|
1
|
| M. A. Kishawy Andy Guibert · 技术社区 · 16 年前 |
|
|
1
1
对我来说,似乎有3个元字段:
MF1:
MF2:
MF3:
其中mf2是可选的。我的分隔符是: MF1至[上午下午] MF2号,地下室除外-* MF3地下室-* 我不太擅长正则表达式,但我会将这三个组提取为
在哪里?表示可选组。 |
|
|
2
2
好吧,您可以按列号删除日期和basement-foo数据,因为它们总是出现在行中的同一点上。然后,可以基于逗号拆分其余部分。是否需要处理转义逗号,或引号“foo,bar”中的逗号取决于您和您的业务需求。 |
|
|
3
1
你可以做到:
|
|
|
4
0
找出每行空白字符与非空白字符相邻的列,然后对这些数字进行统计分析:每行或几乎每行出现的数字很可能是字段边界。 类似地,对于与字母相邻的标点符号,但一般来说,不可能猜测a-或a是否意味着要分隔字段。如果它出现在每一行的同一位置,它可能是一个分隔符,但在诸如d-fl r-tx d-ny之类的列表中,它可能不是。因此,对于任意数据不可能有完全自动的解决方案。 |
|
|
5
0
由于每个字段都是非常不同的(至少在上面粘贴的示例中如此),因此可以执行以下操作:
|
|
|
6
-2
你可以使用 Strtokenizer 从commons lang并指定要拆分的多个分隔符: 有许多内置类型通过 StrMatcher .
例如
将给出(从上面的示例中):
|
|
|
Essi · R-基于匹配值从另一个数据帧添加数据[重复] 8 年前 |
|
|
wen tian · 使用beautifulsoup从网站中提取数字? 8 年前 |
|
|
Ty Kayn · PHP7中的ZipArchive找不到zip的内容 8 年前 |
|
|
YazOT · 使用python从文本文件中提取特定行 8 年前 |
|
|
plaidshirt · JMeter JSON提取器按条件获取值 8 年前 |
|
|
Pau · 从字符串中提取超链接的Php函数 8 年前 |
|
|
kroy2008 · 从选定尾注生成的字符串中提取文本 8 年前 |
|
|
Fabio Favoretto · 在R中匹配不同数据帧中的站点 9 年前 |