首页 / 正则 / python-根据正则表达式字典填充Pandas DataFrame列

python-根据正则表达式字典填充Pandas DataFrame列

内容导读

互联网集市收集整理的这篇技术教程文章主要介绍了python-根据正则表达式字典填充Pandas DataFrame列，小编现在分享给大家，供广大互联网技能从业者学习和参考。文章包含1530字，纯文字阅读大概需要3分钟。

内容图文

我有一个如下数据框：

    GE    GO
1   AD    Weiss
2   KI    Ruby
3   OH    Port
4   ER    Rose
5   KI    Rose
6   JJ    Weiss
7   OH    7UP
8   AD    7UP
9   OP    Coke
10  JJ    Stout

并且我正在尝试根据GO列的值添加一列.我当时正在考虑使用字典,但是在我的真实情况下,我需要使用正则表达式来识别部分匹配项.例如：

Dic={'Weiss|\wuby|Sto\w+':'Beer', 'Port|Rose':'Wine','\dUP|Coke':'Soda'}

这会给

    GE    GO    OUT
1   AD    Weiss Beer
2   KI    Ruby  Beer
3   OH    Port  Wine
4   ER    Rose  Wine
5   KI    Rose  Wine
6   JJ    Weiss Beer
7   OH    7UP   Soda
8   AD    7UP   Soda
9   OP    Coke  Soda
10  JJ    Stout Beer

lambda函数在这里可以工作吗？我将如何使其成为正则表达式？提前致谢！

解决方法:

您可以这样操作：

In [253]: df['OUT'] = df[['GO']].replace({'GO':Dic}, regex=True)

In [254]: df
Out[254]:
    GE     GO   OUT
1   AD  Weiss  Beer
2   KI   Ruby  Beer
3   OH   Port  Wine
4   ER   Rose  Wine
5   KI   Rose  Wine
6   JJ  Weiss  Beer
7   OH    7UP  Soda
8   AD    7UP  Soda
9   OP   Coke  Soda
10  JJ  Stout  Beer

有趣的观察-在较早的Pandas版本中,与DataFrame.replace()和Series.str.replace()方法相比,Series.map()方法几乎总是更快.在Pandas 0.19.2中变得更好：

In [267]: df = pd.concat([df] * 10**4, ignore_index=True)

In [268]: %timeit df.GO.map(lambda x: next(Dic[k] for k in Dic if re.search(k, x)))
1 loop, best of 3: 1.57 s per loop

In [269]: %timeit df[['GO']].replace({'GO':Dic}, regex=True)
1 loop, best of 3: 895 ms per loop

In [270]: %timeit df.GO.replace(Dic, regex=True)
1 loop, best of 3: 876 ms per loop

In [271]: df.shape
Out[271]: (100000, 2)

内容总结

以上是互联网集市为您收集整理的python-根据正则表达式字典填充Pandas DataFrame列全部内容，希望文章能够帮你解决python-根据正则表达式字典填充Pandas DataFrame列所遇到的程序开发问题。如果觉得互联网集市技术教程内容还不错，欢迎将互联网集市网站推荐给程序员好友。

内容备注

版权声明：本文内容由互联网用户自发贡献，该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容，请发送邮件至 gblab@vip.qq.com 举报，一经查实，本站将立刻删除。

内容手机端

扫描二维码推送至手机访问。

本文链接：https://qyyshop.com/info/693271.html

来源：【匿名】

【上一篇】Python中的非使用正则表达式拆分【下一篇】正则表达式语法

更多 ►

【python-根据正则表达式字典填充Pandas DataFrame列】教程文章相关的互联网学习教程文章

python-根据正则表达式字典填充Pandas DataFrame列【代码】

我有一个如下数据框：GE GO 1 AD Weiss 2 KI Ruby 3 OH Port 4 ER Rose 5 KI Rose 6 JJ Weiss 7 OH 7UP 8 AD 7UP 9 OP Coke 10 JJ Stout并且我正在尝试根据GO列的值添加一列.我当时正在考虑使用字典,但是在我的真实情况下,我需要使用正则表达式来识别部分匹配项.例如：Dic={'Weiss|\wuby|Sto\w+':'Beer', 'Port|Rose':'Wine','\dUP|Coke':'Soda'}这会给GE GO OUT 1 A...

如何使用正则表达式删除python pandas DataFrame中的行？【代码】

我有一个模式：patternDel = "( \\((MoM|QoQ)\\))";我想删除pandas dataframe中的所有行,其中列df [‘Event Name’]匹配此模式.这是最好的方法吗？数据帧中有超过100k行.解决方法:str.contains()返回一系列布尔值,我们可以使用它来索引我们的帧patternDel = "( \\((MoM|QoQ)\\))" filter = df['Event Name'].str.contains(patternDel)我倾向于保留我们想要的东西而不是删除行.由于filter表示我们要删除的内容,因此我们使用?来获取所...

正则 - 最热教程

java正则表达式匹配所有数字，包括带小...UltraEdit正则表达式搜索替换小技巧 php正则表达式，允许有数字，字母，和标...jquery取字符串中数字的正则_jquery 分享正则表达式注册表验证和一些常用的...php正则表达式的特殊字符含义_PHP教程 SwiftUI iOS 超酷组件之支持文本分割炸...python 正则表达式与JSON-JSON java-检查字符串是否仅包含字母空格和引...java网页爬虫正则表达式

首页 / 正则 / python-根据正则表达式字典填充Pandas DataFrame列

python-根据正则表达式字典填充Pandas DataFrame列

内容导读

内容图文

内容总结

内容备注

内容手机端

【python-根据正则表达式字典填充Pandas DataFrame列】教程文章相关的互联网学习教程文章

python-根据正则表达式字典填充Pandas DataFrame列【代码】

如何使用正则表达式删除python pandas DataFrame中的行？【代码】

PYTHON - 相关标签

正则表达式 - 相关标签

正则 - 最新教程

正则 - 最热教程