温馨提示×

温馨提示×

您好,登录后才能下订单哦!

密码登录×
登录注册×
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》

Python中怎么利用正则表达式提取文本

发布时间:2021-07-10 14:21:14 来源:亿速云 阅读:479 作者:Leah 栏目:大数据

这篇文章将为大家详细讲解有关Python中怎么利用正则表达式提取文本,文章内容质量较高,因此小编分享给大家做个参考,希望大家阅读完这篇文章后对相关知识有一定的了解。

用OCR工具把信息提取出来如下:

提取文本
Keratin type ll cytoskeletal 1 OS=Homo sapiens OX=9606 GN=KRT1 PE=1 SV=6
Keratin type I cytoskeletal 10 OS=Homo sapiens OX=9606 GN=KRT10 |PE=1 SV=6
Pyruvate carboxylase mitochondrial OS=Homo sapiens OX=9606 GN=PC PE=1 SV=2

解题:

# 加载数据
df

Python中怎么利用正则表达式提取文本

# 数据处理
df["提取文本"].str.extract("GN=(\w+) ")

Python中怎么利用正则表达式提取文本

关于Python中怎么利用正则表达式提取文本就分享到这里了,希望以上内容可以对大家有一定的帮助,可以学到更多知识。如果觉得文章不错,可以把它分享出去让更多的人看到。

向AI问一下细节

免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

AI