介绍
这篇文章主要介绍了python中去掉标点符号的方法,具有一定借鉴价值,需要的朋友可以参考下。希望大家阅读完这篇文章后大有收获。下面让小编带着大家一起了解一下。
既然是去掉标点符号,那当然是用正则表达式啦。
正则表达式,又称规则表达式。(英语:正则表达式,在代码中常简写为正则表达式,正则表达式或重新),计算机科学的一个概念。正则表达式通常被用来检索,替换那些符合某个模式(规则)的文本。
<强>正则表达式是对字符串操作的一种逻辑公式,就是用事先定义好的一些特定字符,及这些特定字符的组合,组成一个“规则字符串”,这个“规则字符串”用来表达对字符串的一种过滤逻辑。强>
<强>给定一个正则表达式和另一个字符串,我们可以达到如下的目的:强>
1。给定的字符串是否符合正则表达式的过滤逻辑(称作“匹配”):
2。可以通过正则表达式,从字符串中获取我们想要的特定部分。
可以对字符串中的标点符号进行过滤,从而达到去掉或替换标点符号的效果。
进口稀土 标点符号=& # 39;!;:?“\ & # 39;& # 39; def removePunctuation(文本): 文本=re.sub (" # 39; ({}) + & # 39; .format(标点符号),& # 39;& # 39;,文本) 返回text.strip () .lower () 文本=?你好,世界!“; 打印removePunctuation(文本)
<强>正则表达式的特点是:强>
1。灵活性,逻辑性和功能性非常强;
2。可以迅速地用极简单的方式达到字符串的复杂控制。
3。对于刚接触的人来说,比较晦涩难懂。
感谢你能够认真阅读完这篇文章,希望小编分享python中去掉标点符号的方法内容对大家有帮助,同时也希望大家多多支持,关注行业资讯频道,遇到问题就找,详细的解决方法等着你来学习!