一行Python代码过滤标点符号等特殊字符

站长资源 2024/11/25 佚名

2 0 1

很多时候我们需要过滤掉标点符号等特殊字符，网上虽然有一堆的方法，但是都没有找到一个非常满意的，有些过滤不了中文的标点符号，有些过滤不了英文的标点符号，有些过滤不全。

最后通过查看正则表达式文档，发现一个高效的办法，一行代码就能搞定：

def replace_all_blank(value):
  """
  去除value中的所有非字母内容，包括标点符号、空格、换行、下划线等
  :param value: 需要处理的内容
  :return: 返回处理后的内容
  """
  # \W 表示匹配非数字字母下划线
  result = re.sub('\W+', '', value).replace("_", '')
  print(result)
  return result

其中用到了 Python 的 re 模块， re 模块里面包含了所有的正则表达式的应用。代码里面有几个点：

\W

测试一下：

replace_all_blank("Powe, on；the 2333, 。哈哈 ！！看看可以吗？一行代码就可以了！^_^")

输出结果：

Poweonthe2333哈哈看看可以吗一行代码就可以了

一行代码搞定！Perfect!

最后推荐大家官网 re 模块的正则表达式文档地址：

https://docs.python.org/zh-cn/3.6/library/re.html

知识点扩展：

python过滤中英文标点符号

import re
# 过滤不了\\ \ 中文（）还有————
r1 = u'[a-zA-Z0-9'!"#$%&\'()*+,-./:;<=>"[\s+\.\!\/_,$%^*(+\"\']+|[+——！，。？、~@#￥%……&*（）]+"
# \\\可以过滤掉反向单杠和双杠，/可以过滤掉正向单杠和双杠，第一个中括号里放的是英文符号，第二个中括号里放的是中文符号，第二个中括号前不能少|，否则过滤不完全
r3 = "[.!//_,$&%^*()<>+\"'"
# 去掉括号和括号内的所有内容
r4 = "\\【.*""'"
text = "\崔芸，\\我爱=+你！【我//""们】~————结/婚'吧:：！这.!！_#？"
print(re.sub(r1, , '', text))

总结

以上所述是小编给大家介绍的一行代码Python过滤标点符号等特殊字符,希望对大家有所帮助，如果大家有任何疑问请给我留言，小编会及时回复大家的。在此也非常感谢大家对网站的支持！
如果你觉得本文对你有帮助，欢迎转载，烦请注明出处，谢谢！

python,过滤标点符号,python,特殊字符

广告合作：本站广告合作请联系QQ：858582 申请时备注：广告合作（否则不回）
免责声明：本站资源来自互联网收集,仅供用于学习和交流,请遵循相关法律法规,本站一切资源不代表本站立场,如有侵权、后门、不妥请联系本站删除！

评论“一行Python代码过滤标点符号等特殊字符”

暂无评论...

www.wwsws.com 伏龙阁资源网

39,976影音资源

44,792技术资源

21,817软件资源

651,128站长资源

更新日志

2024年11月25日

一行Python代码过滤标点符号等特殊字符

Django 查询数据库并返回页面的例子

python3 深浅copy对比详解

评论“一行Python代码过滤标点符号等特殊字符”

更新日志

友情链接