Python 强大的模式匹配工具

简说Python 1周前

以下文章来源于Python实用宝典 ,作者Ckend

简说Python推荐
来源|Python实用宝典
作者|Ckend

在自然语言处理界,模式匹配可以说是最常用的技术。甚至可以说,将NLP技术作为真实生产力的项目都少不了模式匹配

什么是模式匹配呢?在计算机科学中,往往是检查给定的序列或字符串中是否有符合某种模式的片段。比如说:“啊,你的AK-47打得真准”,如果我们将 “啊,你的_____打得真准 ” 作为一种模式,则会将AK-47匹配出来。

实现模式匹配往往都是用正则表达式,但是如果你想识别特别复杂的模式,编写正则表达式就会变得非常非常麻烦。而Pampy这个项目能解决你不少的烦恼。https://github.com/santinic/pampy

下面是一个使用例子:

1.安装

赶紧让我们来试一下,安装Pampy前,你要确保Python和pip已经成功安装在电脑上噢,如果没有,请访问这篇文章:超详细Python安装指南

打开Cmd(开始—运行—CMD)或Terminal(command+空格输入Terminal). 输入以下命令安装Pampy:

pip install pampy

看到 Successfully installed pampy-0.3.0 则说明安装成功。

2.使用

特性1:HEAD 和 TAIL

HEAD和TAIL能代表某个模式的前面部分或后面部分。

比如将特定模式后的元素都变成元组:

from pampy import match, HEAD, TAIL, _x = [-1, -2, -3, 0, 1, 2, 3]print(match(x, [-1, TAIL], lambda t: [-1, tuple(t)]))# => [-1, (-2, -3, 0, 1, 2, 3)]

将特定模式前的元素设为集合,后面的元素设为元组:

from pampy import match, HEAD, TAIL, _

x = [-1, -2, -3, 0, 1, 2, 3]

print(match(x, [HEAD, _, _, 0, TAIL], lambda h, a, b, t: (set([h, a, b]), tuple(t))))

# => ({-3, -1, -2}, (1, 2, 3))

特性2:甚至能匹配字典中的键

在你不知道哪个键下有某个值的时候,这招非常好用:

from pampy import match, HEAD, TAIL, _

my_dict = {    'global_setting': [1, 3, 3],    'user_setting': {        'face': ['beautiful', 'ugly'],        'mind': ['smart', 'stupid']    }}

result = match(my_dict, { _: {'face': _}}, lambda key, son_value: (key, son_value))

print(result)

# => ('user_setting', ['beautiful', 'ugly'])

特性3: 搭配正则

不仅如此,它还能搭配正则一起使用哦:

import re

from pampy import match, HEAD, TAIL, _

def what_is(pet):    return match(        pet, re.compile('(\w+),(\w)\w+鳕鱼$'), lambda mygod, you: you + "像鳕鱼"    )

print(what_is('我的天,你长得真像鳕鱼'))# => '你像鳕鱼'
(0)

相关推荐

  • Fluentd部署:多Workers进程模式

    本文介绍如何使用Fluentd的多worker模式处理高访问量的日志事件.此模式会运行多个worker进程以最大利用多核CPU. 原理 默认情况下,一个Fluentd实例会运行一个监控进程和一个工作进 ...

  • 理解lambda表达式,为什么用它?

    初学者接触 lambda表达式 ,觉得语法很清奇,正好今天看到 python weekly 推送了一个youtube的视频教程,今天大邓就顺便领大家简单认识一下lambda语法. up主:PyLeni ...

  • Python正则表达式之re.match()分组

    https://www.jianshu.com/p/cc26837242b1 我们在面对生物数据,比如序列信息(比如碱基序列.氨基酸序列等)的时候, 会时常要问,这其中是否包含着且含有多少某种已知的模 ...

  • Python中JSON结构数据的高效增删改操作

    ❝ 本文示例代码及文件已上传至我的Github仓库https://github.com/CNFeffery/DataScienceStudyNotes ❞ 1 简介 在上一期文章中我们一起学习了在Py ...

  • Python 超级强大的模式匹配工具—Pampy

    作者丨Ckend 来源丨Python实用宝典(ID:pythondict) 在自然语言处理界,模式匹配可以说是最常用的技术.甚至可以说,将NLP技术作为真实生产力的项目都少不了模式匹配. 什么是模式匹 ...

  • Python重大变化:match-case模式匹配

    花下猫语:有很多人期待在 Python 中使用 switch-case 语句,Python 社区里针对它有过长达数年的讨论(PEP-275.PEP-3103),然而结论是不支持.我曾在文章< & ...

  • 强大的数学工具:不变量,捕捉数学对象的本质

    当丽莎·皮克西里洛解开了关于"康威结"的这个长达几十年的数学难题时,她必须克服这个结的神秘能力--它能欺骗数学家们设计的一些最强大的工具.这些工具被称为不变量,它不仅是纽结理论的支 ...

  • 一个非常强大的盈利工具!4月29日!

    开头提醒:现在公众号的推送时间线改了,为了大家能每天准时接收到智丽的复盘,不和智丽失联.大家一定要将"智丽淘金"添加星标,同时记得每天点下右下角的"在看"或者评 ...

  • Python入门推荐八大工具!

    Python是一门开源的编程语言,可以帮助我们解决各种各样的事情,几乎是无所不能,因此受到大家的追捧.那么初入门学习Python的你,知道哪个工具更好用吗?下面是小编整理的程序员和学生最常用的一些Py ...

  • 高质量工具 篇二十七:推荐6款实用强大的神器工具,建议你先收藏,总有一天你会用到

    分享6个非常强大的神器工具,每一款都是精品,喜欢的话记得点赞支持哦~ 1.后羿采集器 后羿采集器是前谷歌技术团队倾力打造,基于人工智能技术,只需要输入网址就能自动识别采集内容.支持Win/Mac/Li ...

  • Camera raw渐变滤镜区别于PS渐变,是强大的局部工具,你可能不懂

    Camera raw渐变滤镜区别于PS渐变,是强大的局部工具,你可能不懂

  • 好强大的后期工具:范围遮罩!

    (被点评的照片原图) ................................... 作者提问 徐老师你好,最近拍到一张鸟的照片,很喜欢,想做的漂亮一些,但对自己没信心,麻烦徐老师给看一下,有 ...

  • Python数据挖掘常用的工具有哪些?五大常用库!

    Python是一种非常特殊的编程语言,可应用于不同场景,比如说数据挖掘.运维.爬虫.开发Python都可以广泛的应用.和其他语言对比,Python语法清晰.入门简单.具有丰富的第三方库,因此在数据挖掘 ...

  • python懒人小工具python打包exe小工具

    https://m.toutiao.com/is/euoUrfS/ 不知道有没有菜鸟和我一样,经常需要把python打包成exe,但是比较懒,虽然命令行很简单,但是不太喜欢用命令行,嘿嘿,就干脆写个小 ...