Py之zhon:zhon库的简介、安装、使用方法之详细攻略

Py之zhon:zhon库的简介、安装、使用方法之详细攻略

 

 

目录

zhon库的简介

zhon库的安装

zhon库的使用方法

1、在字符串中查找CJK字符、验证拼音音节、单词或句子:


 

zhon库的简介

         Zhon是一个Python库,它提供了中文文本处理中常用的常量。

包括常用常量:

  • 中日韩文字和部首
  • 中文标点符号
  • 汉语句子规则表达模式
  • 拼音元音、辅音、小写、大写和标点符号
  • 拼音音节、单词和句子规则表达模式
  • 诸印文字
  • 竹音音节规则表达模式
  • CC-CEDICT字符

 

 

 

zhon库的安装

pip install zhon

 

 

 

zhon库的使用方法

1、在字符串中查找CJK字符、验证拼音音节、单词或句子:

在字符串中查找CJK字符:

>>> re.findall('[%s]' % zhon.hanzi.characters, 'I broke a plate: 我打破了一个盘子.')
['我', '打', '破', '了', '一', '个', '盘', '子']


验证拼音音节、单词或句子:
>>> re.findall(zhon.pinyin.syllable, 'Yuànzi lǐ tíngzhe yí liàng chē.', re.I)
['Yuàn', 'zi', 'lǐ', 'tíng', 'zhe', 'yí', 'liàng', 'chē']

>>> re.findall(zhon.pinyin.word, 'Yuànzi lǐ tíngzhe yí liàng chē.', re.I)
['Yuànzi', 'lǐ', 'tíngzhe', 'yí', 'liàng', 'chē']

>>> re.findall(zhon.pinyin.sentence, 'Yuànzi lǐ tíngzhe yí liàng chē.', re.I)
['Yuànzi lǐ tíngzhe yí liàng chē.']

 

 

 

 

 

 

一个处女座的程序猿 CSDN认证博客专家 华为杯研电赛一等 华为研数模一等奖 国内外AI竞十
人工智能硕博生,目前兼职国内外多家头部人工智能公司的AI技术顾问。拥有十多项发明专利(6项)和软件著作权(9项),多个国家级证书(2个国三级、3个国四级),先后获得国内外“人工智能算法”竞赛(包括国家级、省市级等,一等奖5项、二等奖4项、三等奖2项)相关证书十多个,以上均以第一作者身份,并拥有省市校级个人荣誉证书十多项。正在撰写《人工智算法最新实战》一书,目前已37万字。
已标记关键词 清除标记
©️2020 CSDN 皮肤主题: 代码科技 设计师:Amelia_0503 返回首页
实付 29.90元
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、C币套餐、付费专栏及课程。

余额充值