import jieba
import jieba.analyse
import jieba.possegdef dosegment_all(sentence):'''带词性标注,对句子进行分词,不排除停词等:param sentence:输入字符:return:'''sentence_seged = jieba.posseg.cut(sentence.strip())outstr = ''for x in sentence_seged:outstr+="{}/{},".format(x.word,x.flag)#上面的for循环可以用python递推式构造生成器完成# outstr = ",".join([("%s/%s" %(x.word,x.flag)) for x in sentence_seged])return outstr
Example:
苹果官网iPhone降价!再次惊觉了神网友们的才华 一群同学
苹果/n,官网/n,iPhone/n,降价/n,!/x,再次/d,惊觉/a,了/ul,神/n,网友/n,们/k,的/uj,才华/nr, /x,一群/m,同学/n,

Ag

形语素

形容词性语素。形容词代码为 a,语素代码g前面置以A。

a

形容词

取英语形容词 adjective的第1个字母。

ad

副形词

直接作状语的形容词。形容词代码 a和副词代码d并在一起。

an

名形词

具有名词功能的形容词。形容词代码 a和名词代码n并在一起。

b

区别词

取汉字“别”的声母。

c

连词

取英语连词 conjunction的第1个字母。

dg

副语素

副词性语素。副词代码为 d,语素代码g前面置以D。

d

副词

取 adverb的第2个字母,因其第1个字母已用于形容词。

e

叹词

取英语叹词 exclamation的第1个字母。

f

方位词

取汉字“方”

g

语素

绝大多数语素都能作为合成词的“词根”,取汉字“根”的声母。

h

前接成分

取英语 head的第1个字母。

i

成语

取英语成语 idiom的第1个字母。

j

简称略语

取汉字“简”的声母。

k

后接成分

 

l

习用语

习用语尚未成为成语,有点“临时性”,取“临”的声母。

m

数词

取英语 numeral的第3个字母,n,u已有他用。

Ng

名语素

名词性语素。名词代码为 n,语素代码g前面置以N。

n

名词

取英语名词 noun的第1个字母。

nr

人名

名词代码 n和“人(ren)”的声母并在一起。

ns

地名

名词代码 n和处所词代码s并在一起。

nt

机构团体

“团”的声母为 t,名词代码n和t并在一起。

nz

其他专名

“专”的声母的第 1个字母为z,名词代码n和z并在一起。

o

拟声词

取英语拟声词 onomatopoeia的第1个字母。

p

介词

取英语介词 prepositional的第1个字母。

q

量词

取英语 quantity的第1个字母。

r

代词

取英语代词 pronoun的第2个字母,因p已用于介词。

s

处所词

取英语 space的第1个字母。

tg

时语素

时间词性语素。时间词代码为 t,在语素的代码g前面置以T。

t

时间词

取英语 time的第1个字母。

u

助词

取英语助词 auxiliary

vg

动语素

动词性语素。动词代码为 v。在语素的代码g前面置以V。

v

动词

取英语动词 verb的第一个字母。

vd

副动词

直接作状语的动词。动词和副词的代码并在一起。

vn

名动词

指具有名词功能的动词。动词和名词的代码并在一起。

w

标点符号

 

x

非语素字

非语素字只是一个符号,字母 x通常用于代表未知数、符号。

y

语气词

取汉字“语”的声母。

z

状态词

取汉字“状”的声母的前一个字母。

un

未知词

不可识别词及用户自定义词组。取英文Unkonwn首两个字母。(非北大标准,CSW分词中定义)

Jieba分词词性标注以及词性说明相关推荐

  1. jieba分词-词性标注

    结巴分词4--词性标注 作者:zhbzz2007 出处:http://www.cnblogs.com/zhbzz2007 1 简介 词性(part-of-speech)是词汇基本的语法范畴,通常也称为 ...

  2. jieba分词词性标注含义

    结巴分词的词性标注 默认模式是使用jieba.posseg.cut(),包括24个词性标签(小写字母). paddle模式多了4个专名类别标签(大写字母). jieba.posseg.POSToken ...

  3. jieba分词中所有词性对应字母符号显示(词性列表及符号表示)

    1. 名词 (1个一类,7个二类,5个三类) n 名词 nr 人名 nr1 汉语姓氏 nr2 汉语名字 nrj 日语人名 nrf 音译人名 ns 地名 nsf 音译地名 nt 机构团体名 nz 其它专 ...

  4. python中正则表达式与jieba分词的使用

    这次和大家分享一下主要使用正则表达式匹配文本信息内容的案例,其中还用到了jieba分词词性标注技术,和一些对文本的切片工作.有兴趣学习的可以详细看看,具体内容,应该有点帮助,这是本人一个一个代码敲出来 ...

  5. Pytorch:jieba分词、hanlp分词、词性标注、命名实体识别、one-hot、Word2vec(CBOW、skipgram)、Word Embedding词嵌入、fasttext

    日萌社 人工智能AI:Keras PyTorch MXNet TensorFlow PaddlePaddle 深度学习实战(不定时更新) 文本预处理及其作用: 文本语料在输送给模型前一般需要一系列的预 ...

  6. jieba分词原理 ‖ 词性标注

    jieba分词原理 | 基于前缀词典及动态规划的分词实现 jieba分词原理 | 基于汉字成词能力的HMM模型识别未登录词实现 jieba分词原理 | 词性标注 jieba分词原理 | 关键词抽取 1 ...

  7. jieba分词的词性表

    注:jieba分词的词性表如下: 另附词性标注表如下: 1. 名词 (1个一类,7个二类,5个三类) 名词分为以下子类: n 名词 nr 人名 nr1 汉语姓氏 nr2 汉语名字 nrj 日语人名 n ...

  8. 分词并显示词性jieba.posseg.cut()

    [小白从小学Python.C.Java] [计算机等级考试+500强双证书] [Python-数据分析] 分词并显示词性 jieba.posseg.cut() [太阳]选择题 以下python代码结果 ...

  9. 2.5.jieba分词工具、Jieba安装、全模式/精确模式、添加自定义词典、关键词抽取、词性标注、词云展示

    2.5.jieba分词工具 2.5.1.Jieba安装 2.5.2.全模式/精确模式 2.5.3.添加自定义词典 2.5.4.关键词抽取 2.5.5.词性标注 2.5.6.词云展示 2.5.jieba ...

最新文章

  1. MyBatis源码流程分析
  2. pyqt5切换python版本_PyQt5每天必学之切换按钮_python
  3. APM - 零侵入监控JDBC服务
  4. java i o流异常问题_第四章 Java的I/O流和异常处理
  5. mysql 卸载批处理_MYSQL 注册启动 及 停用卸载 批处理脚本 (补)
  6. 自动化运维工具Ansible连续剧之--介绍安装与连接
  7. http 升级 https 影响原来的链接吗_360站长平台自动收录JS切换为https
  8. 20个 CSS 快速提升技巧
  9. Oracle Database 中 B*Tree 索引内部维护
  10. Android 节日短信送祝福(功能篇:2-短信历史记录Fragment的编写)
  11. python中类的构成_Python中类型关系和继承关系实例详解
  12. mysql startswith_Java startsWith()方法
  13. C#使用OpcNetApi.dll和OpcNetApi.Com.dll操作OPC
  14. java实现归并排序
  15. java 对话 智能,如何用Java实现智能对话机器人
  16. 一款使用RxJava+Retrofit+MVP的快播App开源啦!
  17. JDBC数据库驱动的下载、安装与连接
  18. Android群英传知识点回顾——第七章:Android动画机制与使用技巧
  19. SDR SDRAM控制器设计
  20. android toast通知关闭,Android Toast通知用法实例详解

热门文章

  1. nginx-vts监控模块
  2. sniper photo
  3. Linux简单入门命令
  4. 基于Matlab的车牌识别系统完整版课论文分享 快看
  5. 怎样实现url隐形转发?
  6. python中算术位移运算
  7. 求助应用Netlogo做交通出行方式选择仿真
  8. word怎么删除空白页,Word Mac删除空白页面的图文方法
  9. Qt播放HTML网页视频
  10. ADC模块的相关介绍