楼主: DL-er
798 0

TF-IDF与规则相结合的中文关键词自动抽取研究 [推广有奖]

  • 0关注
  • 6粉丝

会员

学术权威

74%

还不是VIP/贵宾

-

威望
0
论坛币
15 个
通用积分
1.0435
学术水平
0 点
热心指数
0 点
信用等级
0 点
经验
38540 点
帖子
3853
精华
0
在线时间
813 小时
注册时间
2017-9-5
最后登录
2018-6-30

楼主
DL-er 在职认证  发表于 2018-1-23 17:20:00 |AI写论文

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币
摘要:关键词的抽取广泛应用于自然语言处理过程中.对于中文关键词抽取,分词结果及候选词的选取严重影响后期的抽取结果.针对候选词的选取,提出一种连续单字未登录词识别和多词短语识别的方法来进行候选词选择,可以较好的识别出频率大于1的未登录词,且不依赖于语料库规模和领域.并且,在传统的TF-IDF基础上,结合位置特征和长度特征的情况下,考虑兼类词的不同词性问题,提出改进的TF-IDF计算公式,进行关键词抽取.通过比较实验,证明了候选词对关键词抽取的影响,与TF-IDF进行比较实验,改进的TF-IDF的准确率提高了5%左右.

原文链接:http://www.cqvip.com//QK/95659X/201604/668342196.html

送人玫瑰,手留余香~如您已下载到该资源,可在回帖当中上传与大家共享,欢迎来CDA社区交流学习。(仅供学术交流用。)

二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:关键词 相结合 cqvip HTML HTTP 抽取 未登录词识别 候选词抽取 TF-IDF

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
jg-xs1
拉您进交流群
GMT+8, 2026-1-5 07:22