没有合适的资源?快使用搜索试试~ 我知道了~
如何用TF-IDF算法提取文本中的关键词?
2 下载量 19 浏览量
2021-01-27
11:37:24
上传
评论
收藏 546KB PDF 举报
温馨提示
试读
5页
IDF,是“InverseDocumentFrequency”(逆文档频率)的缩写。我觉得这个算法可用于帮助译者提取一篇待译文章中的“术语”,所以准备写一篇文章来简要介绍这个算法的实现方法。我将使用百度的分词技术来处理中文文本,用以计算中文词语的“TF-IDF”值。在本公众号之前的文章中,我们已经介绍了如何引入百度的分词API,本文就不再介绍细节了。首先启动本地开发环境XAMPP,将百度分词API下载到工作文件夹(下图的api文件夹中):在“index.php”中输入百度分词API引入模板,并在指定位置填写基本信息: 填入API信息,并测试是否能够成功分词:index.php在浏览器中
资源推荐
资源评论
资源评论
weixin_38651365
- 粉丝: 3
- 资源: 922
上传资源 快速赚钱
- 我的内容管理 展开
- 我的资源 快来上传第一个资源
- 我的收益 登录查看自己的收益
- 我的积分 登录查看自己的积分
- 我的C币 登录后查看C币余额
- 我的收藏
- 我的下载
- 下载帮助
安全验证
文档复制为VIP权益,开通VIP直接复制
信息提交成功