首页| JavaScript| HTML/CSS| Matlab| PHP| Python| Java| C/C++/VC++| C#| ASP| 其他|
购买积分 购买会员 激活码充值

您现在的位置是:虫虫源码 > Java > 中文信息处理过程中去除停用词的一段代码

中文信息处理过程中去除停用词的一段代码

  • 资源大小:4.23 kB
  • 上传时间:2021-06-29
  • 下载次数:0次
  • 浏览次数:1次
  • 资源积分:1积分
  • 标      签: java

资 源 简 介

中文信息处理过程中去除停用词的一段代码,稍作修改便可直接使用。在信息检索中,为节省存储空间和提高搜索效率,在处理自然语言数据(或文本)之前或之后会自动过滤掉某些字或词,这些字或词即被称为Stop Words(停用词)。

文 件 列 表

去停用词的一段示例程序
ExcludeStopWords.java
StopWords.txt

相 关 资 源

您 可 能 感 兴 趣 的

同 类 别 推 荐

VIP VIP