设为首页收藏本站

LUPA开源社区

 找回密码
 注册
文章 帖子 博客
LUPA开源社区 首页 业界资讯 软件追踪 查看内容

Apache OpenNLP 1.8.0发布,自然语言处理工具

2017-5-21 18:34| 发布者: joejoe0332| 查看: 508| 评论: 0|原作者: oschina|来自: oschina

摘要: Apache OpenNLP 1.8.0 发布了,OpenNLP 是一个机器学习工具包,用于处理自然语言文本。支持大多数常用的 NLP 任务,例如:标识化、句子切分、部分词性标注、名称抽取、组块、解析等。此版本带来了许多新功能、改进和 ...

Apache OpenNLP 1.8.0 发布了,OpenNLP 是一个机器学习工具包,用于处理自然语言文本。支持大多数常用的 NLP 任务,例如:标识化、句子切分、部分词性标注、名称抽取、组块、解析等。

此版本带来了许多新功能、改进和错误修复。API 已经得到改进以获得更好的一致性,并且删除了许多不被赞同的方法。

更新如下:

  • POS Tagger context generator now supports feature generation XML

  • Add a Name Finder feature generator that adds POS Tag features

  • Add CONLL-U format support

  • Improve default Name Finder settings

  • TokenNameFinderEvaluator CLI now support nameTypes argument

  • Stupid backoff is now the default in NGramLanguageModel

  • Language codes now are ISO 639-3 compliant

  • Add many unit tests

  • Distribution package now includes example parameters file

  • Now prefix and suffix feature generators are configurable

  • Remove API in Document Categorizer for user specified tokenizer

  • Learnable lemmatizer now returns all possible lemmas for a given word and pos tag

  • Lemmatizer API backward compatibility break: no need to encode/decode lemmas anymore, now LemmatizerME lemmatize method returns the actual lemma

  • Add stemmer, detokenizer and sentence detection abbreviations for Irish

  • Chunker SequenceValidator signature changed to allow access to both token and POS tag

下载地址:

https://opennlp.apache.org/download.html

酷毙

雷人

鲜花

鸡蛋

漂亮
  • 快毕业了,没工作经验,
    找份工作好难啊?
    赶紧去人才芯片公司磨练吧!!

最新评论

关于LUPA|人才芯片工程|人才招聘|LUPA认证|LUPA教育|LUPA开源社区 ( 浙B2-20090187 浙公网安备 33010602006705号   

返回顶部