加载中...

Stanford CoreNLP 是斯坦福大学自然语言处理组开发的 Java 语言处理工具套件,将该组多年积累的分词、词性标注、命名实体识别、句法分析、依存分析、指代消解、情感分析等组件整合为统一的标注流水线,长期是学术研究的标准基线工具。
用户以「annotator」列表声明所需处理步骤,CoreNLP 按依赖顺序依次执行并将结果写入统一的文档对象,支持命令行、Java API 和 HTTP 服务三种使用方式,输出 JSON、XML 等格式,并提供多语言模型,包括中文。
斯坦福 NLP 组后续推出了基于 PyTorch 的 Stanza 工具包,以神经网络流水线支持 60 余种语言,并可作为 CoreNLP 的 Python 接口。著名的 Stanford Parser、Stanford NER 均已并入 CoreNLP。
虽被深度学习框架分流,CoreNLP 在需要规则可控、组件成熟的场景仍被采用。

登录 后参与讨论
暂无讨论,来发表第一条评论吧