首页 | 本学科首页   官方微博 | 高级检索  
     检索      

基于条件随机场的中文分词方法
引用本文:迟呈英,于长远,战学刚.基于条件随机场的中文分词方法[J].情报杂志,2008,27(5):79-81.
作者姓名:迟呈英  于长远  战学刚
作者单位:辽宁科技大学,鞍山,114051
摘    要:提出了一种基于条件随机场(Conditional Random Fields,简称CRF)的中文分词方法.CRF模型利用词的上下文信息,对歧义词和未登陆词进行分词统计处理取得了理想的效果.以SIGHAN2006 Chinese Language Processing Bakeoff提供的数据作为实验数据.实验数据表明,基于CRF的中文分词方法取得了很好的效果,在Uppen,Msra两种语料的封闭测试中准确率分别达到了95.8%和95.9%.

关 键 词:条件随机场  中文分词  歧义词  未登陆词

A Chinese Word Segmentation Approach Using Conditional Random Fields
Chi Chengying et al..A Chinese Word Segmentation Approach Using Conditional Random Fields[J].Journal of Information,2008,27(5):79-81.
Authors:Chi Chengying
Abstract:
Keywords:
本文献已被 CNKI 维普 万方数据 等数据库收录!
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号