CSpace  > 中国科学院计算技术研究所期刊论文  > 中文
面向文本数字化的自动纠错方法
陈翔1; 徐平先2; 张玉志1
2008
发表期刊计算机应用研究
ISSN1001-3695
卷号25.0期号:005页码:1434
摘要为了提高文本数字化系统的质量,针对该系统的错误特点,采用频率统计树构建查错模型,结合切分信息进行标点纠错,通过表形码和缓存集给出纠错建议,提出了规则与统计结合的自动纠错方法。实验结果表明,该方法召回率为84.65%,准确率为78.89%,误判率为9.07%,能够满足数字化系统需求。
关键词自动纠错 文本数字化 频率统计树 切分信息 表形码
语种英语
文献类型期刊论文
条目标识符http://119.78.100.204/handle/2XEOYT63/34754
专题中国科学院计算技术研究所期刊论文_中文
作者单位1.中国科学院计算技术研究所
2.点通数据有限公司
第一作者单位中国科学院计算技术研究所
推荐引用方式
GB/T 7714
陈翔,徐平先,张玉志. 面向文本数字化的自动纠错方法[J]. 计算机应用研究,2008,25.0(005):1434.
APA 陈翔,徐平先,&张玉志.(2008).面向文本数字化的自动纠错方法.计算机应用研究,25.0(005),1434.
MLA 陈翔,et al."面向文本数字化的自动纠错方法".计算机应用研究 25.0.005(2008):1434.
条目包含的文件
条目无相关文件。
个性服务
推荐该条目
保存到收藏夹
查看访问统计
导出为Endnote文件
谷歌学术
谷歌学术中相似的文章
[陈翔]的文章
[徐平先]的文章
[张玉志]的文章
百度学术
百度学术中相似的文章
[陈翔]的文章
[徐平先]的文章
[张玉志]的文章
必应学术
必应学术中相似的文章
[陈翔]的文章
[徐平先]的文章
[张玉志]的文章
相关权益政策
暂无数据
收藏/分享
所有评论 (0)
暂无评论
 

除非特别说明,本系统中所有内容都受版权保护,并保留所有权利。