文档名:文本可读性的自动分析研究综述
文本可读性问题最初由教育学家提出,初衷是辅助教师为语言学习者推荐适合其阅读水平的文本.随着计算机技术的发展及网页文本的涌现,对文本进行可读性分析有了更加丰富技术手段和应用场景.本文对可读性自动分析的相关研究进行了梳理,将可读性自动分析的方法总结为公式法、分类法和排序法三类.本文进一步对可读性自动分析中的两项重要内容,数据集的使用和文本特征的选择进行了梳理.最后对可读性研究的发展方向进行展望.
作者:吴思远 蔡建永 于东 江新
作者单位:北京语言大学信息科学学院,北京100083;北京语言大学对外汉语研究中心,北京100083北京语言大学对外汉语研究中心,北京100083;北京语言大学汉语速成学院北京语言大学信息科学学院,北京100083北京语言大学对外汉语研究中心,北京100083
母体文献:第十七届全国计算语言学学术会议暨第六届基于自然标注大数据的自然语言处理国际学术研讨会(CCL2018)论文集
会议名称:第十七届全国计算语言学学术会议暨第六届基于自然标注大数据的自然语言处理国际学术研讨会(CCL2018)
会议时间:2018年10月19日
会议地点:长沙
主办单位:中国中文信息学会
语种:chi
分类号:
关键词:文本可读性 自动分析 特征提取 数据集使用
在线出版日期:2021年9月13日
基金项目:
相似文献
相关博文
- 文件大小:
- 854.51 KB
- 下载次数:
- 60
-
高速下载
|
|