线上期刊服务咨询,发表咨询:400-808-1701 订阅咨询:400-808-1721

结合语义知识的藏文网页主题句抽取算法研究

艾金勇 图书馆理论与实践 2017年第08期

摘要:通过分析总结藏文网页的结构特征,在借鉴汉语主题句抽取方法的基础上,提出了结合语义信息的藏文网页主题句抽取算法。该方法根据藏文文本特征实现了网页内容的智能识别,同时,在对识别的文本块进行自动分词后,利用改进TF-IDF方法结合主题词的语义相关性确定了网页文本的主题词,并据此构建了候选主题句集,再通过候选主题句的重要度和分布度计算得到了候选主题句的权值。最后对所有候选主题句按权值大小排序并确定了文本的主题句。

关键词:藏文网页语义信息主题句抽取

单位:西藏民族大学图书馆

注:因版权方要求,不能公开全文,如需全文,请咨询杂志社

图书馆理论与实践

CSSCI南大期刊

¥520.00

关注 35人评论|0人关注