俄罗斯学者获专利:新型程序实现科学文本关键词智能提取
该程序将统计方法与语言学知识深度融合
南乌拉尔国立大学的研究人员近日成功获得一项软件产品专利。该程序旨在从多语种、各体裁的文本中,自动提取由一至四个词汇单位构成的关键词。据TV BRICS合作伙伴高校官网 消息,该软件将广泛应用于各类文本处理任务。
该程序支持两种运行模式。第一种为全自动模式:系统可自主处理文档并直接输出关键词。第二种为专家模式:专业人员可根据特定语言、学科领域或文本类型手动调整工具参数,并精准界定哪些词汇或词组应被提取为关键词。
该程序的主要开发者、南乌拉尔国立大学语言学与翻译系教授斯韦特兰娜·舍列梅季耶娃表示,该程序不仅能准确提取高频词汇,还能精准识别低频且符合语法规则的词汇组合。
她解释道:“通过交互式界面,该程序能够轻松适配不同的语言和学科领域。”
该应用程序不仅可应用于语言学信息科学研究,还可服务于文本处理的多种场景,包括认知建模、多语种索引、信息检索以及教学实践等。