|
|
|
题名
|
作者
|
年代
|
出处
|
被引量
|
| 1 | 文本信息处理研究述评显示文摘文本信息处理就是通过计算机对文本从表及里、由此及彼的分析处理,不仅仅抽取包含其中的信息,更需要分析推理蕴涵其中的意义。全面地分析探讨了文本信息处理研究现状,概述了文本信息处理的发展历史,将文本信息处理研究归纳为分词研究、文本信息抽取、文本分类、文本信息检索、文本自动摘要等方面,并分别对各领域的研究现状做了概述,指出了各研究领域中存在的问题。讨论了文本信息处理的关键技术问题及其挑战,指出了文本信息处理的远景目标就是文本信息的语义分析、归纳推理和文语转换。 | 袁鼎荣 钟宁 张师超 | 2011 | 计算机科学2011,38,2: | 11 |
| 2 | 基于TextRank的关键词提取算法显示文摘关键字提取是自然语言处理中一项重要任务,也是很多自然语言处理任务的基础步骤,做好自然语言处理能够大大提高其他任务的精度,本文主要介绍如何用Text Rank做关键字提取。文章前面主要介绍关键字提取背景、意义和应用,文章第二部分对中文分词、文档图模型构建、Text Rank原理做了重点介绍,包括了自然语言处理中的统计语言模型,机器学习中Text Rank算法。 | 门家乐 | 2018 | 电子世界2018,0,15: | 5 |
| 3 | Web页面信息主动检索模型显示文摘单个页面信息量远远大于特定用户对页面中的信息需求.为快速准确从当前页面中获取特定用户所需求的兴趣信息,提出了页面信息主动检索模型.该检索模型中,根据页面Block特点将当前Web页面转化成信息树,根据用户过去的浏览行为构造用户特征树,挖掘用户特征树产生用户需求信息集,然后从当前页面中检索需求的信息,获取用户兴趣信息集.详述了主动检索的基本原理,给出了相应的算法描述,并通过实验证明了该模型具有可行性. | 袁鼎荣 钟宁 | 2010 | 智能系统学报2010,5,2: | 1 |
| 4 | 基于属性论的自动摘要技术显示文摘最近几年越来越多的人使用互联网收集信息,与此同时,互联网的可用信息正呈指数级增长,信息增长成为每个用户必须面对的问题。用户想要大概地了解一篇文章的大概意思有很多方式,其中最主要的方式是通过摘要,因此自动生成摘要是一项重要任务。通过属性论方法,建立一个接近于自然语言的属性坐标知识库,找到文本的关键字,通过知识图谱来自动生成文本摘要。 | 杨宁宁 冯嘉礼 | 2014 | 现代计算机2014,20,6: | 0 |
| 5 | 基于Silo的科学计算结果数据的管理与可视化显示文摘在某数值模拟可视化软件研制中,为了对不同类型的数值模拟结果进行统一管理和可视化,采用Silo格式文件管理数值结果,并将其应用于可视化工具VisIt中。对MCNP,FDTD,Fluent等数值模拟程序计算结果中的曲线、网格及相关联的标量、矢量等数据进行提取,写为Silo格式文件,并给出了其在VisIt中的可视化效果。结果表明:不同类型的数值模拟结果数据可通过Silo格式文件进行综合管理,并可在VisIt中得到高效的可视化。 | 王延红 田传艳 杨平利 黄少华 | 2011 | 现代电子技术2011,34,8: | 0 |
| 6 | 基于竞争学习网络的中文关键字提取算法显示文摘为提高中文关键字的提取准确率,提出一种基于竞争学习网络的中文关键字提取算法。对文章进行分词,得到单个词组或短语,视其为单个神经元,将神经元输入竞争学习网络的输入层,通过竞争层上神经元的相互竞争,获得一个或几个活跃的神经元,使用合并权值及聚类分析方法得到文章的关键字。实验结果表明,该算法提取关键字的平均命中率高于词频-逆文档频率算法和传统的词频算法,鲁棒性较好。 | 沈学利 程宇伟 | 2013 | 计算机工程2013,39,2: | 0 |