维普中文期刊产品整合服务
共被期刊论文引用了19次 您的检索式:您选中1篇文献正在查看引证文献汇总
    题名 作者 年代 出处 被引量
1基于增量型聚类的自动话题检测研究显示文摘随着网络信息飞速的发展,收集并组织相关信息变得越来越困难.话题检测与跟踪(topic detection andtracking,简称TDT)就是为解决该问题而提出来的研究方向.话题检测是TDT中重要的研究任务之一,其主要研究内容是把讨论相同话题的故事聚类到一起.虽然话题检测已经有了多年的研究,但面对日益变化的网络信息,它具有了更大的挑战性.提出了一种基于增量型聚类的和自动话题检测方法,该方法旨在提高话题检测的效率,并且能够自动检测出文本库中话题的数量.采用改进的权重算法计算特征的权重,通过自适应地提炼具有较强的主题辨别能力的文本特征来提高文档聚类的准确率,并且在聚类过程中利用BIC来判断话题类别的数目,同时利用话题的延续性特征来预聚类文档,并以此提高话题检测的速度.基于TDT-4语料库的实验结果表明,该方法能够大幅度提高话题检测的效率和准确率.张小明 李舟军 巢文涵 2012软件学报2012,23,6:23
2基于双语词典和歧义消解的中英双语专利信息检索研究显示文摘[目的/意义]为了增进知识交流、知识共享,避免专利侵权,研究了基于双语词典和歧义消解的中英双语专利信息检索方案,并将其应用到实际系统开发中。[方法/过程]通过基于双语词典的提问式翻译实现双语专利检索,利用基于潜语义分析的提问式消歧策略进行歧义消解,结合布尔检索模型与向量空间模型构建检索表达式,与专利索引库进行匹配,生成检索结果。[结果/结论]选取'3D打印'领域中英双语专利语料为样本,通过检索实验证明方案的有效性。颜端武 任婷 陶志恒 2018情报理论与实践2018,41,2:9
3潜在语义索引中特征优化技术的研究显示文摘潜在语义索引被广泛应用于信息检索、文本分类、自动问答等领域中。潜在语义索引是一种降维方法,它把共现特征映射到同一维空间上,而非共现特征映射到不同的空间上。在潜在语义索引的语义空间中,共现特征通过文档内部以及文档之间的特征传递关系获得。该文认为这种特征传递关系会引入一些不存在的共现特征,从而降低潜在语义索引的性能,应该对这种特征传递关系进行一些选择,削除不存在的共现特征信息。该文采用文档频率对文档集合进行特征选择,用Complete—Link聚类算法在两个公开语料上进行三个实验,实验结果显示,保留文档频度的10%~15%时,其F1值分别提高了6.5770%,1.9928%和3.3614%。季铎 郑伟 蔡东风 2009中文信息学报2009,23,2:7
4基于潜在语义分析的文本指纹提取方法显示文摘网络化大数据时代的到来丰富了网络空间中的信息资源,然而由于数据资源类型的多样性及其增长的快速性,给网络空间的存储和信息资源的有效利用带来了压力和挑战。该文提出了一种基于潜在语义分析的文本指纹提取方法,该方法是对数据信息的一种压缩表示,是针对目前指纹提取方法语义缺失的一种改进。该方法主要通过奇异值分解获取原始文档的潜在语义特征,然后将原文档向量空间转换到与其对应的潜在语义空间,再根据随机超平面原理将该空间的文档转换成二进制数字指纹,最终用汉明距离来衡量指纹间的差异程度。实验以中国知网上的学术论文作为数据对象,通过对论文文本进行相似度实验和聚类实验对该文提出的方法进行实验验证。实验结果表明该方法能够较好地表征文档语义信息,进而验证了文本语义压缩表示的准确性和有效性。崔彤彤 崔荣一 2018中文信息学报2018,32,5:7
5基于模糊C均值和改进的LSA的文档聚类研究显示文摘文中研究的是文档聚类的方法,即将给定文档集合中的文档进行分类,以达到准确聚类的目的。提出了一种将模糊C均值(FCM)和改进的LSA(Latent Semantic Analysis)相结合进行文档聚类的方法。采用改进的词语特征提取方法构建词-文档矩阵,对该词-文档矩阵进行奇异值分解,从传统的VSM向量空间中提取文本的潜在语义空间,进而将高维的文档向量映射为低维空间的语义向量,文档之间相似度的计算采用文档语义向量的余弦表示。然后采用模糊C均值根据上述计算文档相似度的结果对文档进行聚类。针对校园论坛中的文档数据进行聚类,该方法降低了处理的复杂度同时提高了相似度计算的准确性。实验结果表明该方法对目标文档的聚类有较好的效果,聚类准确性较高。胡永丽 龚沛曾 2010计算机技术与发展2010,20,12:5
6基于相似粗糙集和模糊认知图的文本分类研究显示文摘阐述了基于相似粗糙集和模糊认知图的文本分类问题,提出了一种基于模糊认知图的文本分类推理算法,使文本分类成为一个基于文本特征项的权和特征项与类别的相关度构成的模糊认知图进行推理的结果,最后对该算法进行了实验,并对结果进行了分析。周鑫 张化详 2008计算机工程与设计2008,29,21:4
7基于模糊认知图的文本分类推理算法显示文摘文本分类是信息处理的重要研究方向,现在应用较多的是基于统计计算的分类方法。介绍了利用模糊认知图的文本分类推理理论与算法,该方法是基于数值推理的,实现将统计与规则融合推理,灵活性较大,不需要语料的多次训练,适合于训练不充分和新主题的文本分类和多类分类,并具有一定的鲁棒性。张桂芸 刘洋 王元元 2007计算机工程与应用2007,43,12:4
8基于客户知识的客户CABOSFV聚类显示文摘客户知识的多元性与多源性决定了客户知识的高维特性,而个性化与离散化又决定其稀疏特性。针对客户知识的高维稀疏特性,借助稀疏特征向量及其可加性原理,提出基于客户知识的客户CABOSFV聚类算法,并利用其进行实例分析,检验其相对于传统聚类算法的优越性。刘希宋 喻登科 李玥 2008情报杂志2008,27,2:3
9基于潜在语义分析的智能答疑系统研究与实现显示文摘文中研究的是基于常问问题库(FAQ库)的智能答疑系统。FAQ库是很多智能答疑系统中的一个重要组成部分,它把用户常问的问题和相关答案保存起来,对于用户输入的问题,可以首先在FAQ库中查找答案。如果能够找到相似的问题,就可以直接将问题所对应的答案返回给用户。为解决智能答疑系统因词的同义或多义现象而导致的'漏答'或'错答',采用一种基于加权潜在语义分析模型的相似度计算方法。针对特定教育领域的智能答疑系统,改进了反映词与词之间相关性的权值计算。通过对特定课程中常问问题的实验,结果显示明显优于向量空间模型。乌庆敏 杨思春 2008计算机技术与发展2008,18,9:2
10基于向量空间模型的特征抽取技术分析显示文摘特征降维是基于向量空间模型(VSM)文本分类的关键技术之一,特征抽取是特征降维的主要方法。本文主要分析了几种常用的特征抽取方法,并给出了它们的实现步骤。任克强 张国萍 赵光甫 2007科技广场2007,,9:1
11面向自然语言生成的词汇选择研究显示文摘词汇选择是自然语言生成研究的关键问题,主要研究如何将意思表示映射为恰当词语。目前许多自然语言处理系统仍没有采取恰当的选词策略,选词效果非常不理想。本文从词汇选择研究的理论和方法两个方面,对当前词汇选择研究现状进行梳理,重点分析了当前研究存在的重点和难点,介绍了现有研究在词义表示、词汇选择建模等方面的方法;并介绍了今后词汇选择研究可能的发展趋势。王星星 李琳 赵小兵 2023中央民族大学学报(自然科学版)2023,32,3:1
12基于子空间优化的潜在语义标引技术研究显示文摘潜在语义标引是一项无监督的特征抽取技术,并且其有效性在信息检索等多个研究领域得到证明。由于该技术的特征抽取效果完全依赖于数据的特征分布,因此对数据的优化能够较好改善技术的有效性。提出了一种潜在语义标引的优化技术-增广空间模型,同时提出了基于文档长度和特征DF分布状态的数据分割策略,该策略的提出能够使子空间尽可能继承原始空间的良好结构。实验证明合理的子空间分割策略,不但保证了正确率,同时极大地缩短了算法的运行时间。最后,采用增广空间模型,将不同子空间进行融合,并获得较好的性能。在分类实验中分类正确率已达85.92%。季铎 常利伟 蔡东风 2013沈阳航空航天大学学报2013,30,2:1
13语义分析在水环境领域的应用研究显示文摘本文针对水环境领域提出了一种改进的潜在语义分析方法,通过改进权重计算方法以及记录词语出现位置的信息,更加准确的表达了词语所表现出的语义信息,最终实现文档内容查准率与查全率的提高。通过实验证明,改进的潜在语义分析算法实现了文本的扩展,在水环境领域中的检索效果优于传统的潜在语义分析算法。段荣伟 付立冬 夏广锋 2015电子技术与软件工程2015,,22:0
14基于潜在语义分析的程序代码相似度检测显示文摘本文从语义学角度定义了程序语言中'语义'的概念,分析了信息检索中的向量空间模型,提出了基于潜在语义分析的检测方法,介绍了潜在语义分析的处理流程以及常用的加权方案。奇异值分解是潜在语义分析的核心,本文重点介绍了奇异值分解的数学原理,矩阵的分解方法,以及常用的相似度计算方法。汪瑾 2012科技创新与应用2012,2,12Z:0
15基于加权潜在语义分析的答案抽取显示文摘问答系统应该能够用准确、简洁的语言回答用户用自然语言提出的问题,其关键和核心实现技术是答案抽取。结合关键词在用户问句和返回文档中的权重,通过潜在语义分析技术实现了中文问答系统中的答案抽取。实验结果表明,加权LSA的MRR值要明显优于未加权LSA和空间向量模型的MRR值,实际用于回答用户提出的问题具有较好的效果。陈永平 杨思春 苏新 毛万胜 2012计算机系统应用2012,21,1:0
16一种基于概念匹配度模型的中文问答系统显示文摘答案抽取是问答系统的核心部分,本文根据汉语本身的特点,采用了本体论方法,借鉴了概念格的思想,提出了一种基于概念匹配度模型的中文问答系统。该系统通过计算与问题概念节点的匹配度,就可以抽取出查询问题的答案。该模型采用了定量计算,缩短了问题—答案匹配时间,并通过实例证明了该模型是有效的。李静 宋振明 2008河北工程大学学报(自然科学版)2008,25,2:0
17基于专利信息的潜在语义索引优化技术的研究显示文摘以专利文献为基础,结合特征传递共现对映射潜在语义空间的影响,提出了基于专利信息的潜在语义索引优化方法。该方法根据专利文献的分解细节信息,将单独的专利文献分解为多个子文档和伪文档,使同一类别文档内特征共现度升高、不同类文档间特征共现度降低,从而使对应的潜在语义空间更加合理。同时提取专利核心特征构建专利信息伪文档,增强合理共现信息的出现频率。实验结果证明,专利文本分类任务结合本方法时,可以有效地提高分类的准确性。毕臣 季铎 蔡东风 2014山西大学学报(自然科学版)2014,37,1:0
18基于模糊认知图的文本分类模型研究显示文摘通过引入模糊认知图进行文本分类模型研究,即在向量空间模型、粗糙集等方法基础上使用模糊认知图进行文本分类,指出这一研究不仅大大约简文本空间向量的冗余属性,降低研究的规模与复杂性,提高工作效率,而且该研究将使文本分类通过迭代计算考虑到各向量间的影响。张薇娟 张桂芸 2007天津科技2007,34,4:0
19当前计算语言学研究的发展态势显示文摘先对计算语言学方面的研究作了一个总体概括,然后指出了本领域研究的四大主要成就以及存在的三大问题。最后预测计算语言学将在三大方面取得更大的成就。罗进军 2006湖南工业职业技术学院学报2006,6,4:0
返回顶部 每页显示:
共1页 首页 上一页 第1页 下一页 末页 /1 跳转

网站首页 | 关于我们 | 联系我们 | 产品服务 | 客服中心 | 广告服务 | 版权声明 | 网站联盟 | 友情链接 | 售卡网点

版权所有© 渝B2-20050021-1 渝公网安备 50019002500403号 违法和不良信息举报中心

互联网出版许可证 新出网证(渝)字10号 全国400电话 - 免长途话费