文本相似度度量方法

文本相似度度量是自然语言处理中的一个基础问题,是许多下游任务的基础,如文本分类、信息检索、对话系统、句义标注等。相似度匹配的过程包括了构造特征与度量特征两个基本步骤,其中构造特征是核心任务。报告的两篇论文讲述了构造特征的一些可供借鉴的方法。第一篇文章从逻辑表达与推理中构造特征来度量句子的相似度,第二篇从表征学习的角度来度量不同长度文本的相似度。

文本相似度度量方法-孔令迪

原创文章,作者:bfs,如若转载,请注明出处:https://www.isclab.org.cn/2022/03/13/%e6%96%87%e6%9c%ac%e7%9b%b8%e4%bc%bc%e5%ba%a6%e5%ba%a6%e9%87%8f%e6%96%b9%e6%b3%95/

(3)
bfsbfs
上一篇 2022年3月7日 上午10:30
下一篇 2022年3月21日 下午5:17

相关推荐

  • Dropout随机失活

    具有大量参数的深度神经网络是非常强大的机器学习系统。然而,在这样复杂的网络中,过拟合的问题难以解决。复杂的网络结构和缓慢的运行速度导致我们很难在测试时通过组合许多不同大型神经网络的…

    2022年1月21日
    3.3K
  • 机器学习中的凸优化

          机器学习模型一般可化简为求解一个目标函数/损失函数的最优化问题,根据优化目标及约束的不同,可划分为凸优化(C…

    2018年11月20日
    4.2K
  • 小样本命名实体识别

    在很多场景下,收集大量的有标签的数据是非常昂贵、困难、甚至不可能。因此在特定领域、小语种等缺乏标注资源的情况下,NER 任务往往得不到有效解决。为了解决少量标注数据的命名实体识别,…

    2023年8月30日
    3.3K
  • 如何优雅地阅读和复用代码

    面对大型软件项目,如何准确、快速地找到目标代码的位置将会极大地加速我们的二次开发。本次报告以GUI程序为例介绍了软件源码查找、修改和使用的一般流程。对初学者的软件项目开发工作大有裨…

    2020年1月2日
    3.6K
  • 对抗性扰动下的后门防御方法

    后门防御旨在使用神经元剪枝、知识蒸馏等手段消除模型中隐藏的后门,阻止攻击者使用触发器样本控制深度学习模型的输出。本次学术报告主要讲解了两种以对抗性扰动和后门攻击关系为基础的后门防御…

    2024年1月17日
    4.0K
  • ISCC2017线上赛证书领取事项通知

    ISCC2017线上赛获奖名单已公布 全国赛区获奖选手名单:ISCC2017(全国赛区)获奖选手名单公示 北理赛区获奖选手名单:ISCC2017(北理赛区)获奖选手名单公示 经信息…

    ISCC竞赛 2017年6月21日
    4.3K
  • 2024年第21届全国大学生信息安全与对抗技术竞赛“智能安全赛”成功召开

    2024年12月16日,第21届全国大学生信息安全与对抗技术竞赛“智能安全赛”在厦门理工学院成功举办。 来自全国248所高校的1892支队伍经过激烈竞争,949支队伍进入全国总决赛…

    2024年12月25日
    7.7K
  • 面向LLM Agent的提示注入攻击

    本报告聚焦大模型Agent提示注入攻击研究,重点解析CrossInject跨模态攻击与ToolHijacker工具劫持两大提示注入攻击框架,CrossInject首次实现“视觉+文…

    2026年6月22日
    1.6K
  • 胶囊(向量神经)网络

        胶囊(向量神经)网络是针对CNN的缺陷提出的一种新的方法,主要实现了两点改进:1.将CNN的输出结果由标量(scalar)替换成了向…

    学术报告 2018年2月26日
    3.6K
  • 源代码变更表征

    本次报告介绍了源代码变更表征领域,其属于源代码表征领域的进一步研究工作,报告首先介绍领域研究目标、背景意义、发展脉络与基础框架,梳理显式与隐式信息交互两类代码变更表示学习方法;随后…

    2026年3月23日
    2.8K