A Simple but Tough-to-Beat Baseline for Sentence Embeddings阅读笔记

文章目录

概述
算法
实验
- 1. Textual Similarity Tasks
- 2. Supervised Tasks

概述

一篇17年的论文, 采用无监督的方法.
主要思想可以概括为两步:

利用词嵌入方法，通过词向量的线性的加权组合对一个句子进行编码
利用奇异向量求出最终的句向量。

算法

实验

1. Textual Similarity Tasks

数据集

all the datasets from SemEval semantic textual similarity (STS) tasks (2012-2015)
the SemEval 2015 Twitter task
the SemEval 2014 Semantic Relatedness task

实验设置
词向量分别采用了无监督的GloVe和弱监督的PSL.
$α$ 固定为 $1 0^{- 3}$ , 词频利用commoncrawl dataset进行统计.

实验结果

2. Supervised Tasks

the SICK similarity task
the SICK entailment task
the Stanford Sentiment Treebank (SST) binary classification task

实验结果

全部评论

推荐最新楼层

05-13 20:48

广电运通_大数据事业部_算法研究员(准入职员工)

广电运通内推-广电运通内推码

🏢 广电运通：上市国企，国内领先的人工智能行业应用领军企，主营城市智能和金融科技。  💰 薪资福利：公司的实习工资非常有诚意哈哈；公司还有免费早午餐，免费上下班班车接送；运动达人更不要错过健身房，还有羽毛球篮球等各种活动。  👫 组内氛围：我们部门真的都是俊男靓女，领导和同事都非常亲切，依稀记得刚开始来的时候还做错了一些事，Mentor脾气超好，非常耐心；此外！在这里我还认识了很多一起实习的小伙伴们，大家都是很好的朋友🧑‍🤝‍🧑周末经常一起去了顺德、香港等地，秒变旅游搭子，超级幸福。  💼 工作内容：不仅了解了岗位工作，还get了一大堆新技能！海报、视频、推文都不在话下。广电运通...

广电运通公司福利 173人发布

点赞评论收藏

不愿透露姓名的神秘牛友

05-14 12:20

跟deepseek说了我初中被霸凌的事情

看到这个话题尝试跟deepseek聊了下，本来这个事情我不打算跟任何人说，我爸妈也不知道。但聊完真的让我很释怀……

被AI治愈的瞬间

点赞评论收藏

04-30 21:35

已编辑

长安大学 C++

美团小sp。。可惜了😪😪————更新——————别说我了兄弟们😭😭。女朋友是体制内高校教师，工作动不了。并且对我真的是非常非常好。在一块也是他出钱居多。并且双方也都见过父母，准备订婚了😭😭😭😭

晓沐咕咕咕：评论区没被女朋友好好对待过的计小将可真多。觉得可惜可以理解，毕竟一线大厂sp。但是骂楼主糊涂的大可不必，说什么会被社会毒打更是丢人。女朋友体制内生活有保障，读研女朋友还供着，都准备订婚了人家两情相悦，二线本地以后两口子日子美滋滋，哪轮到你一个一线城市房子都买不起的996清高计小将在这说人家傻😅

点赞评论收藏