腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
word2vec
的
余弦
相似
性大于1
python
、
apache-spark
、
pyspark
我使用spark
的
word2vec算法来计算文本
的
文档向量。w2vmodel.findSynonyms('science',4).show(5)| wordneuroscience|1.4968051528391833| | psychology| 1.4588656
浏览 0
提问于2016-12-29
得票数 6
1
回答
如何
获得
排序
的
余弦
相似
度
?
python
、
scikit-learn
、
cosine-similarity
、
pairwise
Label6 Label8Type4|Label1 Label2 Label4 Label5ax.set_yticklabels(labels,rotation=0,fontsize=14) 倒数第三行是我有点老套
的
分配标签
的
方式,这样它们就可以向我显示集群图上所有内容对应
的
内容。但我也希望看到具有最强
余
浏览 12
提问于2021-03-09
得票数 0
1
回答
如何
用Lucene和Java计算tf-国防军
的
余弦
相似
度
java
、
lucene
、
tf-idf
、
cosine-similarity
我需要根据与tf-国防军
的
余弦
相似
性对这些文件进行
排序
。请有人告诉我,我能从Lucene那里得到什么支持来计算这个?从Lucene可以直接计算出哪些参数(可以通过lucene中
的
某些方法直接得到tf、国防军吗?)
如何
用Lucene计算
余弦
相似
度
(如果传递查询和文档
的
两个向量,是否有直接返回
余弦
相似
度
的
函数?)
浏览 1
提问于2012-04-16
得票数 2
1
回答
如何
在MALLET中获取两个文档之间
的
余弦
相似
度
?
java
、
modeling
、
lda
、
mallet
我有一个使用MALLET训练
的
LDA主题模型,但是我想计算两个文档之间
的
余弦
相似
度
来
获得
相似
度
,但是我不确定我要计算哪个文件
的
余弦
。我
的
余弦
相似
度
函数运行得很好,但我不确定我在MALLET中比较
的
是什么。 任何帮助都将不胜感激!
浏览 1
提问于2017-04-07
得票数 0
1
回答
Elasticsearch:在相关评分中使用密集向量上
的
距离(在查询时)
elasticsearch
我使用elasticsearch来组合不同
的
东西:-基于密集向量(
余弦
相似
度
)
的
文本得分搜索。我
的
问题是,在查询阶段不计算
余弦
相似
度
,我在文本中
的
搜索充当预筛选器。我将始终
获得
结果链接到文本搜索,即使
余弦</em
浏览 1
提问于2020-01-29
得票数 1
回答已采纳
1
回答
生成两个具有给定角度
的
向量
math
、
vector
、
linear-algebra
、
cosine-similarity
我试图用给定
的
余弦
相似
度
生成两个向量。输入将是
余弦
相似
度
的
程度(或者说它取决于它)和向量中
的
维数(D),输出将是D维
的
两个向量,与它们之间给定
的
相似
度
,现在我知道
如何
使用
余弦
相似
函数来计算
相似
度
,但当我尝试相反
的
方法时,我迷失了方向。是否有这样
的</
浏览 6
提问于2022-05-25
得票数 1
回答已采纳
1
回答
基于浮点数组
余弦
相似
度
的
Elasticsearch
排序
elasticsearch
是否可以基于两个不同浮点数组
的
余弦
相似
度
进行
排序
?类似于您可以通过传递坐标进行
排序
来按地理距离
排序
吗?
浏览 0
提问于2017-10-31
得票数 2
1
回答
相似
性评分在gensim中意味着什么?
python
、
text
、
gensim
、
sentence-similarity
我使用Gensim库来查找句子与段落集合、文本数据集之间
的
相似
之处。分别使用了
余弦
相似
度
、软
余弦
相似
度
和移动测度。Gensim返回一个项目列表,包括、docid、和
相似
性评分。对于
余弦
相似
度
和软
余弦
相似
度
,我猜
相似
度
是向量之间
的
余弦
。我说
的
浏览 0
提问于2021-09-20
得票数 0
回答已采纳
1
回答
仅对于匹配
的
文档,与Lucene
的
余弦
相似
性
java
、
solr
、
lucene
、
cosine-similarity
这是正确
的
吗? 如果您确实需要文档之间
的
余弦
相似
性,则必须为源字段启用项向量,并使用它们
浏览 5
提问于2015-09-07
得票数 1
回答已采纳
1
回答
我们
如何
计算由评级表示
的
两个项目的调整后
的
余弦
相似
度
?
recommendation-engine
、
mahout-recommender
、
collaborative-filtering
、
cosine-similarity
我想分别为a和b表示
的
两个项目计算调整后
的
余弦
相似
值。我们取两个向量a={2,3,1,0}和b={1,0,4,2}。我知道
余弦
相似
度
是
如何
工作
的
,但我坚持使用调整后
的
余弦
相似
度
方法。
浏览 4
提问于2016-02-18
得票数 0
1
回答
一个恰当
的
向量
相似
度
指标
math
、
vector
、
similarity
我正在尝试调整
余弦
相似
度
,以确定两个向量相对于条目的
相似
度
。由于所
获得
的
度量在向量尺度{(0,1,2)和(0,2,4)具有
余弦
相似
度
1}下是不变
的
,那么扩展
相似
性度量以说明初始向量尺度
的
方法是什么?我想乘以min{|v1|,|v2|}/max{|v1|,|v2|},其中|v|表示向量v范数,以保持-1和1
的
界限。任何建议都是非常感谢<e
浏览 2
提问于2012-01-06
得票数 1
回答已采纳
7
回答
在lucene中获取两个文档之间
的
余弦
相似
度
lucene
、
similarity
、
trigonometry
、
tf-idf
我想在不指定查询
的
情况下,只是得到一个分数(
余弦
相似
度
还是另一个距离?)在索引中
的
两个文档之间。
如何
获得
这两个文档之间
的
余弦
相似
度
? 谢谢
浏览 7
提问于2009-12-04
得票数 15
回答已采纳
3
回答
solr使用
余弦
相似
吗?
solr
、
lucene
、
search-engine
我写了一个小
的
搜索引擎作为我
的
每周专题。它基于查询向量和文档向量之间
的
余弦
相似
度
。矢量是用TF-下手
的
记号来计算
的
. 我已经了解了Apache,这是一个全文搜索引擎。我
的
问题是,在
排序
搜索结果时,solr内部使用
余弦
相似
性吗?
浏览 2
提问于2014-07-09
得票数 5
回答已采纳
1
回答
如何
比较使用两个不同
的
数据集
获得
的
两个
相似
性?
algorithm
、
similarity
我试图通过使用两个不同
的
数据集通过
余弦
相似
度
来计算用户与用户
的
相似
度
(用户是相同
的
,只是为了
获得
相似
度
而考虑
的
特征在数据集之间是不同
的
)。现在,有没有一种方法可以根据
相似
度
值来判断这两个数据集有多
相似
?
浏览 0
提问于2017-05-22
得票数 0
2
回答
使用相同源
的
余弦
相似
和完全不同
的
结果
python
、
machine-learning
、
cosine-similarity
、
word-embedding
、
machine-translation
我正在学习单词嵌入和
余弦
相似
性。我
的
数据是由两组相同
的
词组成
的
,但用
的
是两种不同
的
语言。 我是否应该期望
获得
同样
的
结果?我
浏览 3
提问于2019-07-24
得票数 0
回答已采纳
1
回答
文档
相似
性-多个文档以相同
的
相似
性评分结束
nlp
我一直在处理一个业务问题,需要找到与现有文档
相似
的新文档。我使用了如下各种方法2.TFIDF +
余弦
相似
他们都没有像预期
的
那样工作。最后,我发现了一种更好
的
方法-- Word2vec +软
余弦
相似
性。 但新
的
挑战是,我最终得到了具有相同
相似
性评分
的
多
浏览 1
提问于2020-04-16
得票数 0
1
回答
在storm中处理多个文件
的
最佳方法是什么
similarity
、
apache-storm
我是新
的
阿帕奇风暴,我想使用风暴来
获得
文件
的
相似
度
。我想要得到文件夹"A“中所有文件
的
余弦
和文件夹"B”中所有文件
的
余弦
。你能帮我指一下
如何
得到结果吗?非常感谢。
浏览 0
提问于2015-07-23
得票数 0
2
回答
如何
在MATLAB中计算两个频率向量之间
的
余弦
相似
度
?
matlab
、
vector
、
cosine-similarity
我需要在MATLAB中找到两个频率向量之间
的
余弦
相似
度
。a = [2,3,4,4,6,1]
如何
在MATLAB中度量这些向量之间
的
余弦
相似
度
?
浏览 40
提问于2019-07-25
得票数 1
1
回答
关于word2vec most_similar()函数
text-mining
、
gensim
、
word2vec
我使用如下
的
most_similar()方法来获取与给定单词
相似
的所有单词:AFAIK,它
的
作用是计算给定单词和字典中所有其他单词之间
的
余弦
相似
度
。当我检查单词和分数时,我可以看到列表中有负分数
的
单词。这是什么意思?它们是与给定单词具有相反含义
的
单词吗? 另外,如果它使用
余弦
相
浏览 2
提问于2016-01-19
得票数 5
2
回答
如何
在Python中获取两个字典值来查找
余弦
相似
度
?
python
、
loops
、
trigonometry
我需要使用存储在user_dict字典中
的
“用户评分”从两个向量中找出
余弦
距离
相似
度
。 评级是从CSV文件导入
的
,然后更改为字典,以用户为关键字,每个用户
的
评分值。我
的
问题是,
如何
遍历字典以获取两个用户
的
评分,并使用
余弦
距离函数
获得
相似
度
? 循环不需要将相同
的
用户比较在一起,或者以不同
的
顺序比较相同
的
用户?(例
浏览 36
提问于2020-08-05
得票数 0
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券