腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
列出标题
的
最简单
的
方法?
nlp
我在这里
的
深度太大了--希望这篇文章没问题。我有1000条左右
的
标题。我试图找出标题是关于同一件事,但措辞不同。 希望能找到最容易做到这一点
的
方法,找出是否有现成
的
工具,找出相关
的
教程等等。我一直在谷歌上搜索,但没有发现任何具体
的
东西,可能是因为我错过了描述它
的
词汇。(在一个理想
的
世界里,有一些我不需要编写
的
在线工具,但如果有必要,我会尝试并编写代码。)谢谢。
浏览 7
提问于2022-05-23
得票数 2
1
回答
如何从包含2个元组
的
列表
中
的
最后一个条目中检索第二个值?
scala
、
map
、
tuples
我使用map扫描输入文件并生成字数
统计
。映射键是
单词
,值是
单词
的
出现
次数。我将映射转换为
列表
,并按值升序排序。因此,我有一个包含2个元组
的
列表
,
出现
频率
最低
的
单词
在
列表
的
第一个位置,
出现
频率
最高
的
单词
在
列表
的
最后一个位置。我知道使用myLi
浏览 2
提问于2012-09-27
得票数 0
回答已采纳
4
回答
有没有办法从Marklogic通用索引
中
获得索引词
的
列表
?
xquery
、
marklogic
我在Marklogic工具上工作,我有一个大约27000个文档
的
数据库。我想要做
的
是检索任何搜索查询结果所给出
的
文档中
出现
频率
最高
的
关键字。我目前正在使用xquery函数来
统计
作为查询结果检索到
的
所有文档
中
每个
单词
的
出现
频率
。然而,这是相当低效
的
。我在想,如果我能得到marklogic已对其执行索引
的
单词
<em
浏览 1
提问于2012-05-25
得票数 1
回答已采纳
3
回答
Apache Pig字数
统计
程序
apache-pig
在
单词
统计
程序
中
,如何找出猪
出现
频率
最高
的
单词
和
出现
频率
最低
的
单词
。如何在这里使用MAX函数。(纳维恩,3) (is,5) 这里我需要
的
输出是" is“
浏览 34
提问于2016-07-24
得票数 0
0
回答
统计
列表
中
单词
的
出现
频率
vba
、
excel
我首先要说
的
是,我不是VBA
的
专家用户;我只是在学习它。因此,我在考虑使用VBA代码按
频率
扫描和组织文本字符串
的
可能性。例如,在我
的
文件中有这样一组
单词
(每个
单词
位于不同
的
单元格
中
): 家,阳台,
浏览 7
提问于2017-01-06
得票数 0
1
回答
如何在R中
统计
我
的
csv文件
中
特定
单词
的
出现
频率
?
r
、
tm
在我
的
csv文档
中
只有评论(只有行,没有列).I想要
统计
单词
的
出现
频率
,例如,like,从我
的
csv文件中最好。我不想要每个
单词
的
频率
。我只想知道这三个
单词
在我
的
csv文档中
出现
的
次数。我尝试了这些代码,但它给了我每个我不想要
的
单词
的
频率
。有没有人能帮我解决
浏览 2
提问于2018-06-28
得票数 0
2
回答
如何将word cloud用于twitter应用程序
asp.net
、
jquery
、
ajax
、
twitter
我正在开发一个twitter应用程序,我想要在word cloud
中
显示所有趋势。但我不知道如何使用word cloud,也不知道我将使用twitter
的
哪个api来实现这一点。 我想要这样
的
。
浏览 0
提问于2009-11-13
得票数 0
回答已采纳
1
回答
Python -找出文本文件
中
每对可能
的
单词
在同一行中
出现
的
频率
的
最有效方法?
python
、
dictionary
、
compare
、
line
、
statistics
这个问题很容易解决,但我不确定我得到
的
解决方案在计算上是否有效。所以我在请教专家! 要浏览一个大文件,收集(整个文件)两个
单词
在同一行中
出现
的
频率
的
统计
数据,最好
的
方法是什么?您将最终收集以下
统计
信息:(this,is: 1),(this,the: 1),(this,白色: 1),(this,棒球: 1),(is,the: 1),(is,白色: 1),(is,棒球: 1)……对于条目(棒球,白色: 2),该值将为2,因为这对
单
浏览 0
提问于2010-10-02
得票数 2
回答已采纳
4
回答
词性标注-从哪里开始?
java
、
parsing
、
nlp
、
linguistics
您好,我想知道如何实现这样一个任务
的
解决方案:我想收集有关
单词
频率
的
统计
数据,但另外要确保每个
单词
都被正确识别(或大多数
单词
)。在句子“她大声哭了”
中
的
“哭”将被归类为名词,而“不要哭”将为
统计
数据提供动词。另一项任务将更加困难。我想找出经常
出现
在一起
的
单词</e
浏览 3
提问于2010-02-05
得票数 0
1
回答
如何
统计
排序
列表
中
单词
的
出现
频率
?
python
、
python-3.x
npl = [] npl.extend(tb(i).noun_phrases)使用上面的代码是可行<e
浏览 25
提问于2018-07-29
得票数 -2
回答已采纳
5
回答
统计
每个
单词
的
出现
频率
c#
、
.net
、
c#-4.0
、
.net-4.0
、
word-frequency
如何
统计
每个文件
中
每个
单词
的
出现
频率
?
单词
是指一组字符,可以包含字母、数字和下划线字符。
浏览 1
提问于2012-03-30
得票数 3
回答已采纳
2
回答
文档
中
的
并行计数字
c#
、
parallel-processing
它
统计
每个
单词
在文档中
出现
的
频率
。_documentVectorSpacei.Terms是文档
中
的
单词
数组。_distinctTerms是包含在所有文档
中
的
所有唯一
单词
的
HashSet。
浏览 1
提问于2013-10-03
得票数 0
2
回答
基于R
中
的
第二个
列表
的
一个
列表
中
的
和词
频率
r
、
regex
、
list
我需要根据一个单独
的
源
列表
来
统计
列表
中
单词
或词组
出现
的
频率
。 我有一个作者和研究领域
的
数据框架。每个作者都有一个或更多
的
研究领域(
单词
/
单词
短语)与他们
的
名字相关联
的
列表
。有时,同一个研究领域不止一次
出现
,我希望每次都对它们进行
统计
(也就是说,不是一个独特
的
浏览 3
提问于2017-07-14
得票数 0
回答已采纳
1
回答
如何将不同维度
的
两个特征结合起来?
machine-learning
、
classification
、
feature-extraction
让我们来考虑文本分类
的
问题。因此,如果文档被表示为
单词
袋,那么我们将有一个n维特征,其中n个
单词
在文档
中
。现在,如果我决定我也想使用文档长度作为特性,那么这个特性
的
维度(长度)将是一个维度。
浏览 3
提问于2012-09-08
得票数 1
2
回答
使用前十名从collections.counter中排除
单词
python
、
collections
、
counter
我想通过使用以下命令来
统计
某些文档中使用
的
单词
的
频率
:我无法简单地将.subtract( exclusion_list )添加到此命令
中
,其中exclusion_list是我不想要
的
单词
列表
。如何才能在不包含排除
列表
的
情况下获得前十个
单词
?
浏览 3
提问于2015-04-15
得票数 2
1
回答
Python:独特
的
单词
及其降序
频率
python
、
word
、
unique
、
frequency
我正在为Python类做一个非常简单
的
家庭作业问题,涉及到各种有关字符、
单词
及其相对
频率
等方面的
统计
数据。目前,我正试图分析一串文本,并得到文本
中
每一个独特
单词
的
列表
,然后是它使用
的
次数。我对Python (或其他任何语言)
的
知识非常有限,因为这是一门入门课程,因此我只提供了以下代码: for k in (""",.’?/!",这会打印出文本
中
<em
浏览 2
提问于2012-06-11
得票数 2
5
回答
停用词可以自动查找吗?
machine-learning
、
nlp
、
data-mining
、
text-mining
在自然语言处理
中
,停用词
的
去除是一个典型
的
预处理步骤。它通常是以经验
的
方式完成
的
,基于我们认为停用词应该是什么。在这方面有没有类似的想法和进展?有没有人能说点什么?
浏览 2
提问于2014-03-13
得票数 15
2
回答
区分正簇和负簇
python
、
nlp
、
k-means
、
word2vec
、
sentiment-analysis
我已经在我
的
Amazon评论数据集上应用了k-意思聚类。max_iter=1000, random_state=True, n_init=50).fit(X=word_vectors.vectors.astype('double')) 现在我想检查哪个集群是正
的
,哪个是负
的
,有谁能建议我这样做吗?此外,是否有任何方法来检查是一个特定
的
词属于哪个集群。例如,
单词
'bad‘属于哪个集群-0或1
浏览 0
提问于2020-11-22
得票数 2
回答已采纳
5
回答
在文本
中
查找相关
单词
的
算法
artificial-intelligence
、
similarity
我想说句话(例如:然后处理一个文本(或者更多)。例如:为苹果处理一个文档,发现iPod、iPhone、Mac都与“苹果”相关。
浏览 0
提问于2011-09-25
得票数 7
回答已采纳
1
回答
从python
中
的
消息
列表
中
查找最常用
的
单词
对
python
、
nltk
我有一个包含100条消息
的
列表
。我能够在消息
列表
中找到使用
频率
最高
的
单词
。但是我想找出
出现
频率
最高
的
那一对
单词
。例如,key和board是
出现
频率
最高
的
单词
。但是我需要找出在NLTK
中
'key‘作为一对使用
的
次数。摘要是句子
的
列表
,摘要词是
单词
<e
浏览 4
提问于2020-02-06
得票数 1
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券