腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
TreeTagger是如何得到一个单词的引理的?
nlp
、
lemmatization
、
treetagger
我正在使用TreeTagger获取西班牙语单词的词条,但我观察到有太多的单词没有像应该的那样进行转换。我想知道这个操作是如何工作的,如果它是通过决策树或机器学习算法等技术完成的,或者它只是包含一个单词列表及其相应的词条。有人知道吗?谢谢!!
浏览 4
提问于2018-06-05
得票数 1
1
回答
我如何从quanteda包转换成
语料
库?
r
、
text-mining
、
quanteda
如何将英语输出转化为
语料
库,以供进一步
分析
?更具体地说,我想创建一个基于关键字前后的单词的
语料
库(contextPre,contextPost),对它们做进一步的情感
分析
。
浏览 2
提问于2016-05-25
得票数 1
1
回答
如何利用HTK进行语言建模
htk
我对如何使用HTK进行语言建模感到困惑。 有什么教程可以用来做同样的事情吗?请帮帮我。
浏览 3
提问于2016-10-27
得票数 0
1
回答
R中tidytext中的ngram
分析
r
、
tidytext
我正在尝试做ngram
分析
,因为在tidytext中,我有一个770个演讲的
语料
库。然而,tidytext中的函数unnest_tokens将数据帧作为输入。我无法将
语料
库转换为数据帧,既不能一次转换一个语音,也不能一次转换所有
语料
库。谢谢
浏览 3
提问于2020-02-14
得票数 0
1
回答
新闻文章和标题的自由文本挖掘
语料
库
text-mining
有没有基于新闻文章和标题的免费
语料
库?在哪里可以免费下载?
浏览 2
提问于2017-06-14
得票数 1
2
回答
用于训练文本分类器的德语数据集
sentiment-analysis
我还没有找到用情感
分析
预先训练过的德语单词嵌入,也没有找到合适的数据集来训练我自己的单词嵌入。 如有任何建议,我们将不胜感激!
浏览 0
提问于2019-04-03
得票数 2
1
回答
R从多个txt文件中挖掘文本文档
r
、
text
、
data-mining
那么,我如何通过跟踪月份-年份引用来
分析
这些文件(文本挖掘)每个文件分别来自唯一的
语料
库(或类似的
语料
库),谢谢。
浏览 3
提问于2016-08-16
得票数 0
4
回答
如何为stanford tagger创建自己的训练
语料
库?
java
、
nlp
、
stanford-nlp
我必须用大量的短手和当地的行话来
分析
非正式的英语文本。因此,我正在考虑为斯坦福大学的标记器创建模型。
语料
库的语法是什么?我的
语料
库应该保持多长时间才能达到理想的性能?
浏览 0
提问于2010-07-01
得票数 15
回答已采纳
1
回答
谷歌是如何获得互联网前几年的“随时间使用”数据的?
statistics
、
google
最近我正在读一本书,我发现有很多词我很少看到。当我搜索他们的意思时,我发现对于一个单一的词汇,谷歌有一个use over time for:统计数据--从1800年到2010年。 我可以想象谷歌是如何收集互联网上使用的词汇的频率的。但是在互联网之前呢?他们如何知道1800年人们使用词汇的频率?他们是否首先将图表材料转换成数字数据,然后计算结果或其他什么?
浏览 0
提问于2018-06-06
得票数 0
回答已采纳
1
回答
LSA相似接口
lsa
、
latent-semantic-indexing
、
latent-semantic-analysis
本文采用LSA相似接口作为
分析
方法。我的背景是语言学,而不是计算机科学。我试图找到一个简单的LSA文档分类工具,但我找不到任何。我试着和Gensim一起玩,但我没有工作。我认为我的问题是将我的
语料
库(txt文件)与Gensim工具链接到一起进行
分析
(我不知道如何完成这个步骤)。如果有人能帮助我进行
分析
,或者指导我使用Gensim的任何工具或简单的教程,我将非常感激。我想要做以下工作:我想应用文档-实体查询从
语料
库中检索最相关的5个文档到查询文档。 我有一个(150条文本)的<e
浏览 6
提问于2014-12-21
得票数 0
1
回答
R主题建模- lda命令'lexicalize‘产生意外的结果
r
、
tm
、
lda
、
topic-modeling
我正在使用R中的'lda‘包对
语料
库执行主题模型
分析
(让我们称之为'corpusB')。我正在为
语料
库的
分析
做准备,首先使用命令'lexicalize',该命令返回一个术语-文档矩阵,如果没有预先指定,还会返回一个在
语料
库中出现的具有唯一标记的词汇表。出于研究目的,我想使用从另一个
语料
库推断出的词汇表对
语料
库进行词汇化(让我们称其为'corpusA'),这是一件应该很容易完成的事情。然而,它并没有起作
浏览 0
提问于2014-01-16
得票数 0
6
回答
用于情感
分析
的训练数据
nlp
、
machine-learning
、
text-analysis
、
sentiment-analysis
、
training-data
我想要一个为公司提供评论的大型文档
语料
库,就像
分析
师和媒体提供的对公司的评论一样。 我发现有产品和电影评论的
语料
库。是否有业务领域的
语料
库,包括对公司的评论,与业务语言相匹配?
浏览 2
提问于2011-09-26
得票数 57
回答已采纳
1
回答
Weka可以处理多少文本?
machine-learning
、
nlp
、
weka
、
sentiment-analysis
、
document-classification
我有一个情感
分析
任务,我需要指定weka可以处理多少数据(在我的例子中是文本)。我有一个包含2500条评论的
语料
库。我知道这是一个很小的
语料
库,但我的论文导师让我专门讨论一下Weka可以处理多少数据。
浏览 1
提问于2014-09-23
得票数 0
4
回答
情绪
分析
-当正面和负面单词列表的长度不同时,我应该对它们进行标准化吗?
nlp
、
sentiment-analysis
我正在实现一个简单的情感
分析
算法,其中论文的作者有一个正面和负面单词的单词列表,并简单地计算每个单词在
分析
的文档中出现的次数,并使用以下内容对文档进行情感评分:这是通过文档长度对情感评分进行归一化,但是负面单词的
语料
库比积极单词
语料
库(大约300个积极单词和1800个负面单词我如何纠正正负
语料
库长度的不平衡?我是否应该调整情绪得分,以通过各自的<
浏览 0
提问于2015-02-19
得票数 1
1
回答
如何将数据帧转换为可由Iramuteq和Alceste读取的txt
r
、
text-mining
、
stringr
Iramuteq和Alceste是文本挖掘程序(在法国仍然非常流行),它们处理格式奇怪的txt文件:
语料
库中的每个文档都必须以*开头,然后每个
语料
库变量都必须编码为*variablename_value(遵守一些格式规则),并且要
分析
的文本必须在新行上。country_france**** year_2021 country_germany如何将文本和
语料
库变量作为列的数据帧转换为这种格式
浏览 0
提问于2021-11-28
得票数 0
1
回答
(如何)我可以选择
语料
库的所有“内容”,而不仅仅是特定的[[1]]或[[2]]等?
r
、
tm
、
corpus
我希望选择所有
语料
库内容作为一个整体进行
分析
,而不是一次只
分析
一个内容,我如何更改此代码?我试着一次选择一个文档,但有70个文档要
分析
,我想把它们作为一个整体来看 ReportCorpus[[1]]$content
浏览 9
提问于2019-09-17
得票数 0
1
回答
文本挖掘中的特征数
machine-learning
、
text-mining
、
text-classification
我有1000份文件在我的
分析
(所以
语料
库将需要700左右)。
语料
库中的术语数约为2万条,超过了文献数(P >> N)。有这么多特征有什么意义吗?HashingTF方法中的特征数应该高于
语料
库中的词条总数?或者我应该让它变小(比如512个功能)? 我有点糊涂。
浏览 2
提问于2017-07-19
得票数 0
回答已采纳
3
回答
文本的语义
分析
nlp
、
keyword
、
semantic-web
对于文本的语义
分析
,您推荐使用哪些工具?我需要处理用户输入的句子,并找出它们在语义上是否与我拥有的
语料
库中的单词接近。
浏览 2
提问于2011-12-27
得票数 1
回答已采纳
2
回答
机密情感数据的来源?
nlp
、
machine-learning
、
sentiment-analysis
、
text-analysis
、
training-data
我已经看过IMDB评论的Lee & Pang
语料
库和MPQA意见
语料
库了。我正在寻找符合以下标准的新web服务。
浏览 6
提问于2012-02-15
得票数 1
1
回答
基于syuzhet tm
语料
库的R情感
分析
text-mining
、
sentiment-analysis
、
tm
我是R中的文本
分析
新手,有没有一种简单的方法可以将syuzhet: get_nrc_sentiment应用于具有x个元素(加载的单个文本文件)的
语料
库?我猜你需要将
语料
库转换回一个组合的纯文本文件并使用它?谢谢
浏览 8
提问于2018-02-26
得票数 0
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券