大鹅专栏：大数据到机器学习-腾讯云开发者社区

开发者社区

文档建议反馈控制台

最新优惠活动

文章/答案/技术大牛

发布

大鹅专栏：大数据到机器学习

从大数据计算到机器学习，你需要了解这些。专注于Hadoop生态 Spark 机器学习深度学习

专栏成员

127

文章

295832

阅读量

47

订阅数

GNN系列综述 GNN GCN GraphSAGE GAT 简单理解及调优Trick

知识图谱神经网络卷积神经网络机器学习腾讯云 TI 平台

图(graph)是一种数据结构，图神经网络(Graph Neural Network)应该是深度学习在图结构数据上的一些模型、方法和应用。常见的图结构由节点(node)和边(edge)构成，节点包含了实体(entity)信息，边包含实体间的关系(relation)信息。

2022-09-04

2.8K0

NLP任务之中文拼写语法纠错介绍与综述

机器学习深度学习 NLP 服务

在很多中文NLP相关的落地场景都会涉及到文本纠错的相关技术，例如跟各种形式机器人的语音或者文字对话，或者用手机扫描相关的PDF或者图片，或者跟人聊天时用输入法打字等等，无论是通过ASR识别的语音信息，通过OCR识别得到的图片信息，还是用户真实通过输入法的文字，都有可能出现错误。这些错误会影响文本的可读性，不利于人和机器的理解，如果这些错误不加处理，会传播到后续的环节，影响后续任务的效果。常见的中文错误类型包括以下几种：

2022-07-20

4K1

GNN系列 GCN简述推导理解及 DGL 源码解析

知识图谱深度学习机器学习数据挖掘 NLP 服务

深度学习一直都是被几大经典模型给统治着，如CNN、RNN等等，它们无论再CV还是NLP领域都取得了优异的效果，那这个GCN是怎么跑出来的？是因为我们发现了很多CNN、RNN无法解决或者效果不好的问题——图结构的数据。

2022-07-17

2.5K0

腾讯云GPU最佳实践-使用jupyter pycharm远程开发训练

GPU 云服务器 jupyter notebook 深度学习机器学习机器学习平台

作为炼丹工程师，GPU毫无疑问会给我们训练模型带来极高的效率提升，但是一般实际开发都是本地编写然后复制代码到GPU机器上面运行，这样效率就会有一定的折损，而且同时维护两套环境可能还会偶尔会有报错。那么为什么我们不直接远程到GPU机器上直接进行开发呢？

2022-04-23

3K0

标签平滑 Label Smoothing 详解及 pytorch tensorflow实现

机器学习深度学习图像处理图像识别 NLP 服务

标签平滑（Label smoothing），像L1、L2和dropout一样，是机器学习领域的一种正则化方法，通常用于分类问题，目的是防止模型在训练时过于自信地预测标签，改善泛化能力差的问题。

2022-01-27

2.4K3

XGBoost 实现文本分类与sklearn NLP库TfidfVectorizer

机器学习深度学习 python java NLP 服务

在文本分类任务中经常使用XGBoost快速建立baseline，在处理文本数据时需要引入TFIDF将文本转换成基于词频的向量才能输入到XGBoost进行分类。这篇博客将简单阐述XGB进行文本分类的实现与部分原理。

2021-12-23

2.6K1

句法依存分析背景基本概念及常用方法

机器学习腾讯云 TI 平台机器学习平台深度学习 NLP 服务

句法结构分析又称短语结构分析（phrase structure parsing），也叫成分句法分析（constituent syntactic parsing），用于获取整个句子的句法结构；

2021-12-21

2K0

ESIM 短文本匹配模型解读分析

深度学习机器学习腾讯云 TI 平台机器学习平台 NLP 服务

ESIM是一个综合应用了BiLSTM和注意力机制的模型，在文本匹配中效果十分强大.

2021-11-12

2K0

深度学习中的文本分类方法汇总相关代码及调优trick

机器学习深度学习 NLP 服务

Fasttext是Facebook推出的一个便捷的工具，包含文本分类和词向量训练两个功能。

2021-11-06

1.7K0

NLP任务汇总简介与理解

机器学习深度学习文字识别 python NLP 服务

序列标注（Sequence labeling）是我们在解决NLP问题时经常遇到的基本问题之一。在序列标注中，我们想对一个序列的每一个元素标注一个标签。一般来说，一个序列指的是一个句子，而一个元素指的是句子中的一个词。比如信息提取问题可以认为是一个序列标注问题，如提取出会议时间、地点等。

2021-10-06

3.9K0

GPT/GPT2/DialoGPT 详解对比与应用-文本生成与对话

机器学习深度学习人工智能 tensorflow NLP 服务

GPT 的全名：Generative Pre-Training，其论文标题是 Improving Language Understanding by Generative Pre-Training。

2021-09-15

8.8K0

基于GPT2制作一个chatbot

机器学习腾讯云 TI 平台 NLP 服务

想必大家都有经历，处于多种原因有个很好的朋友不再跟你聊天了，那么可不可以用他的微信聊天记录来大致还原一下这个人的聊天习惯语气甚至是喜欢发的表情包等等呢？

2021-09-14

2.1K0

机器学习深度学习中激活函数sigmoid relu tanh gelu等汇总整理

机器学习深度学习推荐系统智能推荐平台人工智能

这篇博客主要总结一下常用的激活函数公式及优劣势，包括sigmoid relu tanh gelu

2021-09-12

2.5K0

wide & deep 模型与优化器理解代码实战

机器学习腾讯云 TI 平台深度学习智能推荐平台推荐系统

wide & deep模型是Google在2016年发布的一类用于分类和回归的模型。该模型应用到了Google Play的应用推荐中，有效的增加了Google Play的软件安装量。目前wide & deep模型已经开源，并且在TensorFlow上提供了高级API。

2021-09-12

2.6K2

深度学习常用优化器汇总整理

机器学习腾讯云 TI 平台机器学习平台人工智能云服务器

为机器学习项目选择好的优化器不是一项容易的任务。流行的深度学习库（如 PyTorch 或 TensorFLow）提供了多种优化器选择，它们各有优缺点。并且，选择不合适的优化器可能会对机器学习项目产生很大的负面影响。这使得选择优化器成为构建、测试和部署机器学习模型过程中的关键一环。

2021-09-05

2.1K0

人工智能机器学习 NLP 服务

https://l1nwatch.gitbook.io/interview_exercise/stackoverflow-about-python/python-zhong-guan-jian-zi-yield-you-shi-mo-zuo-yong

2021-09-01

1.3K4

深度学习NLP从RNN LSTM GRU seq2seq到Attention分类及解析

机器学习腾讯云 TI 平台深度学习人工智能 NLP 服务

上一篇博客讲了Transformers里面的self-attention，在NLP领域中其实attentionseq2seq的时候就有广泛应用了。这篇文章主要总结一下从从RNN LSTM GRU seq2seq 到attention的种类及应用，方便大家理解整体发展与attention机制。

2021-08-31

1.6K0

Transformer (Attention is all you need) 详解

机器学习平台机器学习深度学习云服务器 NLP 服务

在之前的博客中有简单讲到Transformer，这篇博客将会专门详细的一起看看内部的计算与实现。

2021-08-26

2.5K1

NLP BERT GPT等模型中 tokenizer 类别说明详解

机器学习机器学习平台深度学习中文分词 NLP 服务

在使用GPT BERT模型输入词语常常会先进行tokenize ，tokenize具体目标与粒度是什么呢？tokenize也有许多类别及优缺点，这篇文章总结一下各个方法及实际案例。

2021-08-20

17.5K0

BERT系列RoBERTa ALBERT ERINE详解与使用学习笔记

机器学习机器学习平台深度学习模式识别 NLP 服务

继上一篇博客，这篇主要讲一下BERT以及BERT衍生的模型，如RoBERTa ALBERT ERINE等模型的改进与优化效果。

2021-08-19

5.5K4

点击加载更多

社区活动

【纪录片】中国数据库前世今生

穿越半个世纪，探寻中国数据库50年的发展历程

Python精品学习库

代码在线跑，知识轻松学

博客搬家 | 分享价值百万资源包

自行/邀约他人一键搬运博客，速成社区影响力并领取好礼

技术创作特训营·精选知识专栏

往期视频·千货材料·成员作品最新动态