【台大李宏毅ML课程】Lecture 14 Word Embedding笔记

NLP必学:Word2Vec、Glove和ELMO 文章目录前言一、one-hot表示二、词嵌入表示法三、word embedding的作用1. 迁移学习2.类比推理四、Word2VecSkip-gramCBOWWordVec的优化1. 分级softmax分类器2.负采样五、GloVe六、ELMO总结 前言 词汇表示(Word Representation)一直是自然语言处理(NLP)中最基础也是最重要的任务之一。 深度学习已经给这一领域带来了革命性的变革。其中一个很关键的概念就是词嵌入(word embeddings),这是语言表示的一种方式,我们可以理解 阅读详情

本节课主要讲了无监督学习——word embedding的一些基本概念

1.word embedding(word2vector)
传统的1 of N encoding(或者one-hot独热编码)的表示法过于稀疏,不可取。所以考虑将每个word映射到另一个空间里去
这里写图片描述

machine通过阅读很多documents来理解语义,从而可以达到word embedding的目的

2.How about Auto-encoder?
auto-encoder好像只是简单的将word编个码,降维,可能相近的词还会离得很远。而word embedding目的是意思相近离的很近,需要进行一些上下文的理解。比如:
ma 520宣誓就職
cai 520宣誓就職
ma和cai都是名字,很接近~

3.常见方式
count-based:如果两个词频繁的同时出现,那么它们在空间中相近
prediction-based:考虑了上下文

4.prediction-based
基本思想:
上一个词为输入,下一个词为输出,中间层作为word vector
这里写图片描述
比如,cai和ma就非常接近

李宏毅机器学习16—Unsupervised learning:word embedding Unsupervised learning:word embedding 无监督学习:词嵌入 摘要:这节课通过介绍word embedding,说明什么是无监督学习以及wordembedding的两种实现方法,简单介绍了一些运用wordembedding方法的实际应用。, 目录 一、什么是word embedding 二、两种实现方法: 1.count based 2.prediction based 三、如何训练这个神经网络 四、Prediction-based model的其他类... 阅读详情

相关推荐

【学习笔记李宏毅2021春机器学习课程第7.2节:自监督学习(二)

文章目录1 为什么BERT有用?2 多语言的BERT2.1 跨语言的阅读理解2.2 跨语言对齐 1 为什么BERT有用? 最常见的解释是,当输入一串文本时,每个文本都有一个对应的向量。对于这个向量,我们称之为embedding。 它的特别之处在于,这些向量代表了输入词的含义。例如,模型输入 “台湾大学”,输出4个向量。这4个向量分别代表 “台”、“湾”、"大 "和 “学”。 更具体地说,如果你把这些词所对应的向量画出来,或者计算它们之间的距离,你会发现,意思比较相似的词,它们的向量比较接近。例如,"鸟 "

Harryline的博客 490

李宏毅老师课件整合

包包含李宏毅老师的机器学习所有课件,都是在李宏毅老师个人主页下载整理的,建议配合B站李宏毅老师的Machine Learning 视频一块使用。

李宏毅《深度学习》笔记(一)

李宏毅《深度学习》笔记(一) 一、机器学习介绍 1.人工智能、机器学习、深度学习的概念区分 人工智能(Artificial Intelligence):这是一个很广泛的概念,这个词在1950年就有了。这个词意味着一个人类长远以来的目标,希望机器可以跟人一样的聪明,因此人工智能是我们想要达成的目标。 机器学习(Machine Leaning):而对于如何实现人工智能?人们希望让机器能够像人一样去学习。因此机器学习是想要达成目标的手段,希望机器通过学习方式,让机器跟人一样聪明。 深度学习(Deep Lear

weixin_44469952的博客 942

李宏毅(2020)作业4-hw4_RNN-判断句子的情感类别

文章目录作业说明数据集介绍Recurrent Neural NetworksDownload DatasetUtilsTrain Word to Vector词嵌入 word2vecData PreprocessDatasetModelTrainTestMainPredict and Write to csv file 作业说明 1. 本次数据集包括training_data,training_label和training_nolabel三个txt文件,训练集包括有标签(积极的还是消极的)的和没有标签的.

顾道长生的科研笔记 1746

李宏毅机器学习(八)ELMo、BERT、GPT、XLNet、MASS、BART、UniLM、ELECTRA、others

怎么得到这个pre-train好的模型呢? Pre-training by Translation(翻译) Context Vector(CoVe): Embeddingwords必须要考虑上下文! 有一个方法是用基于Translation的Model! 就是用Translation这个任务间接的训练model! 为什么不用Summary等任务作为工具呢,因为summary是提取某些word的重要性,那么不能做到对所有的word一视同仁! 同时该任务的缺点也在于需要大量的成对的数据,我们不可能有很多的数

qq_35222729的博客 1776

笔记ML-LHY-14: Unsupervised Learning - Word Embedding

Word Embedding Count based 这种方法和LSA类似: 如果wiw_iwi​和wjw_jwj​经常成对出现,那么用一个向量表示的V(wi)V(w_i)V(wi​)和V(wj)V(w_j)V(wj​)内积的值就会比较大。所以和LSA类似,可以用GD求隐含向量表示。 Prediction based 这个方法思想很巧妙,利用文章中句子的词语顺序作为标签,训练一个神经网络,大致训练过程如下: 那么这个网络我们并不是要网络的输出,而是用第一个隐藏层的输出作为一个词语的隐含向量表示:

upup 407

常用的词嵌入(Word Embedding)方法及其原理(超详细的李宏毅视频课笔记

介绍最早的电脑读取文字的 每一个词汇都当做一个符号,都用向量来描述,这个方法是不足的,这样词汇和词汇之间的相关性反应不出来。 后来有了word class,将词汇进行分类。 这个方法也比较粗糙,比如动物也分了很多种 Word Embedding 每一个的词汇都用向量来描述,但是每一个维度是一个属性。 怎么做?这是一个无监督方法,通过让模型阅读大量词汇,就可以知道这个embedding的feature vector长什么样子。 就是找一个network,输入是一个词汇,输出就是那个embedding, 输

双鸭山•克里菲斯•北方孤星之堕 1万+

机器学习 李宏毅 L25-Word Embedding

Word Embedding 主要用于文字的无监督学习,机器能够在无监督情况下,通过阅读大量数据后能够理解词语的含义。最简单的编码方式是1-of-N encoding,但是较为复杂。由于classification能够实现化繁为简,因此可以对于词汇进行classification,使用word embedding,每一个词汇使用一个连续的向量进行描述,每一维均代表某种含义。 每一个词汇的意义可

okgagaga的博客 1331

李宏毅ML lecture-14 unsupervised Learning Word Embeddng

李宏毅ML lecture-14 unsupervised Learning word2vec

qq_26737815的博客 375

机器学习通俗易懂系列之Word2vec

本来工作后比较懒,很久不写博客了,因为实习小同学时不时问到一些问题,网上的资料比较分散、不够通俗透彻,决定重新开启这个系列,这一篇是word2vec

就俩字,咱们要做精通,不做熟悉 1102

word embedding and word2vec 理解

该篇博文纯属个人观点,本着共同交流学习的想法,其中有错误和不足还请大佬们指正。在NLP处理中,词向量是网络的基本输入,那么该如何获得词向量呢?    两种方法,一种是one-hot representation(中文:独热表示,不建议记中文名,以后均是英文),另一种是distribute representation。一、One-hot representation    问什么称之为one-ho...

herr_kun的博客 1464

机器学习数据预处理2:词向量 (word2vec)

google 两篇关于 word2vec 的论文: [1]Tomas Mikolov, Kai Chen, Greg Corrado, and Jeffrey Dean. Efficient Estimation of Word Representations in Vector Space. In Proceedings of Workshop at ICLR, 2013. [2]Tomas...

梦Dancing的博客 4838

word2vec原理_word2vec(一)

最近在看王喆的机器学习笔记王喆的机器学习笔记​zhuanlan.zhihu.com发现大部分推荐系统的特征表示都变为了embedding形式(万物皆可embedding), item2vec是根据word2vec演变而来的,因此想仔细的梳理word2vec原理以及优化方法,这篇首先介绍了word2vec的原理。参考资料:李宏毅 word embedding/ cs224n word2vec/ Al...

weixin_39834205的博客 291

李宏毅2020机器学习 【学习笔记】 P23 Unsupervised Learning:Word Embedding

李宏毅2020机器学习深度学习(完整版)国语】 https://www.bilibili.com/video/BV1JE411g7XF/?

weixin_51330846的博客 808

李宏毅2021机器学习笔记(十三)

Transformer 简单来说就是Sequence-to-Sequence 输入一个序列,输出一个结果 这个是台语到中文的翻译器 但是如果你特质化模型,效果当然更好。当然Seq2Seq也能做 还有如下。 Transformer原理 Encoder 这就是一级框架。下面我们来讲Encoder 其实Transformer的Encoder就是用了Self-attention。 解释一下:每个Block都包括好几个............

qq_44698709的博客 364

李宏毅机器学习课程笔记5:Unsupervised Learning - Linear Methods、Word Embedding、Neighbor Embedding

台湾大学李宏毅老师的机器学习课程是一份非常好的ML/DL入门资料,李宏毅老师将课程录像上传到了YouTube,地址:NTUEE ML 2016 。 这篇文章是学习本课程第13-15课所做的笔记和自己的理解。Lecture 13: Unsupervised Learning - Linear Methods Unsupervised Learning有两种,化繁为简(Clustering & Dim

徐子尧的博客 7650

DeepNLP的表示学习·词嵌入来龙去脉·深度学习(Deep Learning)·自然语言处理(NLP)·表示(Representation)

DeepNLP的表示学习·词嵌入来龙去脉·深度学习(Deep Learning)·自然语言处理(NLP)·表示(Representation) 词向量、word embedding、分布式表示、word2vec、glove 术语解释! 自然语言处理表示学习 词向量、word2vec无门槛理解! 其实顺便分享下,在我个人的方法论思维中,一个带有完整上下文以及结构构建良好的知识框架,在某种程度上,比一些细枝末节的详细知识点来的重要的多了!因为,一旦构建了一个完备的知识结构框架,那么剩下你要做的是将一些零零碎

Mr.Scofield 3万+

[机器学习入门] 李宏毅机器学习笔记-15 (Unsupervised Learning: Word Embedding;无监督学习:词嵌入)

[机器学习入门] 李宏毅机器学习笔记-15 (Unsupervised Learning: Word Embedding;无监督学习:词嵌入) PDF VIDEOWord Embedding Word Embedding 是前面讲到的dimension reduction一个很好的应用。 1-of-N Encoding,是把所有的word用一个向量表示,每个向量都不一样,我们没办法

Holeung blog 3473
上一篇: 【台大李宏毅ML课程】Lecture 12 Semi-Supervised Learning半监督学习笔记
下一篇: 【台大李宏毅ML课程】Lecture 13 Unsupervised Learning——Linear Dimension Reduction笔记
code_caq
博客等级 码龄10年 112粉丝 58原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值