DLNg第三周：序列模型和注意力机制

lypbendlf 2024-10-15 10:18:35 原文

1.基础模型

将法语翻译为英语，分为编码和解码阶段，将一个序列变为另一个序列。即序列对序列模型。

从图中识别出物体的状态，将图片转换为文字。

先使用CNN处理图片，再使用RNN将其转换为语言描述。

2.选择最可能的句子

7.注意力模型直观理解

绿色部分是输入法语句子并记忆，在感知机中传递，紫色是解码网络，生成英文翻译；

人翻译的时候会选择看一段翻译一段，而在NN中如果是记忆整个句子，那效果就如Blue得分的蓝线随着单词的增长而降低。

在神经网络中，记忆长句子是很困难的。

使用双向RNN获取特征集，使用另一个RNN来进行翻译。

在预测第一个单词Jane时，需要考虑法语中jane和其附近的词，这时会根据距离给予每个单词一个注意力权重，

比如对jane是α<1,1>,visite是a<1,2>,l'Afrique是a<1,3>这样将原来的网络输入根据不同的权重来预测单词Jane;

在生成第二个单词的时候，又会有（紫色笔）不同的注意力权重，并且输入上一个单元的输出；绿色笔是预测第三个词。

α<t,t’>会告诉在尝试生成第T个英文单词，应该花多少注意力在第t个法语词上，当生成一个特定的英文词时，它允许在每个时间步内去看周围词距内的法语需要多少注意力。

8.注意力模型

是将上一节的进行了一点展开讲解，对于预测某一单词，Σα<1,t'>=1，是说在生成第一个单词的时候，总共t'个可影响的单词，它们的影响总和为1，并且状态C是根据其对应的注意力来计算的。

softmax函数能够保证和为1，左下角的图输入为上一个预测结果和当前词的Attention，右下角的图也就是左下角的具体化。

右下角的图左边是出入，上面是输出，能够发现注意力？？

DLNg第三周：序列模型和注意力机制的更多相关文章

吴恩达《深度学习》-第五门课序列模型(Sequence Models)-第三周序列模型和注意力机制（Sequence models & Attention mechanism）-课程笔记
第三周序列模型和注意力机制(Sequence models & Attention mechanism) 3.1 序列结构的各种序列(Various sequence to sequence ...
深度学习教程 | Seq2Seq序列模型和注意力机制
作者:韩信子@ShowMeAI 教程地址:http://www.showmeai.tech/tutorials/35 本文地址:http://www.showmeai.tech/article-det ...
DeepLearning.ai学习笔记（五）序列模型 -- week2 序列模型和注意力机制
一.基础模型假设要翻译下面这句话: "简将要在9月访问中国" 正确的翻译结果应该是: "Jane is visiting China in September" ...
ng-深度学习-课程笔记-17: 序列模型和注意力机制(Week3)
1 基础模型(Basic models) 一个机器翻译的例子,比如把法语翻译成英语,如何构建一个神经网络来解决这个问题呢? 首先用RNN构建一个encoder,对法语进行编码,得到一系列特征然后用R ...
Coursera Deep Learning笔记序列模型（三）Sequence models & Attention mechanism(序列模型和注意力机制)
参考 1. 基础模型(Basic Model) Sequence to sequence模型(Seq2Seq) 从机器翻译到语音识别方面都有着广泛的应用. 举例: 该机器翻译问题,可以使用" ...
Seq2Seq模型与注意力机制
Seq2Seq模型基本原理核心思想:将一个作为输入的序列映射为一个作为输出的序列编码输入解码输出解码第一步,解码器进入编码器的最终状态,生成第一个输出以后解码器读入上一步的输出,生成当前步 ...
Deep Learning.ai学习笔记_第五门课_序列模型
目录第一周循环序列模型第二周自然语言处理与词嵌入第三周序列模型和注意力机制第一周循环序列模型在进行语音识别时,给定一个输入音频片段X,并要求输出对应的文字记录Y,这个例子中输入和输出 ...
[DeeplearningAI笔记]序列模型3.7-3.8注意力模型
5.3序列模型与注意力机制觉得有用的话,欢迎一起讨论相互学习~Follow Me 3.7注意力模型直观理解Attention model intuition 长序列问题 The problem of ...
[DeeplearningAI笔记]序列模型3.9-3.10语音辨识/CTC损失函数/触发字检测
5.3序列模型与注意力机制觉得有用的话,欢迎一起讨论相互学习~Follow Me 3.9语音辨识 Speech recognition 问题描述对于音频片段(audio clip)x ,y生成文本 ...

随机推荐

python3 的 mysql 简单操作
一.python 提供的 db 接口 pymysql 两个基本对象: connection.cursor 连接示例 # connect_demo.py import pymysql db = pymy ...
solus 系统 - 自定义终端快捷键
终端: 命令方式:Alt+F2 输入“gnome-terminal“ 全屏显示 control+alt+F1 (退出 control+alt+F2) 可在`键盘`菜单中添加自定义快捷方式: 其它快捷方 ...
修改Jenkins的主目录步骤
在使用Jenkins做持续集成过程中,在构建很多次后发现有时在构建的时候系统提示磁盘空间不足,此时检查发现Jenkins的主目录挂载区放在了服务器根目录下,占用空间较大,此时除了对服务器的磁盘进行扩容 ...
Python与金融量化分析----金融与量化投资
一:金融了解金融:就是对现有资源进行重新的整合之后,进行价值和利润的等效流通. 金融工具: 股票期货黄金外汇基金 ............. 股票: 股票是股份公司发给出资人多的一种凭证,股 ...
Flask----基础
Flask是一个基于Python开发并且依赖jinja2模板和Werkzeug WSGI服务的一个微型框架,对于Werkzeug本质是Socket服务端,其用于接收http请求并对请求进行预处理,然后 ...
Django中,ajax检测注册用户信息是否可用?
ajax检测注册用户信息主体思路 1.在settings.py中配置需要使用的信息 #对static文件进行配置 STATICFILES_DIRS=[ os.path.join(BASE_DIR,'s ...
AppSettings操作类
using System; using System.Collections.Generic; using System.Configuration; using System.Linq; using ...
WPF datagrid 获取行或单格为NULL 问题
datagrid 属性 EnableRowVirtualization 设置为 false 解决...不要问我为什么. 害死我了
win10屏幕变灰怎么解决？
朋友们在使用电脑过程中最高频使用的快捷键可能就是ctrl+c, ctrl+v了,但是殊不知,有时候按的太快产生误触,触发了ctrl+win+c,是屏幕变成了灰色,只需要再次同时按下这三个键就可以恢复彩 ...
mysql日期格式转换，如何保持原日期？CONVERT/Substring 函数截取。replace替换
http://www.cnblogs.com/stevenjson/p/3729577.html CONVERT(varchar(100), getdate(), 112)这种, 问题就出在getda ...