首页 / 注意力机制

#

注意力机制

#

805次浏览 1人互动

此刻你想和大家分享什么

热门最新

2023-06-03 21:52

阿里巴巴_算法工程师

深度学习基础入门篇[六(1)]：模型调优注意力机制多头注意力

深度学习基础入门篇[六(1)]：模型调优：注意力机制[多头注意力、自注意力]，正则化【L1、L2，Dropout，Drop Connect】等 1.注意力机制 在深度学习领域，模型往往需要接收和处理大量的数据，然而在特定的某个时刻，往往只有少部分的某些数据是重要的，这种情况就非常适合Attention机制发光发热。  举个例子，图2展示了一个机器翻译的结果，在这个例子中，我们想将”who are you”翻译为”你是谁”，传统的模型处理方式是一个seq-to-seq的模型，其包含一个encoder端和一个decoder端，其中encoder端对”who are you”进行编码，然后将整句话的...

深度学习入门到进阶

点赞评论收藏

分享

玩命加载中

创作者周榜

更多

热议话题

更多

牛客网
牛客网在线编程
牛客网题解
牛客企业服务