当前位置: 首页 > news >正文

html5响应式布局网站深圳最新新闻事件今天

html5响应式布局网站,深圳最新新闻事件今天,华为荣耀商店,wordpress添加一级菜单文章目录 如名称所示,BERT(来自Transformer的双向编码器表示)是基于Transformer模型。我们可以将BERT视为只有编码器部分的Transformer。 在上一个主题《Transformer入门》中,我们了解到将句子作为输入喂给Transformer的编码器&a…

文章目录


如名称所示,BERT(来自Transformer的双向编码器表示)是基于Transformer模型。我们可以将BERT视为只有编码器部分的Transformer。

在上一个主题《Transformer入门》中,我们了解到将句子作为输入喂给Transformer的编码器,它会返回句子中每个单词的表示作为输出。这正是BERT的本质——来自Transformer的编码器表示(Encoder
Representation from Transformer)。那么,“双向”这个词又是什么意思呢?

在 “Bidirectional Encoder Representation from Transformers” (BERT) 中的 “Bidirectional” 这个词,指的是模型在处理文本数据时能够同时考虑文本中的前后上下文信息。

以下是对 “Bidirectional” 的具体解释:

(1)传统单向语言模型:在 BERT 之前,常见的语言模型如 LSTM 或 GRU,通常是单向的。这意味着它们要么从左到右(正向)读取文本信息,要么从右到左(反向)读取。这样,每个词的表示只包含了它在一个方向上的上下文信息。

(2)双向性:而 “Bidirectional” 意味着模型在处理一个词时,能够同时考虑这个词左边和右边的上下文。这样,每个词的表示都能融合来自两个方向的信息,从而更加全面地理解词义和上下文。

在 BERT 模型中,“Bidirectional” 的实现方式如下:

(1)**Masked Language Model (MLM) **:在训练过程中,随机地遮盖(mask)输入序列中的一些词,然后要求模型预测这些被遮盖的词。由于模型不知道哪些词会被遮盖,因此它必须考虑所有词在两个方向上的上下文。

(2)**Next Sentence Prediction (NSP) **:在训练时,模型还会接收成对的句子作为输入,并学习预测第二个句子是否是第一个句子的后续。这进一步增强了模型对上下文的理解。

通过这种方式,BERT 成为了一个真正意义上的双向模型,它能够捕获文本中的复杂依赖关系,并在各种自然语言处理任务中取得了显著的性能提升。

Transformer的编码器本质上是双向的,因为它可以双向读取句子。因此,BERT基本上是从Transformer获得的双向编码器表示(the Bidirectional Encoder Representation obtained from the Transformer)。

让我们通过一个例子来理解BERT是如何作为Transformer的双向编码器表示的。让我们使用上一节中看到的同一个句子。

假设我们有句子A:He got bit by Python。现在,我们将这个句子作为输入喂给Transformer的编码器,并得到句子中每个单词的上下文表示(embedding,嵌入)作为输出。一旦我们将句子作为输入喂给编码器,编码器就会使用多头注意力机制(将句子中的每个单词与句子中的所有单词关联起来,以学习单词之间的关系和上下文意义)理解句子中每个单词的上下文,并返回句子中每个单词的上下文表示作为输出。

如下图所示,我们将句子作为输入喂给Transformer的编码器,并得到句子中每个单词的表示(representation)作为输出。我们可以堆叠N个编码器,如下图所示。我们只展开了编码器1,以减少混乱。在下面的图中,R_He是单词“He”的表示,R_got是单词“got”的表示,以此类推。每个标记的表示大小将是编码器层的大小。假设编码器层的大小是768,那么每个标记的表示大小将是768:

在这里插入图片描述

图2.3 – BERT生成句子中每个单词的表示

同样,如果我们把句子B,“Python is a popular programming language.”,喂给Transformer的编码器,我们得到句子中每个单词的上下文表示作为输出,如下图所示:

在这里插入图片描述

图2.4 – BERT生成句子中每个单词的表示

因此,使用BERT模型,对于给定的句子,我们得到句子中每个单词的上下文表示(embedding,嵌入)作为输出。

现在我们了解了BERT是如何生成上下文表示的,接下来我们将查看BERT的不同配置。


感谢您的阅读,欢迎关注!


http://www.zhongyajixie.com/news/1085.html

相关文章:

  • 静态和动态网站的区别磁力屋torrentkitty
  • 网站建设策划解决方案网上销售培训课程
  • wordpress 微博功能宁波seo优化公司
  • 柏乡网站建设怎么打开网站
  • 微网站运营唐山seo
  • 易语言网站开发教程软文广告经典案例短的
  • 阳江房产网站关键词优化武汉
  • 一个域名访问不同的网站天津网站排名提升
  • wordpress网站导航主题qq刷赞网站推广
  • 重庆做网站开发的公司有哪些获客引流100种方法
  • 可视化网站制作软件百度一级代理商
  • 自己做的网站怎么设置文件下载营业推广的形式包括
  • 东莞的网站建设公司株洲seo推广
  • 广东疫情最新消息通知seo网络推广优化
  • 网站设计公司无锡国内做网站比较好的公司
  • 网站搜索模块沧州网站seo
  • 贵阳网站设计哪家好搜索引擎营销概念
  • 专做民宿预定的网站发帖子最好的几个网站
  • 今科网站建设推广联盟平台
  • wordpress 单独搜索页面佛山网络排名优化
  • 做设计哪个网站可以接单产品互联网营销推广
  • 聊城做wap网站价格seo公司推荐
  • 大连模板网站制作公司搜索引擎营销是什么
  • 做网站地图58精准推广点击器
  • 吉林省长春市建设局网站百度推广中心
  • 住房和城乡建设部电工证论坛seo招聘
  • 杭州网站建设V芯ee8888e优化关键词怎么做
  • wordpress本地视频教程扬州seo推广
  • 南京驰铭做网站公司网站运营推广
  • 怎么做网站的浏览栏网站app免费生成软件