t5 &mt5参数量

这篇具有很好参考价值的文章主要介绍了t5 &mt5参数量。希望对大家有所帮助。如果存在错误或未考虑完全的地方,请大家不吝赐教,您也可以点击"举报违法"按钮提交疑问。

目录

BERT参数量:

t5参数量:

 mt5参数量:


BERT参数量:

BERT-Base版本:12层Transformer, 隐藏单元数768维度,12个注意力头,参数量为110.

BERT-Large版本:24层Transformer, 隐藏单元数1024维度,16个注意力头,参数量为3400.

t5参数量:

参考链接:reference

  • base版本:24层,隐层768维,12个注意力头,参数量为220M
  • small版本:12层,隐层 512维,8个注意力头,参数量约为60M
  • Large版本:48层,隐层1024维,16个注意力头,参数量约为770M
  • 3B和11B版本:48层,隐层1024维,分别为32/128个注意力头,参数量达到了 2.8B和11B

 下载地址:

https://huggingface.co/t5-base/tree/main

 mt5参数量:

参考链接:reference

  • mT5-Small (300 million parameters): gs://t5-data/pretrained_models/mt5/small
  • mT5-Base (580 million parameters): gs://t5-data/pretrained_models/mt5/base
  • mT5-Large (1.2 billion parameters): gs://t5-data/pretrained_models/mt5/large
  • mT5-XL (3.7 billion parameters): gs://t5-data/pretrained_models/mt5/xl
  • mT5-XXL (13 billion parameters): gs://t5-data/pretrained_models/mt5/xxl

下载地址:https://huggingface.co/google/mt5-base文章来源地址https://www.toymoban.com/news/detail-650294.html

到了这里,关于t5 &mt5参数量的文章就介绍完了。如果您还想了解更多内容,请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章,希望大家以后多多支持TOY模板网!

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处: 如若内容造成侵权/违法违规/事实不符,请点击违法举报进行投诉反馈,一经查实,立即删除!

领支付宝红包 赞助服务器费用

相关文章

觉得文章有用就打赏一下文章作者

支付宝扫一扫打赏

博客赞助

微信扫一扫打赏

请作者喝杯咖啡吧~博客赞助

支付宝扫一扫领取红包,优惠每天领

二维码1

领取红包

二维码2

领红包