Stability AI发布全新代码模型Stable Code 3B

这篇具有很好参考价值的文章主要介绍了Stability AI发布全新代码模型Stable Code 3B。希望对大家有所帮助。如果存在错误或未考虑完全的地方,请大家不吝赐教,您也可以点击"举报违法"按钮提交疑问。

Stable Code 3B: Coding on the Edge

要点

  • Stable Code 3B 是一个包含 30 亿个参数的大型语言模型 (LLM),可实现准确且响应灵敏的代码补全,其水平与大 2.5 倍的 CodeLLaMA 7b 等模型相当。
  • 即使在 MacBook Air 等普通笔记本电脑上没有 GPU,也可以离线运行。

stablecode3b 部署,AIGC,人工智能,AIGC,生成对抗网络,计算机视觉

1月16日,Stability AI宣布 2024 年第一个大型语言模型版本:stable-code-3b。这个新的 LLM 是之前发布的 stable-code Alpha 3B 的后续版本,也是第一个主要的稳定代码版本,提供了新的最先进的模型,专为具有多种附加功能的代码完成而设计。

与 CodeLLaMA 7b 相比,Stable Code 3B 体积缩小了 60%,同时跨编程语言具有相似的高级性能。基于预先存在的 Stable LM 3B 基础模型(在 4 万亿个自然语言数据上进行训练),Stable Code 进一步接受了特定于软件工程的训练数据,包括代码。该模型的紧凑尺寸使其可以在现代笔记本电脑的边缘实时私下运行,即使是那些没有专用 GPU 的笔记本电脑。

Stable Code 3B 跨多种语言提供更多功能和显着更好的性能,并具有额外的优势,例如支持中间填充功能 (FIM) 和扩展的上下文大小。Stable Code 作为基础在最多 16,384 个 token 的序列上进行训练,但遵循与 CodeLlama 类似的方法,实施旋转嵌入,可选择允许修改最多 1,000,000 个旋转基,进一步将模型的上下文长度扩展至 100k 个 token。

Stable Code 3B 接受了 18 种编程语言的训练(根据 [2023 年 StackOverflow 开发人员调查] 选择)) 并展示了跨多种测试编程语言的 MultiPL-E 指标的最先进性能(与类似大小的模型相比)。

性能比较
stablecode3b 部署,AIGC,人工智能,AIGC,生成对抗网络,计算机视觉
stablecode3b 部署,AIGC,人工智能,AIGC,生成对抗网络,计算机视觉

Stable Code 完成 3B 与 CodeLLama 7B 的并排比较

stablecode3b 部署,AIGC,人工智能,AIGC,生成对抗网络,计算机视觉

Training见解

在训练流程由类似于 Codellama 的多阶段过程组成。从对自然语言数据进行预训练的 LM 开始,在本例中为 StableLM-3B-4e1t,然后进行无监督微调多个代码和与代码相关的数据集,包括 CommitPack、GitHub Issues、StarCoder 和其他数学数据集。在第二步中,根据 CodeLLama 中建议的基本修改,进一步使用 16,384 个标记的更长序列对模型进行微调。新的稳定代码模型还支持 Flash Attention 2 并且可供使用。

对数据和模型的进一步了解,可以参考Stability AI的模型卡中找到。Stability AI将发布一份完整的技术报告,其中包含更多详细信息和删减内容,以便对社区更加透明和开放。文章来源地址https://www.toymoban.com/news/detail-824826.html

到了这里,关于Stability AI发布全新代码模型Stable Code 3B的文章就介绍完了。如果您还想了解更多内容,请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章,希望大家以后多多支持TOY模板网!

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处: 如若内容造成侵权/违法违规/事实不符,请点击违法举报进行投诉反馈,一经查实,立即删除!

领支付宝红包 赞助服务器费用

相关文章

  • 9款最新文生图模型汇总!含华为、谷歌、Stability AI等大厂创新模型(附论文和代码)

    2023年真是文生图大放异彩的一年,给数字艺术界和创意圈注入了新鲜血液。从起初的基础图像创作跃进到现在的超逼真效果,这些先进的模型彻底变革了我们制作和享受数字作品的途径。 最近,一些大公司比如华为、谷歌、还有Stability AI等人工智能巨头也没闲着,纷纷推出

    2024年01月23日
    浏览(28)
  • Amazon Code Whisperer 的正式使用,全新 AI 代码工具等你发现!(内附详细安装步骤图解)

    文章作者:稚始稚终 关于 Code Whisperer Code Whisperer,亚马逊推出的实时 AI 编程助手,是一项基于机器学习的服务,它可以分析开发者在集成开发环境(IDE)中的注释和代码,并根据其内容生成多种代码建议。 开发者可以用自然语言(目前仅支持英语)描述他们想要实现的功能

    2024年02月04日
    浏览(28)
  • Stability AI 的Stable Video公测体验

    引言: Stability AI官方的SVD视频生成平台现已公测,功能上,它在SVD模型的基础上增加了镜头控制能力,使得视频生成更加灵活和多样化。用户可以通过上传图片或输入文本提示来生成视频,而平台的演示视频已经展示了其高质量的生成效果。 此外,平台每天提供150个免费额

    2024年03月24日
    浏览(29)
  • 探索Stable Code:引领编程新纪元的AI语言模型

    博主猫头虎的技术世界 🌟 欢迎来到猫头虎的博客 — 探索技术的无限可能! 专栏链接 : 🔗 精选专栏 : 《面试题大全》 — 面试准备的宝典! 《IDEA开发秘籍》 — 提升你的IDEA技能! 《100天精通鸿蒙》 — 从Web/安卓到鸿蒙大师! 《100天精通Golang(基础入门篇)》 — 踏入

    2024年04月10日
    浏览(57)
  • Stable Doodle:Stability AI推出的一款零门槛AI绘画神器

    Stable Doodle是由Stability AI推出的一款零门槛AI绘画神器,可以将简单的草图转化为精美的图像。它可以将随手的塗鴉草稿转化为高畫質的完成圖,让用户能够以更快的速度将想法转化为精美的艺术作品。Stable Doodle利用最新的Stable Diffusion模型,通过分析草图的轮廓,生成视觉上

    2024年02月03日
    浏览(34)
  • 重磅!Stable Diffusion 3 发布,AI模型百花争鸣!

    击上方关注 “ 终端研发部 ” 最近AI大变天! 刚火了Sora,又火了Gemma,这不stable diffusion又来了!大语言模型成了龙争虎斗的年代已开启~ Stable Diffusion 3到底是什么? 用官方的描述,3.0版本核心功能是多主题提示、图像质量和拼写能力。 比如给出提示词:厨房的桌子上放着一

    2024年03月13日
    浏览(45)
  • 使用Gradio构建生成式AI应用程序; Stability AI推出Stable Diffusion XL 1.0

    🦉 AI新闻 🚀 Stability AI推出最先进的AI工具Stable Diffusion XL 1.0 摘要 :Stability AI宣布推出Stable Diffusion XL 1.0,该版本是其迄今为止最先进的AI工具。Stable Diffusion XL 1.0提供更鲜艳、更准确的图片生成,包括对比度、阴影和光照效果。该版本还支持用户定制生成的图片风格和在图片

    2024年02月14日
    浏览(30)
  • Stability AI推出Stable Diffusion 3和Turbo版API:定义新时代AI,超越DALL-E 3和Midjourney v6|TodayAI

    在人工智能的世界里,革命性的发展正稳步前行。Stability AI 在其开发者平台API上全新推出了Stable Diffusion 3和Stable Diffusion 3 Turbo。这两款产品在技术上的突破不仅提升了AI技术的可用性,还进一步推动了开放式创新的愿景。 AI性能的新高度 Stable Diffusion 3和其加速版本Stable Dif

    2024年04月27日
    浏览(29)
  • OpenAI全新发布文生视频模型:Sora!

    OpenAI官网原文链接:https://openai.com/research/video-generation-models-as-world-simulators#fn-20      我们探索视频数据生成模型的大规模训练。具体来说,我们在可变持续时间、分辨率和宽高比的视频和图像上联合训练文本条件扩散模型。我们利用对视频和图像潜在代码的时空Patche

    2024年02月19日
    浏览(33)
  • 百度发布全新 AI 互动式搜索:百度简单搜索

    本心、输入输出、结果 编辑:简简单单 Online zuozuo 地址:https://blog.csdn.net/qq_15071263 10月17日,百度世界大会2023即将开幕,此次活动将举办一场主论坛及七场分论坛 百度简单搜索 是百度通过大模型重构的第一个产品,也是首个A1互动式搜索一一简单搜索 主要能力 🔍 百度新搜

    2024年02月07日
    浏览(30)

觉得文章有用就打赏一下文章作者

支付宝扫一扫打赏

博客赞助

微信扫一扫打赏

请作者喝杯咖啡吧~博客赞助

支付宝扫一扫领取红包,优惠每天领

二维码1

领取红包

二维码2

领红包