新闻中心
Stability AI开源3B代码生成模型:可补全,还能Debug
本周一,Stability AI 开源了小体量预训练模型 Stable Code Instruct 3B。
Stable Code Instruct 3B 是建立在 Stable Code 3B 基础上的指令调整编码语言模型(Code LM)。通过提供自然语言提示,该模型可应用于多种任务,包括代码生成、数学问题以及其他与软件工程相关的任务。
Stability AI声称,他们的模型在规模为3B时表现出了最先进的性能,优于CodeLlama的7B Instruct等更大规模的模型,在软件工程相关任务中,甚至与StarChat的15B模型性能相当。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜
- 模型:https://huggingface.co/stabilityai/stable-code-instruct-3b
- HuggingFace 试用:https://huggingface.co/spaces/stabilityai/stable-code-instruct-3b
- Stable Code 技术报告:https://static1.squarespace.com/static/6213c340453c3f502425776e/t/6601c5713150412edcd56f8e/1711392114564/Stable_Code_TechReport_release.pdf
Stable Code Instruct 3
B已经升级了代码补全功能,并且支持自然语言交互,旨在提高编程和软件开发任务的效率和直观性。实验结果显示,这个模型在各种编码相关任务中表现优异,超过了Codellama 7B Instruct和DeepSeek-Coder Instruct 1.3B等竞争对手模型。
方法介绍
Stable Code 建立在 Stable LM 3B 的基础上。Stable Code 是一个因果纯解码器 transformer,类似于 LLaMA 架构,与 LLaMA 的主要区别如下:
- 位置嵌入,旋转位置嵌入应用于头嵌入维度的前 25%,以提高吞吐量;
- 标准化,带有学得偏差项的 LayerNorm;
- 偏差,除了键、查询和值投影的偏差,Stable Code 从前馈网络和多头自注意力层中删除了所有偏差项。

下表给出了预训练语料库数据集的采样权重、 epoch、类别等信息。


根据 Stack Overflow 2025 开发者调查报告,Stable Code Instruct 3B 重点关注 Python、J*ascript、J*a、C、C++ 和 Go 等语言,这些语言对于各种开发人员来说是最流行和最有影响力的。虽然这些语言被选为训练的重点,但该模型还针对其他广泛采用的语言(例如 SQL、PHP 和 Rust)进行了训练。

即使对于最初未包含在训练集中的语言(例如 Lua),Stable Code Instruct 3B 也能提供强大的测试性能。这种熟练程度可能源于其对底层编码原理的理解,以及利用编码任务固有的可预测性,在不同编程环境中适应概念的能力。
Stable Code Instruct 3B 不仅精通代码生成,还精通 FIM(Fill in the Middle)任务、数据库查询、代码翻译、解释和创建。其指令调整使其能够理解并按照细致入微的指令采取行动,促进除简单代码完成之外的广泛编码任务,包括数学理解、逻辑推理和围绕软件开发处理复杂的技术描述。
性能评估
与 Codellama 7B Instruct 和 DeepSeek-Coder Instruct 1.3B 等领先模型相比,Stable Code Instruct 3B 在一系列编码任务中展现出卓越的性能。

研究团队还在 Multi-PL 基准上比较了三种模型。尽管参数量较少,但 Stable Code Instruct 3B 在所有语言上的表现均明显优于 CodeLlama Instruct。

下表 8 展示了几种模型在 FIM 任务上的性能:

实验测试表明,Stable Code Instruct 3B 在代码完成准确性、对自然语言指令的理解以及跨不同编程语言的能力方面可与其他模型媲美甚至超越。

Stable Code Instruct 3B 的参数规模和低硬件要求使其可供广泛的受众使用,使开发人员能够更高效地工作。值得一提的是,Stable Code Instruct 3B 现在可以通过 Stability AI 会员资格用于商业目的。
以上就是Stability AI开源3B代码生成模型:可补全,还能Debug的详细内容,更多请关注其它相关文章!
# 应用于
# 北海建设工程信息网站
# 菏泽网站关键词排名优化
# 兰州网站推广文案公司
# 淮南关键词自然排名
# 淘宝网站内推广怎么做
# 淘宝seo如何定价
# 宁波seo引流推广公司
# 浠水推广代运营网站
# 优化网站排名差异
# 小米营销推广策划总结
# 下表
# 开发人员
# 模型
# 使其
# 基础上
# 出了
# 自然语言
# 软件工程
# 还能
# llama
# deepseek
# overflow
# 开源
# ai
相关栏目:
【
行业资讯67740 】
【
技术百科0 】
【
网络运营39195 】
相关推荐:
如何加装固态硬盘
如何在固态硬盘上安装win7系统
如何提高import命令的性能
苹果16多有哪些功能
sofa是什么意思
征信信誉不好如何恢复 如何修复不良征信方法
juice是什么意思
awful是什么意思
如何4k对齐固态硬盘
j*a数组怎么取元素
命令行ftp如何创建目录
sqlite中datediff函数怎么用 SQLite中DATEDIFF()函数的用法分享
如何将系统移到固态硬盘
怎么用typescript 写js
linux如何跳回命令行界面
国标控制器单片机怎么接线
新三板市盈率是什么意思
j*a数组对象怎么取
启辰星power标志是什么意思
如何学好typescript
苹果16配置参数有哪些
如何使用批处理命令编译vc程序
mac 如何启动命令行模式
苹果16自带配件有哪些
vue项目如何用typescript
a股等权平均市盈率是什么意思
移动固态硬盘如何使用
电脑命令如何删除账号
怎么看手机是不是双模5g手机
虽千万人吾往矣什么意思
linux如何调出命令行
typescript的语法格式是什么
三星相机里power是什么意思
如何用ftp连接命令行
为什么选择typescript
光刻机的分类及特点
nosql数据库的应用场景有哪些
rxjs和typescript什么意思
shell如何执行sql脚本命令行
光猫power灯一直闪是什么意思
typescript如何使用viewer
cmd如何定时执行命令
估值水平比较中市盈率E是什么意思
typescript如何遍历map
苹果16将会带来哪些升级
手机如何ip绑定域名解析
三星 nfc什么功能是什么意思
win7怎么取消360显示的壁纸
linux如何安装yum命令
光刻机的分类及其优缺点


2024-03-28
浏览次数:次
返回列表