Qwen2.5-Coder: 码无止境,学无止境!

简介: Qwen2.5-Coder: 码无止境,学无止境!


本文作者 | 通义千问团队


四月初,我们发布了CodeQwen1.5, 得到了社区广泛的关注与喜爱。自那以后,我们一直在继续努力提升代码模型。今天,我们很高兴地宣布新一代的开放代码模型Qwen2.5-Coder的发布,并正式将CodeQwen的命名改为Qwen-Coder,我们认为Coder更加拟人、灵动,期待其可以在未来真正与人类结对编程Qwen2.5-Coder是我们Qwen2.5开源家族的一员,共包括三个尺寸的模型:1.5B、7B和32B(在路上)。


本次更新的两大核心包括代码训练数据的进一步scaling,以及探索在提升代码能力的同时保持数学和通用能力。


1、码无止境:Qwen2.5-Coder基于强大的Qwen2.5初始化,扩增了更大规模的代码训练数据持续训练,包括源代码、文本代码混合数据、合成数据等共计5.5T tokens,使得Qwen2.5-Coder在代码生成、代码推理、代码修复等任务上都有了显著提升。


2、学无止境:我们希望Qwen2.5-Coder在提升代码能力的同时,也能保持在数学、通用能力等方面的优势。因此,我们在Qwen2.5-Coder中加入了更多的数学、通用能力数据,为未来的真实应用提供更为全面的基座。

基座模型:Qwen2.5-Coder


Qwen2.5-Coder最多128K tokens上下文,支持92种编程语言,并在多个代码相关的评估任务中都取得了显著的提升,包括代码生成、多编程语言代码生成、代码补全、代码修复等。


值得注意的是,本次开源的Qwen2.5-Coder-7B模型,打败了更大尺寸的DeepSeek-Coder-V2-Lite和Codestral-20B,成为当前最强大的基础代码模型之一。


除了代码任务外,Qwen2.5-Coder也具备极具竞争力的数学能力。面向通用任务,我们评估了MMLU和ARC,结果表明Qwen2.5-Coder很好地保持了Qwen2.5的通用能力。



指令微调模型:

Qwen2.5-Coder-Instruct


我们在Qwen2.5-Coder的基础上,通过指令微调,得到了Qwen2.5-Coder-Instruct。Qwen2.5-Coder-Instruct除了进一步提升了多个任务上的性能外,还在更多的评估中体现出了卓越的泛化性。



特别的是,Qwen2.5-Coder-Instruct在几个方面表现非常突出:


1、卓越的多编程语言能力:为了更广泛的评估多编程语言能力,我们使用McEval在Qwen2.5-Coder-Instruct上进行了更多的测试,共设计40多种编程语言。结果表明Qwen2.5-Coder-Instruct在多种编程语言任务上表现非常出色,包括一些小众语言。



2、代码推理:我们认为,代码推理能力和通用推理能力是密切相关的,我们选择CRUXEval作为评估基准,结果表明Qwen2.5-Coder-Instruct在代码推理任务上表现非常出色。更有趣的是,我们发现,随着代码推理能力的提升,模型的复杂指令遵循也得到了增强,这鼓舞我们继续探索代码对于通用能力的增益。



3、数学能力:数学和代码经常被一起讨论,数学是代码的基础学科,代码是数学的重要工具。我们发现Qwen2.5-Coder-Instruct在代码和数学任务上都表现出色,是一个名副其实的理科生。



4、基础能力:我们还在通用能力上进行了评估,结果表明Qwen2.5-Coder-Instruct在通用能力上也保持了Qwen2.5的优势。



模型许可


Qwen2.5-Coder采用Apache 2.0许可证。我们希望本次开放程度的提升能够加速Qwen2.5-Coder在代码智能方面的应用。


Qwen2.5-Coder的下一步是什么?

我们正在筹备32B版本的Qwen2.5-Coder,期待可以直接向闭源模型发起挑战,很快就会和大家见面,敬请期待!除此之外,我们还在积极探索以代码为中心的强大推理模型,探索代码智能的边界。


Qwen2.5-Coder 论文链接:

https://arxiv.org/pdf/2409.12186

相关文章
|
存储 Shell Linux
git 大文件记录清除解决方案
git 大文件记录清除解决方案
4914 1
|
数据采集 人工智能 API
Qwen2.5-Coder深夜开源炸场,Prompt编程的时代来了!
通义千问团队开源「强大」、「多样」、「实用」的 Qwen2.5-Coder 全系列,致力于持续推动 Open Code LLMs 的发展。
|
5月前
|
人工智能 开发框架 文字识别
Qwen3.6 正式发布!阿里云百炼同步开启“AI大模型节省计划”超值优惠
阿里云发布千问Qwen3.6系列大模型,大模型官网:https://t.aliyun.com/U/JbblVp 实现编程、智能体(Agent)及多模态能力的范式跃迁:代码生成与调试更精准,原生支持LangChain等框架,工具调用更稳定,图文识别与推理全面升级。Qwen3.6-Flash轻量高效,开发体验优化。同步推出百炼「全模型通享」限时特惠,新客首月立减最高500元。
2429 1
|
人工智能 C++ iOS开发
ollama + qwen2.5-coder + VS Code + Continue 实现本地AI 辅助写代码
本文介绍在Apple M4 MacOS环境下搭建Ollama和qwen2.5-coder模型的过程。首先通过官网或Brew安装Ollama,然后下载qwen2.5-coder模型,可通过终端命令`ollama run qwen2.5-coder`启动模型进行测试。最后,在VS Code中安装Continue插件,并配置qwen2.5-coder模型用于代码开发辅助。
31616 71
|
11月前
|
人工智能 安全 开发工具
C3仓库AI代码门禁通用实践:基于Qwen3-Coder+RAG的代码评审
本文介绍基于Qwen3-Coder、RAG与Iflow在C3级代码仓库落地LLM代码评审的实践,实现AI辅助人工评审。通过CI流水线自动触发,结合私域知识库与生产代码同仓管理,已成功拦截数十次高危缺陷,显著提升评审效率与质量,具备向各类代码门禁平台复用推广的价值。(239字)
1906 24
|
自然语言处理 前端开发 网络协议
用 Qwen2.5-Coder 开发一个网页应用,完全0基础,已部署上线,代码开源!
利用Qwen2.5-Coder成功开发了一个简洁实用的网页应用,该应用能够在浏览器Tab标题中显示北京时间,并在页面中集成了实时时间显示和番茄时钟功能。通过Qwen2.5-Coder的强大代码生成能力,从零基础开始,仅需简单提示便完成了HTML、CSS和JavaScript的编写。经过几次优化调整,最终实现了美观且功能完善的网页应用,并顺利部署至Vercel平台,满足了作者在全屏模式下查看时间的需求。
用 Qwen2.5-Coder 开发一个网页应用,完全0基础,已部署上线,代码开源!
|
10月前
|
机器学习/深度学习 人工智能 前端开发
终端里的 AI 编程助手:OpenCode 使用指南
OpenCode 是开源的终端 AI 编码助手,支持 Claude、GPT-4 等模型,可在命令行完成代码编写、Bug 修复、项目重构。提供原生终端界面和上下文感知能力,适合全栈开发者和终端用户使用。
60607 11
|
人工智能 自然语言处理 数据可视化
全球最强开源代码模型Qwen2.5-Coder来了!
全球最强开源代码模型Qwen2.5-Coder来了!
4014 5