阿里开源编程大模型 CodeQwen1.5：64K92编程语言，Code和SQL编程，评测接近GPT-4-Turbo

news2026/2/14 0:05:56

前言

阿里巴巴最近发布的CodeQwen1.5模型标志着其在编程语言模型领域的一次重大突破。这款开源模型不仅支持高达92种编程语言和64K的上下文长度，而且在多项性能评测中显示出接近或超过当前行业领导者GPT-4-Turbo的能力。

Huggingface模型下载：https://huggingface.co/Qwen/CodeQwen1.5-7B
AI快站模型免费加速下载：https://aifasthub.com/models/Qwen

模型概述

CodeQwen1.5是基于Qwen语言模型的进阶版本，拥有70亿参数，并使用GQA架构。模型在约3万亿token的代码相关数据上进行了预训练，这使得它在代码生成、长序列建模、代码修改和SQL编程等多个方面表现卓越。

编程语言支持

模型支持的92种编程语言覆盖了从Python、Java、C++到较少见的语言如Elixir和Go，使其成为多语言编程环境中的强大工具。这种广泛的语言支持对于开发多平台应用程序尤为重要，能够满足不同开发者的需求。

长序列建模能力

CodeQwen1.5的一个重要特点是其长序列建模能力，能处理高达64K的上下文输入。这对于理解大型代码库和执行复杂的代码重构任务至关重要。模型在处理长序列时展现了极低的困惑度，表明其对代码结构和语义的深入理解。

SQL编程专长

除了通用编程能力，CodeQwen1.5还展现了出色的SQL编程专长，能够通过自然语言查询实现复杂的数据库操作。这一功能特别适合非技术用户，帮助他们轻松地进行数据检索和管理。在两个流行的文本到SQL基准测试Spider和Bird上评估了CodeQwen1.5-Chat的性能。实验结果显示，CodeQwen1.5在接近GPT-4的位置排名第二（结果来自DIN-SQL，一种 SOTA 的提示方法）。

性能评测

在标准的编程能力评测如HumanEval和MBPP中，CodeQwen1.5的表现堪比顶级商业模型。例如，在HumanEval的0-shot测试中，CodeQwen1.5的得分高达51.8%，而在MBPP的3-shot测试中，得分达到61.8%。这些成绩显示了其在理解和执行复杂编程任务方面的能力。

CodeQwen1.5不仅在 Python 方面表现出色，还是一个多编程语言的编程模型。在 MultiPL-E 平台上，包括 Python、C++、Java、PHP、TypeScript、C#、Bash 和 JavaScript 在内的 8 种主流语言上进行了全面评估，这些结果证明了CodeQwen1.5强大的编程能力。

结论

CodeQwen1.5的发布不仅证明了阿里巴巴在开源社区中的影响力，也标志着开源编程模型在性能和通用性上达到了一个新的高度。它不仅为开发者社区提供了一个强大的工具，还为编程语言模型的未来发展设定了新的标准。随着更多的开源项目和开发者参与到CodeQwen1.5的持续改进中，我们可以期待这一模型在未来解决更多复杂的软件开发挑战。