Qwen团队推出了Qwen2.5-Coder系列,这是一组源自Qwen2.5架构的新型代码专用语言模型。该系列包含六个模型尺寸,参数量从0.5B到32B不等,并在超过5.5万亿个经过清理的源代码和合成数据令牌上进行训练。

  • 这些模型在代码生成、补全、推理和修复等10多个基准测试中取得了最先进的性能。
  • Qwen2.5-Coder-32B-Instruct在保持强大的通用和数学能力的同时,其编码能力与GPT-4o相当。
  • 该架构采用了特殊令牌来支持中间填充(FIM)操作和仓库级上下文管理。
  • 此次发布包含宽松的许可协议,以促进开发者的广泛采用。

作者旨在通过这些开源模型推动代码智能研究并支持实际应用。