CodeFuse 基于蚂蚁基础大模型研发

工具软件3年前 (2023)发布 AI观察员

451 0 0

CodeFuse 基于蚂蚁基础大模型研发，在近期代码补全的 HumanEval 评测中，CodeFuse 得分 74.4%，超过 GPT-4（67%）的成绩，也超过了 WizardCoder-34B 73.2% 的得分。本次开源内容包括代码框架、模型等，现已上架相关平台，可在 HuggingFace 下载模型。

代码框架部分包括自研的多任务微调（Multi-task fine-tuning，缩写为 MFT）框架。MFT 支持代码生成、代码翻译、测试用例生成、bug 修复等数 10 个任务一起微调。MFT 微调框架支持蚂蚁自研模型，以及多个开源大模型的代码能力微调。同时，框架内含创新的微调数据打包技术，号称可提升微调速度约 8 倍；并使用多重部署优化技术，使推理加速约 2 倍。

模型部分包括 CodeFuse13B-4K、CodeFuse-CodeLlaMa34B-MFT 两个大模型。模型训练过程中，CodeFuse 使用了程序分析校验技术，对高质量代码数据进行筛选，并构建了代码领域专用字典，编码平均长度低 10%+。

CodeFuse 早在今年 6 月就开始内测，用以真实开发环境，可以助力开发者低门槛编程，例如用自然语言编写 H5 小游戏、快速开发支付宝小程序等。基于 CodeFuse 的应用场景有开发助手、IDE 插件、数据分析器等，覆盖了目前研发工作的主要需求，在蚂蚁集团内部研发流程中陆续得到验证。