程序员 AI 助手新竞品,蚂蚁集团宣布开源代码大模型 CodeFuse

人工智能 开源
蚂蚁集团首次开源了代码大模型 CodeFuse,加入这一市场竞争中。蚂蚁自研的代码生成专属大模型,可以根据开发者的输入提供智能建议和实时支持,帮助开发者自动生成代码、自动增加注释、自动生成测试用例、修复和优化代码等,以提升研发效率。

9 月 8 日消息,目前市面上已经有不少能够辅助写代码的 AI 产品了,在今日的外滩大会分论坛上,蚂蚁集团首次开源了代码大模型 CodeFuse,加入这一市场竞争中。

据介绍,这是蚂蚁自研的代码生成专属大模型,可以根据开发者的输入提供智能建议和实时支持,帮助开发者自动生成代码、自动增加注释、自动生成测试用例、修复和优化代码等,以提升研发效率。

蚂蚁集团表示:“无论用户是初学者还是有经验的开发者,CodeFuse 都能够极大地提高编程效率和准确性,让人人可编程、可创新成为现实。”

CodeFuse 基于蚂蚁基础大模型研发,在近期代码补全的 HumanEval 评测中,CodeFuse 得分 74.4%,超过 GPT-4(67%)的成绩,也超过了 WizardCoder-34B 73.2% 的得分。本次开源内容包括代码框架、模型等,现已上架相关平台,IT之家小伙伴可在 HuggingFace 下载模型

代码框架部分包括自研的多任务微调(Multi-task fine-tuning,缩写为 MFT)框架。MFT 支持代码生成、代码翻译、测试用例生成、bug 修复等数 10 个任务一起微调。MFT 微调框架支持蚂蚁自研模型,以及多个开源大模型的代码能力微调。同时,框架内含创新的微调数据打包技术,号称可提升微调速度约 8 倍;并使用多重部署优化技术,使推理加速约 2 倍。

模型部分包括 CodeFuse13B-4K、CodeFuse-CodeLlaMa34B-MFT 两个大模型。模型训练过程中,CodeFuse 使用了程序分析校验技术,对高质量代码数据进行筛选,并构建了代码领域专用字典,编码平均长度低 10%+。

蚂蚁集团透露,CodeFuse 早在今年 6 月就开始内测,用以真实开发环境,可以助力开发者低门槛编程,例如用自然语言编写 H5 小游戏、快速开发支付宝小程序等。基于 CodeFuse 的应用场景有开发助手、IDE 插件、数据分析器等,覆盖了目前研发工作的主要需求,在蚂蚁集团内部研发流程中陆续得到验证

责任编辑:庞桂玉 来源: IT之家
相关推荐

2023-11-01 19:03:56

云栖大会蚂蚁集团SOFAStack

2023-12-01 14:34:42

AnthropicAILLM

2024-04-11 10:02:54

蚂蚁集团CodeFuse

2023-04-21 10:14:22

开源AI

2023-11-03 07:46:54

CodeGeeX编程助手

2017-11-20 22:28:43

程序员源代码编程

2024-07-26 00:00:02

2015-03-13 09:45:27

2024-12-13 08:02:55

大模型GPT后端

2011-03-31 17:44:12

程序员新LOGO

2015-11-30 08:57:07

源代码阅读程序员

2018-05-29 22:38:49

AI程序员代码

2023-08-04 17:01:30

代码模型

2024-10-30 14:30:00

AI代码程序员

2015-11-30 11:01:07

程序员阅读源代码

2013-06-28 13:28:09

2017-10-29 22:36:41

程序员

2015-07-27 09:26:41

程序员

2019-01-07 09:31:37

程序员测试人员代码
点赞
收藏

51CTO技术栈公众号