蚂蚁开源代码大模型CodeFuse,面向开发者提升编程效率

云网络8个月前 (09-09)建站教程67

2023090820432621980.jpg


                         图片说明:支付宝小程序云技术负责人李铮宣布CodeFuse正式开源。

这是蚂蚁自研的代码生成专属大模型,根据开发者的输入提供智能建议和实时支持,帮助开发者自动生成代码、自动增加注释,自动生成测试用例,修复和优化代码等,以提升研发效率。无论用户是初学者还是有经验的开发者,CodeFuse都能够极大地提高编程效率和准确性,让人人可编程、可创新成为现实。

CodeFuse基于蚂蚁基础大模型研发,在近期代码补全的HumanEval评测中,CodeFuse得分74.4%,超过GPT-4(67%)的成绩,也超过了WizardCoder-34B73.2%的得分,在开源模型中位于国际前列。本次开源内容包括代码框架、模型等,现已上架相关平台,模型可在HuggingFace下载。

代码框架部分包括自研的多任务微调(Multi-taskfine-tuning,缩写为MFT)框架。MFT支持代码生成、代码翻译、测试用例生成、bug修复等数10个任务一起微调,它充分利用多任务之间的信息互补,通过创新的loss设计处理不同任务之间收敛难易不均衡的难题,最终取得比单任务微调SFT更好的效果。MFT微调框架支持蚂蚁自研模型,以及多个开源大模型的代码能力微调。同时,框架内含创新的微调数据打包技术,提升微调速度约8倍;并使用多重部署优化技术,使推理加速约2倍。

模型部分包括CodeFuse13B-4K、CodeFuse-CodeLlaMa34B-MFT两个大模型。模型训练过程中,CodeFuse使用了程序分析校验技术,对高质量代码数据进行筛选,并构建了代码领域专用字典,编码平均长度低10%+。

早在2022年1月,蚂蚁集团内部成立了代码智能生成专项,随着公司整体战略的推进,在统一软硬件基础设施支持下,从零到一训练了多个代码大模型,最终基于13B版本,打造了CodeFuse,并在今年6月开始内测,用以真实开发环境,可以助力开发者低门槛编程,例如用自然语言编写H5小游戏、快速开发支付宝小程序等。

基于CodeFuse的应用场景有开发助手、IDE插件、数据分析器等,覆盖了目前研发工作的主要需求,在蚂蚁集团内部研发流程中陆续得到验证。

CodeFuse的目的是重新定义下一代AI研发,提供全生命周期AI辅助工具。蚂蚁集团期望通过开源CodeFuse,和社区一起推进软件工程领域的范式跃迁,重塑软件研发的各个领域,加速各行各业的数字化进程。

据了解,外滩大会上蚂蚁集团还发布了工业级金融大模型,两大应用产品将在完成相关备案工作后上线,包括面向消费者的应用产品—智能金融助理“支小宝2.0”,以及面向金融行业专家的智能业务助手“支小助1.0”,展示了蚂蚁在大模型领域从技术到行业应用的全面布局和进展。


相关文章

Java中static和volatile关键字的区别

区别有:1. 作用范围不同;2. 变量类型不同;3. 内存模型不同;4. 线程安全不同;5. 性能不同。作用不同指的是,static关键字用于声明类级别的变量或方法,所有类的实例共享同一个static...

警惕!车站附近有人半价卖iPhone手机 到手结果是机模

但你以为能占到便宜时,就离受骗不远了。近日,西藏拉萨就抓获一名利用iPhone手机模型冒充真手机实施诈骗的犯罪嫌疑人。8月29日,有男子路过城关区北郊客运站附近时,该骗子突然走近搭讪道:要不要苹果手机...

心系天下!三星W24发布:高端陶瓷工艺 15999元

快科技9月15日消息,今日,三星心系天下”系列W24正式发布,售价15999元(16GB 1TB)。自2008年12月起,三星与中国电信展开合作,推出旗下心系天下”W699手机,真正意义上的万元超高端...

马斯克称将用X数据训练AI 仅限公开内容

马斯克称将用X数据训练AI 仅限公开内容

9月4日 消息:马斯克旗下的社交平台X(前身为推特)最近更新了隐私条款,明确表示X可能会使用收集到的信息和公开信息来训练其AI模型。这个更新引发了一些关于隐私和数据使用的担忧。然而,马斯克本人也承认,...

什么是数据可视化

相信现在有很多公司都在使用的一个理念就是数据可视化,通过更高级的技术将数据进行图像处理,甚至是进行建模处理,或者将这些数据加以动画显示,让我们在观看这些数据的时候,更直接的了解到,数据发生了变化以及数...

网站出现Service Unavailable提示怎么办?

问:为什么我的网站有时会出现“Service Unavailable”的提示,有时候刷新几下又可以访问。答: 出现这种情况是由于您的网站超过了系统资源限制造成的,主要是流量太大或者程序占用资源太多。1...