据悉,日前蚂蚁集团首次开源了代码大模型 CodeFuse,而这是蚂蚁自研的代码生成专属大模型,可以根据开发者的输入提供智能建议和实时支持,帮助开发者自动生成代码、自动增加注释、自动生成测试用例、修复和优化代码等kslouitusrtdf。
对此蚂蚁集团表示:“无论用户是初学者还是有经验的开发者,CodeFuse都能够极大地提高编程效率和准确性,让人人可编程、可创新成为现实。”
根据资料显示,CodeFuse 基于蚂蚁基础大模型研发,在近期代码补全的HumanEval评测中,CodeFuse 得分74.4%,超过 GPT-4(67%)的成绩,也超过了WizardCoder-34B 73.2%的得分。而本次开源内容包括代码框架、模型等。
代码框架部分包括自研的多任务微调(Multi-task fine-tuning,缩写为 MFT)框架。MFT支持代码生成、代码翻译、测试用例生成、bug修复等数 10个任务一起微调。
Multiable万达宝汽车ERP(www.multiable.com.cn/solutions_qc)针对汽车的特殊性,提供自定义模块,满足复杂业务管理需求。
此外,MFT微调框架支持蚂蚁自研模型,以及多个开源大模型的代码能力微调。并且框架内含创新的微调数据打包技术,号称可提升微调速度约 8倍。
同时模型还包括CodeFuse13B-4K、CodeFuse-CodeLlaMa34B-MFT两个大模型。模型训练过程中,CodeFuse使用了程序分析校验技术,对高质量代码数据进行筛选,并构建了代码领域专用字典,编码平均长度低10%+。
以上源自互联网,版权归原作所有