蚂蚁开源代码大模型CodeFuse,面向开发者提升编程效率
图片说明:支付宝小程序云技术负责人李铮宣布CodeFuse正式开源。
(相关资料图)
这是蚂蚁自研的代码生成专属大模型,根据开发者的输入提供智能建议和实时支持,帮助开发者自动生成代码、自动增加注释,自动生成测试用例,修复和优化代码等,以提升研发效率。无论用户是初学者还是有经验的开发者,CodeFuse都能够极大地提高编程效率和准确性,让人人可编程、可创新成为现实。
CodeFuse基于蚂蚁基础大模型研发,在近期代码补全的HumanEval评测中,CodeFuse得分74.4%,超过GPT-4(67%)的成绩,也超过了WizardCoder-34B73.2%的得分,在开源模型中位于国际前列。本次开源内容包括代码框架、模型等,现已上架相关平台,模型可在HuggingFace下载。
代码框架部分包括自研的多任务微调(Multi-taskfine-tuning,缩写为MFT)框架。MFT支持代码生成、代码翻译、测试用例生成、bug修复等数10个任务一起微调,它充分利用多任务之间的信息互补,通过创新的loss设计处理不同任务之间收敛难易不均衡的难题,最终取得比单任务微调SFT更好的效果。MFT微调框架支持蚂蚁自研模型,以及多个开源大模型的代码能力微调。同时,框架内含创新的微调数据打包技术,提升微调速度约8倍;并使用多重部署优化技术,使推理加速约2倍。
模型部分包括CodeFuse13B-4K、CodeFuse-CodeLlaMa34B-MFT两个大模型。模型训练过程中,CodeFuse使用了程序分析校验技术,对高质量代码数据进行筛选,并构建了代码领域专用字典,编码平均长度低10%+。
早在2022年1月,蚂蚁集团内部成立了代码智能生成专项,随着公司整体战略的推进,在统一软硬件基础设施支持下,从零到一训练了多个代码大模型,最终基于13B版本,打造了CodeFuse,并在今年6月开始内测,用以真实开发环境,可以助力开发者低门槛编程,例如用自然语言编写H5小游戏、快速开发支付宝小程序等。
基于CodeFuse的应用场景有开发助手、IDE插件、数据分析器等,覆盖了目前研发工作的主要需求,在蚂蚁集团内部研发流程中陆续得到验证。
CodeFuse的目的是重新定义下一代AI研发,提供全生命周期AI辅助工具。蚂蚁集团期望通过开源CodeFuse,和社区一起推进软件工程领域的范式跃迁,重塑软件研发的各个领域,加速各行各业的数字化进程。
据了解,外滩大会上蚂蚁集团还发布了工业级金融大模型,两大应用产品将在完成相关备案工作后上线,包括面向消费者的应用产品—智能金融助理“支小宝2.0”,以及面向金融行业专家的智能业务助手“支小助1.0”,展示了蚂蚁在大模型领域从技术到行业应用的全面布局和进展。
(举报)
- 蚂蚁开源代码大模型CodeFuse,面向开发者提升编程效率
- 赚钱卖车,不寒碜?网传一汽员工5折买奥迪e-tron,被证确有此事
- 博格丹世界杯11次单场20+分创神迹:比肩诺天王 成历史第三人
- 英国第二大城市破产,苏纳克拒绝救援,意味着什么?
- 外交部:如何解决台湾问题是中国人自己的事
- 仙桃最新表彰!有你的老师吗
- 杭州亚运会火炬传递活动开启,第一棒火炬手是她
- 强邦新材:收入占比持续增长的境外第一大客户,销售核查如何操作
- 上海养老金重算补发计发基数是什么 2023年9月起上海将迎来养老金重算补发
- 美国向乌提供贫铀武器遭多方反对:“犯罪行径”!丨世界观
- 潼关县多措并举推进大气污染治理
- 深圳水库水位超汛限水位 排洪调整为120立方米/秒
- 人身意外险的赔付范围有哪些?最高能赔付多少钱?
- 华纬科技:不同产品的产能利用率和毛利率存在差异主要体现在弹簧与稳定杆之间
- 市人大常委会党组第十四次会议暨第九次主任会议召开
- 《骄阳伴我》今晚央视黄金档播出,8位实力派联手助阵,要爆了
- 三星s5368怎么重置(三星s5368)
- 《无主之地:潘多拉魔盒典藏版》公布 60美元买6个游戏
- 【高手持仓】8月31日多空持仓数据
- 被不点名批评,司机集体维权,“垄断”货拉拉正竭泽而渔?
- 重磅!确定了!惠州官宣:9月1日起“认房不认贷”
- 美国再次向台湾地区供武!外交部回应
- 四甲基丙二胺商品报价动态(2023-08-31)
- 离开工厂的中年人,都去了哪里?
- 美尔雅(600107)2023年中报简析:净利润减176.74%,债务压力大
- 九三学社三明市委举办“三明九三讲坛”第4期活动
- 那一刻 这两年丨美军仓皇撤离阿富汗两周年 遗留创伤难以抚平
- 华北东北受灾地区生产生活秩序加快恢复
- 关爱不能“一屏蔽之”!多些陪伴,引导孩子放下手机
- 越有本事越没有脾气的三大星座