阿里云Qwen2.5震撼发布!72B模型击败LIama3 405B,轻松胜过GPT-4o-mini

图片

 9 月 19 日的云栖大会上,

CTO 周靖人宣布:

通义千问发布 Qwen2.5!

昨日凌晨,阿里巴巴官宣了史上最大规模的开源发布,推出了基础模型Qwen2.5、专用于编码Qwen2.5-Coder和数学Qwen2.5-Math。这三大类模型一共有10多个版本,包括0.5B、1.5B、3B、7B、14B、32B和72B,适用于个人、企业及移动端、PC等不同人群不同业务场景的模型。

图片

1:百宝箱:Qwen2.5

图片

这次,Qwen2.5 系列是一个超级 AI 模型「百宝箱」,涵盖了多个尺寸的大语言模型、多模态模型、数学模型和代码模型。每个尺寸都有基础版本、指令跟随版本和量化版本,总计上架了 100 多个模型,刷新了业界纪录。

图片

Qwen2.5系列支持中文、英文、法文、西班牙文、葡萄牙文、德文、意大利文、俄文、日文等超过29种主流语言。

所有 Qwen2.5 系列模型都在 18 万亿(18T)tokens 的数据上进行了预训练。相比 Qwen2,整体性能提升了 18% 以上,拥有更多的知识、更强的编程和数学能力。

图片

2:Qwen2.5系列性能测试

图片

本次阿里开源的最大版本指令微调模型Qwen2.5-72B在MMLU-Pro。

虽然Qwen2.5只有720亿参数,但在多个基准测试中击败了Meta拥有4050亿参数的最新开源Llama-3.1指令微调模型;全面超过了Mistral最新开源的Large-V2指令微调模型,成为目前最强大参数的开源模型之一。即便是没有进行指令微调的基础模型,其性能同样超过Llama-3-405B。

图片

阿里开放API的旗舰模型Qwen-Plus,其性能可以媲美闭源模型GPT4-o 和Claude-3.5-Sonnet。

指令微调模型的性能则超过了谷歌的Gemma2-27B、微软的Phi-3.5-MoE-Instruct,与闭源模型GPT-4o mini相比,只有三项测试略低其他基准测试全部超过。

图片

其中,Qwen2.5-Math-72B的整体性能超越了Qwen2-Math-72B指令微调和著名闭源模型GPT4-o。

图片

3:Qwen-Max 全方位升级

图片

现在,通义官网和通义 APP 的后台模型都已切换为 Qwen-Max,继续为所有用户免费服务。你还可以通过阿里云百炼平台调用 Qwen-Max 的 API,亲自体验它的强大实力。

图片

相比上一代模型,它在训练中使用了更多的训练数据、更大的模型规模,并进行了更深入的人类对齐,最终实现了智能水平的飞跃。在十多个权威基准测试中,Qwen-Max 的表现已经接近 GPT-4o,尤其是在数学能力和代码能力上,甚至超越了 GPT-4o!要知道,数学和代码所代表的推理能力可是大模型智能的核心体现。

图片

通义千问凭借不断迭代的技术和丰富的应用场景,迅速崛起为开发者的热门选择,尤其是在中文社区中引发了广泛关注。这次发布,模型不仅展现出更强大的代码、数学和语言处理能力,还拥有领先的多模态处理和视觉智能,使其成为当前 AI 技术领域的佼佼者。

内容概要:本文介绍了 Trae Builder 模式,这是一种基于自然语言处理和智能代码生成技术的创新开发模式,旨在简化应用程序的开发过程。开发者只需用自然语言描述需求,Trae Builder 即可自动生成代码框架。文章详细描述了如何使用 Trae Builder 创建一个 To-Do List 应用,涵盖环境准备、项目结构生成、核心功能实现(如任务添加、删除、标记完成和查看任务列表)、本地存储、界面样式优化、功能测试及性能优化等内容。通过 Trae Builder,开发效率显著提升,非专业开发者也能轻松参与应用开发。最后,文章探讨了 Trae 技术的发展趋势及其对编程行业的影响。适合人群:具备一定编程基础的研发人员,尤其是希望提高开发效率、简化项目搭建过程的开发者,以及有兴趣尝试自然语言编程的非专业技术人员。使用场景及目标:①快速搭建项目框架,减少手动编写代码的工作量;②通过自然语言描述需求,自动生成代码,降低开发门槛;③优化项目结构和功能,提高开发效率;④进行功能测试和性能优化,确保应用的质量和稳定性。其他说明:Trae Builder 模式不仅提高了开发效率,还降低了编程门槛,让更多人能够参与到应用开发中。未来,Trae 技术有望支持更多编程语言和框架,进一步提升自然语言处理的准确性,并与其他先进技术融合,推动编程行业的变革和发展。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值