新火种AI|实属罕见!四大AI顶流同台,有哪些关键信息值得关注?

人工智能顶会投稿指南:CCF-A类会议ACL、ICML、NeurIPS、ICLR的投稿周期与影响力解析 本文详细解析了CCF-A类会议ACL、ICML、NeurIPS、ICLR的投稿周期与影响力,涵盖各会议的投稿时间线、评审特点及录用率。ACL注重自然语言处理,ICML强调机器学习理论,NeurIPS覆盖神经信息处理,ICLR聚焦表征学习。文章还提供了实战投稿策略,帮助研究者提升投稿成功率。 阅读详情

作者:小岩

编辑:彩云

在有着“AI春晚”之称的2024年智源大会上,非常难得的一幕出现了:当下国内的四大AI顶流公司——月之暗面,百川智能,智谱AI,面壁智能齐聚一堂,十分罕见的同台了。

从体量上来说,四家大模型公司都称得上是独角兽级别,它们的创始人聚在一起,分享各自对大模型未来的观点和看法,这对于整个行业来说,无疑是值得标记的一笔。

有意思的是,这四家大模型独角兽掌舵人——百川智能的CEO王小川,智谱AI CEO张鹏,月之暗面CEO杨植麟以及面壁智能联合创始人,CEO李大海都出身于清华,是名副其实的师出同门。

关于价格,安全等话题:四家独角兽给出的答案各有侧重。

在智源大会上,四位出身于清华的大模型独角兽掌舵人一同出席了《尖峰对话:通往AGI之路》环节。

在对话中,大家对于大模型的价格战问题表达了自己的看法。王小川就公开表示,价格战对于中国发展大模型是特别好的事,自己也是积极看待的。目前打响的大模型价格战,主要是云厂商之间的竞争。包括火山引擎,阿里云,腾讯云,百度云等。

可在此之前,王小川是旗帜鲜明的反对价格战的,表示这是巨头间的游戏,百川智能不愿意掺和进去。

其实王小川先前的想法并非个例。零一万物创始人李开复也在大会别的环节上表示,当下AI市场存在一个比较严重的问题,就是很多大公司没有认识到软件的价值,不愿意为软件付费。结果很多大模型公司来竞标,结果却是越竞越低,做到最后做一单赔一单,没有利润。也正因此,他认为,零一万物坚决做to C,不做“赔钱的to B”。而智源研究院的院长王仲远也认为,当下选择大模型优先考虑的肯定不是性价比,而是能否真正为自己的产品赋能。在此基础之上,大模型的价格终归会达到一个合理的水平。

大模型是否是通往AGI的基石:大家所存在的共识与非共识。

除了对于降价潮这样的“周边问题”表达看法,对于“大模型是否是通往AGI之路的基石”这一热点话题,四位掌舵人也给出了自己的看法和观点。

月之暗面的杨植麟认为,大模型的第一性原理,就是要不断提升模型的规模。这件事从本质上来说,是在做压缩,压缩就会产生智能。当然,这个过程会面临很多的挑战,诸如数据流失,某些领域的数据资料较为稀缺等。由此可见,数据是当前存在的最大的问题和变量,而规模定律或大模型本身并没有什么问题。

杨植麟还表示,“如何定义AGI”这件事至关重要,但不必急于现在就给出一个精确量化的定义。AGI可能更多地是一种定性的概念,一种感觉上的共识。其核心作用在于,能够使社会和个人对未来可能发生的变化有所准备。毕竟,这项技术的发展速度可能异常迅猛。

百川智能的王小川则认为,“基石”这个词是没有问题的,但它只是在逼近AGI。从根本上说,这需要一个范式的转变,而今天大家看到的规模定律的成效只是迈出的第一步。王小川认为,从某种程度上说,我们目前已经进入了AGI的时代,这个时代有能力吸引更多的科学家和资源,共同迈向AGI。但仅凭目前公开的规模定律无法完全实现AGI, 光靠Scaling Law,也是做不到AGI的。

智谱AI的张鹏则肯定大模型是基石之一。他认为,当下人工智能的从业者很“实用主义”,大家都十分关心到底能不能真正的解决问题,到底能不能真的向每个人心中定义的AGI路径上进行推动。目前来说,Scaling Law还在生效,还在往前前进,大模型也依然在很有效地推进。但说到未来能否真的帮助人们到达顶峰,尚未可知。

或许是因为面壁智能的李大海出自数学专业,他的表达较为严谨。他表示,大模型一定是当前所有技术里,可以在通往AGI这个方向上走得最远的,但它能否直达,现在来看还有很多未知因素。李大海表示,“联想到《思考:快与慢》的观点,人脑有两个系统:快速直观的感性思考与慢速细致的理性思考。现在的云端大模型主要是在处理人的大脑系统,一是“快思考”的工作;二是“慢思考”的系统,即要做各种各样推理,搜索空间去做搜索,组合,从而来完成一个任务”。

想要实现“慢思考”的能力,需要大模型通过Agent技术外部化或者把它内化为自己的能力,抑或通过端侧大模型的部署来实现。未来的大模型是否有这样的能力?这需要大家去进行进一步的探索。

由此可见,在短期内对对AGI的进展进行评估,会是一个极具挑战性的问题。

大模型是否应该开源?大家普遍共识:开源并不会削弱竞争力。

近期斯坦福的三位学生抄袭面壁智能MiniCPM大模型的事件正闹的沸沸扬扬,而面壁智能的李大海也在会上首次公开做出了回应。他表示,“我们完全没有想到我们的工作会以这种方式出圈,挺惶恐的”。

这个具体事件要追溯到5月20日,面壁智能开源了MiniCPM大模型之后。5月29日,三位斯坦福的本科生在该模型基础上做了非常简单的高斯叠加,就号称是自己的模型。这个模型一下子变得很受欢迎,因为该团队宣称这个模型的多模态能力跟GPT4-V完全对标,但是参数只有后者的1%,并且只需要500美金就能够训练出来。

事件发生仅仅过了一天,开元社区的热心参与者便发现了事情的真相,并将此曝光。

在大会上,李大海对于这一事件进行了表态。他表示,3位本科生所提到的“模型的多模态能力跟GPT4-V完全对标,但是参数只有后者的1%”是真实的,面壁智能确实具备这样的实力,但其耗费的成本远远不止500美金,其实是需要花很多钱的。李大海认为,这件事让面壁智能更加坚定了开源的力量。开源力量很强大,不光有做原创工作的人,还有很参与者贡献需求,贡献反馈,这也是开源生态重要组成部分。持续做开源贡献,势必能够给公司带来正向收益。

百川智能同样是开源的参与者,王小川解释了开源的动机:“第一,开源在市场上有这个需求,2023年6月开源了第一版,9月份开源了第二版。去年,中国对大模型充满热情与紧迫感,开源策略在市场上产生了积极影响。作为认真开源的商业化厂商,百川获得了市场的认可,这对我们来说是一个巨大的鼓舞,无论是在人才储备还是资本关注方面,都为行业树立了标杆。第二,开源也体现了一种心态。我们认识到模型的快速迭代,今天的领先并不意味着明天的竞争力。因此,开源并没有削弱我们的商业竞争力”。更重要的是,众多公司参与开源,共同推动中国生态追赶美国,保护知识产权,这会使整个生态持续繁荣的发展。

四家独角兽大模型公司的同台是具有极其重要的意义的,这不仅体现了行业内的合作精神和开放交流的态度,也会推动整个行业的发展和创新。

人工智能迷惑行为 在这个充满数字化自动化的时代,人工智能AI)已成我们生活中无处不在的影子。然而,尽管技术日月异,AI在某些场合下表现得却让人哭笑不得。是不是感觉AI时不时也玩起了幽默?今天,就让我们一起来探讨那些人工智能的“幽默”瞬间,以及它们背后的技术原理可能的社会影响。 阅读详情

相关推荐

全球第一开源云ERP Odoo操作手册 模块安装界面汉化指南

Odoo 的功能包含在不同的模块中, 刚创建的数据库除 Odoo 的核心模块外, 其它模块并没有被安装到系统中,你可以根据需要安装它们。本节将介绍安装模块界面汉化的相关知识。

weixin_44793763的博客 2037

盘点一下,人工智能顶刊顶会有哪些?

人工智能过去十年发展快速,也逐步从学术研究走向商业化。但是该领域的主要成果产出依然会发表在国际顶级期刊会议(即,顶刊顶会)上。 AI领域高水平论文发表量整体上呈现稳步增长态势 顶会顶刊,通常是指《CCF 推荐国际学术期刊会议目录》 ACM 计算机学分类系统相关子领域的 A 类期刊会议,此外也有相关专家团体的推荐。 在人工智能领域,除了家最为熟知的最核心的顶会AAAI、IJCAI、ICMLNeurIPS,以及作为计算机视觉自然语言为代表的CVPRACL这两学术会议,也涌现了许多“后起之

sh_0001的博客 3万+

JavaScript教程-字符集,Unicode转义序列,标识符,数据类型,数字,未定义值,浮点数,字符串,引用数据类型,类型检测,类型转换,运算符,关系运算符,

前端学习

VAN 188

人工智能AI)领域各方向顶会顶刊

人工智能AI)这个快速发展的领域,研究人员从业者需要紧跟最的研究动态技术进展。顶级的会议期刊是获取最科研成果交流思想的重要平台。以下是人工智能领域内不同方向的顶级会议期刊概览。

I‘m Frank Lee 5922

2023 年值得关注的 7 人工智能 (AI) 技术趋势

人工智能 (AI) 技术几乎在每个领域都取得了长足进步,从金融、汽车、游戏到医疗保健。从个人访问电子商务商店购买他们最喜欢的服装或购买杂货而不离开他们的舒适区的那一刻起,它的应用几乎在每个可能的领域都在增长。因此,人工智能技术的遗产在 2022 年接近 3874.5 亿美元,预计到2029 年将超过 13943 亿美元。 今天,世界正在经历一波人工智能驱动的全球经济转型浪潮。餐厅可以根据顾客的喜好策划菜单,而聊天机器人都可以在不涉及人工翻译的情况下为用户提供虚拟帮助。人工智能技术将继续存在,树立的里程

努力是为了站在万人之中,成为别人的光 1万+

2025年值得关注的8人工智能趋势

可以说,人工智能的快速发展让我们处于一个变革时代的边缘。无论你是悲观主义者还是乐观主义者,了解并掌握关于这项技术的信息都至关重要。只有接受人工智能带来的各种可能性,并以负责任的态度利用其力量,我们才能推动创、提高效率,并提升人类的体验。本文转载自 雪兽软件更多精彩推荐请访问 雪兽软件官网。

雪兽软件 792

2024 年值得关注的十人工智能 (AI) 趋势

深度造假、复杂的人工智能生成内容增强的网络钓鱼攻击的激增凸显了人工智能的双重用途性质,它能够带来巨的好处,但也带来错误信息、操纵、身份盗窃欺诈等风险。欧盟的人工智能法案可能是世界上第一部全面的人工智能法,它可能会禁止某些人工智能的使用,强制执行高风险人工智能系统开发商的义务,并要求人工智能使用公司保持透明度。从超越传统单模式数据处理、涵盖文本、图像声音等多种输入类型的多模态人工智能的变革潜力,到量子人工智能的出现,塑造人工智能未来的趋势既令人兴奋又令人畏惧。

lythinking的博客 1361

(论文速读)EDiT:用线性压缩注意力加速扩散 Transformer

本文提出了一种高效扩散Transformer架构EDiT,通过创的线性压缩注意力机制解决传统DiT在生成高分辨率图像时的计算瓶颈。EDiT采用卷积增强的线性注意力(ConvFusion+SpatialCompressor)处理图像自注意力,同时为多模态场景设计混合注意力方案,仅对图像-图像交互进行线性化处理,保留文本相关交互的标准注意力。实验表明,EDiT在PixArt-ΣStable Diffusion3.5-Medium上实现高达2.2倍的加速,同时保持接近原始模型的生成质量。该方法的核心创在于针

LJ1147517021的博客 269

如何借助 AI 实现自动化测试:让 Agent 帮你写测试、跑测试、修测试

上下文工程优先:维护(页面结构、账号、业务规则),AI 输出质量立竿见影;AI 生成 + 人审 + 入库:测试代码是资产,必须 code review,禁止「AI 跑完就当真」;定位器纪律:全程getByRolegetByLabel,从源头减少失效;分层使用:单元/接口测试用传统框架,UI 探索性测试用 Agent,回归用固化脚本;成本控制:批量生成用便宜模型(DeepSeek / 本地 Ollama),关键修复用强模型;安全红线:测试 Agent 只能连测试环境;

篮球界最会写bug的人;程序猿中打球最菜的人。 700

83.85% vs 17.91%:FormStruct-Bench 揭开表单解析的错觉

文章摘要 FormStruct-Bench论文提出了一个针对表单类文档结构识别的型分层评测基准,解决了传统方法在结构化评估上的不足。研究团队通过"导演-美术-质检"的合成流程构建了7,000个带精确标注的表单实例,并设计了分层评估指标,包括内容读取(Value-nED)、结构重建(Schema-nED)路径正确率(TSR-path)等。实验结果显示,当前最佳系统在内容读取上达到83.85%,但结构路径正确率仅17.91%,区域检测关系识别指标更低。研究表明,视觉退化主要影响结构绑定而非内容识别,且合成

liferecords的博客 689

WAIC论坛现场|网易智企分享企业AI“上岗之路“

在世界人工智能会(WAIC)2026上,网易智企举办了"用可信AI构建企业智生产力"专题论坛。会上,网易智企副总经理段毓铮带来了题为《从能聊、到能干、到越干越好:企业AI的上岗之路》的演讲,抛出了一个核心观点:不把AI当工具,而是当作"AI员工"来看待。

weixin_43099039的博客 207

8.4 处理智能体的工具调用与输出解析《LangGraph开发AI Agent实践》

规范遵循:工具需遵循LangChain的BaseTool接口,定义清晰的name、description以及args_schema(通常为Pydantic模型)。注册方式:将工具实例传入LLM的tools参数(如OpenAI的function_calling)或通过LangGraph的状态节点显式绑定。目的:确保LLM能理解工具的功能、输入格式及使用场景。

夏天又到了的专栏 503

AI 配音软件哪个最好用?配音工具实测推荐

批量长脚本、矩阵推文解说,追求稳定省事,优先叮叮配音;做探店带货、本地生活短视频,看重口语自然度,优先布丁配音;剪辑短剧、漫剧,需要多角色剧本、声音克隆打造 IP,优先媒小三配音。AI 配音只是内容制作辅助工具,不要盲目追求花哨功能。结合自己的视频类型、脚本长短、是否商用去选择,稳定好用、少套路,才是挑选配音软件的核心。

2601_95566246的博客 241

AI网关API网关区别在哪?MAI Gateway统一治理方案深度解析

API网关转发请求,不关心内容。AI网关处理消费,不只转发。这是两类网关的根本区别。调用方不需要知道服务在哪,网关负责路由。请求体内容在网关层透传,网关不碰。企业要知道AI调用的内容安不安全、花了多少钱、归谁的部门、模型说了什么。请求体内容在网关层被检查、脱敏、计费、记录。差异的根源在于:模型调用是按次消费,每次调用花钱;传统API调用是基础设施服务,部署了就能用。

youdiyunan的博客 308

企业级AI Agent规模化落地的技术挑战:从62%试点到23%规模化的差距在哪?

数据显示,62%的企业已完成AI Agent试点,但成功实现规模化部署的比例仅为23%。从“Demo跑通”到“生产级落地”之间,隔着一系列工程化难题:任务执行可靠性、遗留系统兼容、数据安全合规、状态管理与断点恢复、多租户隔离。本文从技术架构角度逐一拆解这些挑战,并给出可落地的解决方案。

2501_93684580的博客 176

织信开发日志 17:织信 Skill 的目的,是把平台能力交给 AI Agent

织信 Skill 的核心价值,不是让 AI 说得更像产品经理,也不是让 AI 写出更漂亮的需求文档。 它的价值是把织信的平台能力变成 AI Agent 可调用的工具集。

iori97king的专栏 651

AI Agent 技术架构深度解析与选型指南

AI Agent代表了企业AI应用从"问答"到"任务执行"的关键跃迁,也为管理软件行业带来了的产品可能性。用友YonClaw、金蝶灵基等企业级AI Agent产品的推出,标志着国产管理软件在AI Agent方向的正式布局。对于企业而言,理解AI Agent的技术架构与能力边界,是做出正确选型决策的基础。本文面向技术架构人员与IT管理者,供技术评估参考。

likeylau的博客 338

STEPONMOON的人工智能之旅(一)

AI入门第一课:破除三误解》 本文从日常生活切入,指出AI已渗透输入法、推荐系统等场景,既非神秘黑箱,也非科幻机器人。针对众对AI的两种极端认知——"万能神"或"铁疙瘩",作者提出核心观点:AI本质是"从数据中找规律的程序"。全文通过部分展开:首先建立学习动机,随后逐一拆解"AI=机器人""AI有自我意识""AI超越人类"三常见误解,最后引导读者建立理性认知框架。文中配有场景插图

qq_36115196的博客 176

BERT预训练原理详解:MLM掩码预测 + NSP句子预测

介绍 BERT 预训练的 MLM 掩码语言模型、NSP 下一句预测两项自监督任务,分析任务实现细节与存在问题,梳理 BERT 预训练流程、下游微调方法以及 RoBERTa、ALBERT 等变体模型的核心改进

weixin_44021329的博客 440

2026-08-19 GitHub 热点项目精选

* 全局样式 */padding: 0;body {/* 标题样式 *//* 链接样式 *//* 引用样式 *//* 表格样式 */table {th, td {th {/* 代码块样式(pygments 高亮) */pre {/* 列表样式 *//* 图片样式 */

m0_65659549的博客 263

基于QT的超声波追溯系统源码.rar

基于QT的超声波追溯系统源码,基于QT的超声波上位机源码,注释齐全,可供学习参考使用

上一篇: 新火种AI|Sora发布半年之后,AI视频生成领域风云再起
下一篇: 新火种AI|英伟达市值超越微软!AI技术如何重塑科技股价值?
新火种
博客等级 码龄3年 901粉丝 129原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值