(本文借助 AI 大模型及工具辅助整理)
一句话总结:英伟达 60 亿美元"租下"Poolside 训练体系亲自下场做开源模型、OpenAI 自研推理芯片 Jalapeño 首测压过 GB300,推理 ASIC 化与"许可式并购"两条主线同时改写 AI 竞争格局;xAI、DeepSeek、阿里千问同日亮出新品,模型价格与能力的天平继续向开源倾斜。
🌊 AI 动态与趋势
今天的行业信息可以浓缩为三个关键词:钱、芯片、开源。资本层面,英伟达用 60 亿美元许可费 + 10 亿美元入股(投前估值 120 亿)+ 109 名工程师岗位的方式"租借"了 Poolside 的 Model Factory 训练体系,这是继 Groq(200 亿)、Enfabrica(9 亿)之后第三次使用这种绕开反垄断并购审查的"许可式收购"。芯片巨头正从"卖铲人"亲自下场做模型,目标直指 DeepSeek、Kimi K3 等中国开源模型,同时也与最大客户 OpenAI、Anthropic 形成竞争张力。同期 Hugging Face 传出约 130 亿美元出售报价、Stability AI 再获 7600 万美元融资,AI 一级市场的整合明显加速。
芯片层面,推理 ASIC 化趋势进一步坐实。OpenAI 与博通合作的自研推理芯片 Jalapeño 首次公开基准数据:单位功耗吞吐与响应延迟优于英伟达 GB300,功耗约 700W,计划今年晚些时候支撑自家模型推理。这与 DeepSeek 视觉模型"1 分钱处理 9 张图"、GPT-5.6 Sol API 降价 20% 互为表里——推理成本曲线正以季度为单位下探,算力军备竞赛进入"每 token 成本"决胜阶段。
模型与产品层面,中国开源模型正在系统性地进入全球 AI 供应链:法律 AI 独角兽 Harvey 发布基于月之暗面 Kimi K3 的自有模型 Tenet;阿里千问预告今晚 23:00 开源基于 Qwen4 架构的 Qwen3.8-Flash-Next;汤森路透以 Qwen 为底座自研 Thomson-1 替代 Claude。与此同时,xAI 发布 Grok 4.6 追平 GPT-5.6 Sol Max,Agent 产品也从"聊天"走向"自主操作":ChatGPT Work 可自主登录网站办事、Claude Tag 的 Slack agent 能主动插话、Perplexity 推出全本地运行的 Portable Computer。
📰 AI 今日看点
今天的看点集中在"算力格局重构"与"开源模式反攻"两条主线:英伟达 60 亿美元拿下 Poolside 训练技术并带走 109 名工程师,亲自下场打造对标 DeepSeek 的开源模型,与最大客户正面竞争;OpenAI 自研推理芯片 Jalapeño 首测即压过 GB300,推理成本战进入新阶段。另一边,xAI 发布 Grok 4.6 追平 GPT-5.6 Sol Max、DeepSeek 视觉模型以 1 分钱 9 图的成本上线、阿里千问预告今晚开源 Qwen3.8-Flash-Next,模型价格与能力的天平继续向开源倾斜。此外,Anthropic IPO 招股书将"AI 抵制浪潮"列为风险因素,为行业的疯狂扩张写下了一个值得玩味的注脚。
🔥 AI 大事件
-
英伟达 60 亿美元"租借" Poolside 训练体系,豪赌开源模型:英伟达以 60 亿美元获得 Poolside 的 Model Factory 训练系统非独占许可,另投 10 亿美元(投前估值 120 亿),并向 109 名核心工程师发出聘书——他们将被编入 Nemotron 开源模型团队,目标对标 DeepSeek、Kimi K3。这是英伟达继 Groq(200 亿)、Enfabrica(9 亿)后第三次使用"许可+挖人+入股"三件套,绕开并购审查。来源:The Next Web
-
OpenAI 自研推理芯片 Jalapeño 首测超越英伟达 GB300:OpenAI 硬件副总裁 Richard Ho 公布与博通历时 16 个月联合开发的定制 ASIC 推理芯片基准:单位功耗 AI 吞吐与响应延迟均优于 GB300,功耗约 700W,计划今年晚些时候支撑自家模型推理;二代已接近流片、三代启动设计。来源:The Verge
-
xAI 发布 Grok 4.6,综合智能追平 GPT-5.6 Sol Max:Grok 4.6 集成至 Hermes 平台,主打长时间运行的 Agent 任务,Artificial Analysis 综合智能指数 61 分,仅次于 Fable 5 Max 的 62 分;API 定价每百万 token 输入 2 美元、输出 6 美元,显著低于竞品。Musk 在收购 Cursor 后内部会上承认 Grok 此前落后,点名 Anthropic 为当前领跑者。来源:稀土掘金
-
阿里千问预告今晚开源 Qwen3.8-Flash-Next:基于下一代 Qwen4 架构的多模态 MoE 模型,北京时间 8 月 26 日 23:00 开源并同步发布 FP8 量化版,提前放风是为了让社区为完整 Qwen4 家族做好生态准备。来源:IT之家
-
DeepSeek 上线 V4-Flash-Vision-Exp 视觉模型:首次补齐 V4 系列图片输入能力,支持 JPEG/PNG/GIF/WebP,视觉 Agent 基准接近 Claude Opus 4.8,文本能力与 V4-Flash 正式版持平;图片按最多 384 token 计费,约 1 分钱处理 9 张图,较同类便宜近 20 倍。来源:稀土掘金
-
Anthropic IPO 招股书将"AI 抵制浪潮"列为风险因素:据 CNBC 报道,Anthropic 招股书将把公众对 AI 及数据中心的负面情绪列为关键风险;公司已秘密递交上市申请,投资者预期估值约 2 万亿美元、募资超 1000 亿美元,有望超越 SpaceX 创纪录的 IPO;盖洛普调查显示七成美国人反对在本地建设 AI 数据中心。来源:CNBC
-
法律 AI 独角兽 Harvey 发布自有模型 Tenet,底座用 Kimi K3:Harvey 首发基于开放权重后训练的自有模型,采用月之暗面开源模型 Kimi K3 做底座,面向长时执行、连续调用工具的法律任务,LAB 基准完成数近底座两倍;公司服务全球超 10 万名律师、每月处理 13 万亿 token,选择"中国开源底座 + 自有后训练"路线以摆脱对 API 依赖。来源:稀土掘金
-
工信部:"十五五"将攻关世界模型、推进人形机器人与脑机接口:国新办发布会披露,我国智能算力规模达 2185 EFLOPS、建成 70 余条算力大通道,国产开源大模型全球累计下载量突破 100 亿次,近 200 项 AI 关键标准已研制;"十五五"将支持高端训练芯片、多模态算法,攻关类脑智能、世界模型等前沿技术。来源:新华网
🛠️ AI 应用前线
-
Perplexity × Nvidia 发布 Portable Computer:全本地 AI agent,零 token 成本:与英伟达深度合作推出的本地 AI 设备,模型、用户文件与工作全部留在本机,本地完成任务不消耗任何计费额度;每个任务默认从设备端启动,只有发送到云端前沿模型时才需用户授权。来源:VentureBeat
-
ChatGPT Work 可自主登录网站办事,凭据对 OpenAI 不可见:ChatGPT 的 Agent 现在可以自行登录网站完成预约 DMV 业务、取消预订、填写求职申请等操作,OpenAI 全程看不到用户登录凭据,隐私边界设计成为产品卖点。来源:The Verge
-
Anthropic Claude Tag 更新:Slack agent 可读完整对话并主动插话:Anthropic 企业产品负责人阐释"多人 AI(multiplayer AI)"理念——AI agent 从单用户聊天机器人转向跨团队协作,能读取组织上下文、在未被点名的情况下主动介入工作流。来源:VentureBeat
-
Claude Cowork 上线统一记忆:聊天与工作台共享记忆:用户在聊天中告诉 Claude 的信息现在会自动同步到 Cowork,可逐条查看、编辑、删除,敏感主题默认不存储、可手动开启;Anthropic 正把用户上下文变成跨产品的核心资产。来源:TechCrunch
-
英伟达发布 Jetson Orin Nano 2 机器人计算机:AI 算力达 78 TOPS,推理性能为前代两倍、功耗降低 40%,兼容 Cosmos、Qwen 3 等大模型,预计 2027 年上半年上市,面向入门级边缘 AI 场景。来源:腾讯网·AI机器人日报
-
Arduino 发布 299 美元边缘 AI 板 Ventuno Q:搭载高通 Dragonwing IQ8 处理器(最高 40 TOPS)+ 专用实时微控制器,可在完全离线状态下处理视觉、语音与传感器数据,面向自主机器人本地运行 agentic AI。来源:The Verge
-
天工机器人百米跑出 8.86 秒,再度刷新世界纪录:第二届世界人形机器人运动会 100 米复赛中,北京人形机器人创新中心的天工机器人以 8.86 秒刷新纪录;同日机器人 ETF 跟踪指数上涨 0.54%。来源:腾讯网·AI机器人日报
📊 数据速递
- 60 亿美元 — 英伟达为 Poolside Model Factory 训练系统支付的许可费,另加 10 亿美元入股(The Next Web)
- 2185 EFLOPS — 截至 6 月底中国智能算力规模,围绕算力枢纽建成 70 余条算力大通道(新华网)
- 100 亿次 — 国内开源大模型全球累计下载量突破 100 亿次(新华网)
- 约 130 亿美元 — 传出 Hugging Face 正在接洽的出售报价(多家科技媒体汇总)
- 7600 万美元 — Stability AI(Stable Diffusion 开发商)新一轮融资(TechCrunch)
- 2000 万 — OpenAI Codex 用户数,普通推理速度三个月提升约 60%(稀土掘金)
- 30 倍 — NVIDIA Vera Rubin 平台运行 DeepSeek 系列模型吞吐量提升幅度(36氪)
- 70% — 盖洛普调查:美国人对在本地建设 AI 数据中心持反对态度(CNBC)
- 8.86 秒 — 天工机器人在世界人形机器人运动会百米赛跑成绩(每日经济新闻)
📊 今日概览
| 维度 | 数据 |
|---|---|
| 📅 日期 | 2026-08-26 |
| 🔬 ArXiv 精选论文 | 12 篇 |
| 🚀 GitHub 趋势项目 | 15 个 |
| 📰 新闻事件 | 16 条 |
🔬 ArXiv 今日精选论文
大模型与 Agent
-
Recuris: Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses — 提出递归"经验-工作记忆"架构:工作记忆追踪任务进度并指导技能选择,元代理将执行证据转化为校验过的技能记忆更新,形成有界的递归记忆进化回路,在四个长程基准与十个模型上显著提升长时任务表现。论文
-
SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL — 针对长工具调用轨迹中组相对强化学习等待成本高的问题,提出流对齐策略优化,用持久化的 prompt 级价值估计消除对兄弟 rollout 的依赖,提升异步 Agent 强化学习效率。论文
-
BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes — 提出通过并行浏览器沙箱规模化生产高质量网页交互轨迹数据的方法,绕开公开数据集在多样性与规模上的瓶颈,为像素级网页 Agent 训练提供数据通路。论文
-
CAFE: Self-Improving Search Agents Need Co-Evolving Feedback — 指出结果监督无法定位中间错误,提出将纠错反馈作为轨迹内干预进行学习,让搜索 Agent 在错误累积前自我纠偏,实现自我改进。论文
机器学习理论与方法
-
Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining — 发现预训练中的"ELR 坍缩"现象:学习率与参数范数主要通过其比值(有效学习率)决定损失动态,ELR 匹配时损失轨迹全程坍缩重合,为超参选择提供新理论抓手。论文
-
What FID Hides: Detecting, Ranking, and Diagnosing Deviations in Generative Evaluation — 揭示 FID 只匹配前两阶矩的缺陷(无法识别方向性离散偏差、对模式坍缩不敏感),提出 ZID 综合诊断框架,输出偏离指数、置换检验 p 值与有符号离散度读数三重视角。论文
-
Bellman Calibration for Marginalized Importance Weighting in Offline Reinforcement Learning — 针对离线 RL 中边缘化重要性加权的残差占用平衡违背问题,提出贝尔曼校准方法,提升目标策略评估的稳定性与精度。论文
多模态与视觉语言
-
LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training — LAION 发布大规模开放视频数据集:从 CommonCrawl 收集 13 亿条视频 URL,实际下载 8000 万条视频、总时长 1000 万小时,专为多模态预训练设计。论文
-
MoTE: Mixture of Task Experts for Multi-Task Video Understanding — 针对程序性视频理解中多种任务共享前馈网络导致的行为纠缠,提出任务专家混合架构,实现对动作识别、预测与程序预测的可控解耦。论文
-
LION: A Clifford Neural Paradigm for Multimodal-Attributed Graph Learning — 面向多模态属性图学习提出 Clifford 神经范式,统一建模文本、视觉等多模态属性与图结构,扩展图下游任务边界。论文
安全、机器人与交叉应用
-
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing — 针对 LLM Agent 工具调用带来的文件篡改、信息泄露等风险,提出步骤级护栏:在执行前监控每个动作而非事后评估整条轨迹,并在安全与效用间动态平衡。论文
-
Right Diagnoses, Decorative Reasoning: A Perturbation Audit of Medical Chain-of-Thought — 对医学大模型的思维链进行扰动审计:临床医生把 CoT 视为推理证据,但研究发现可见思维链常是"装饰性"的,诊断正确并不代表推理链真实,提示医学场景需谨慎对待 CoT 可信度。论文
-
A Geometric Theory of Robust Fairness Audits — 基于近邻的公平性审计依赖最近邻关系,对扰动敏感;论文建立鲁棒公平审计的几何理论,刻画审计程序自身的稳健性边界。论文
🚀 GitHub AI 趋势日榜 Top 15
| 排名 | 项目 | 语言 | ⭐ 今日获星 | 说明 |
|---|---|---|---|---|
| 1 | tt-a1i/archify | HTML | — | 生成美观、可验证的架构图/工作流/时序图 Agent 技能,自包含 HTML,支持动画与导出 |
| 2 | freestylefly/awesome-gpt-image-2 | JavaScript | +2,156 | GPT-Image2 工业级提示词引擎与模板库,530+ 案例逆向工程,20+ 套工业级模板 |
| 3 | anthropics/claude-plugins-official | Python | — | Anthropic 官方维护的高质量 Claude Code 插件目录 |
| 4 | Alishahryar1/free-claude-code | Python | +851 | 在终端/IDE/手机免费使用 Claude Code、Codex 等(13 亿+免费 token),支持语音 |
| 5 | MadsLorentzen/ai-job-search | Python | +1,199 | 基于 Claude Code 的 AI 求职框架:评估职位、定制简历、撰写求职信、模拟面试 |
| 6 | AgriciDaniel/claude-obsidian | Python | — | 自组织 Obsidian 第二大脑:任意资料自动链接进 Markdown 知识图谱,开源的 Notion 替代 |
| 7 | basecamp/omarchy | Shell | +1,139 | Basecamp 出品的现代、美观且"有主见"的 Linux 发行版 |
| 8 | rohitg00/ai-engineering-from-scratch | Python | — | "学它、造它、交付它"的 AI 工程从零实战教程 |
| 9 | tinyhumansai/openhuman | Rust | — | 本地优先的个人 AI 超级智能:构建生活记忆、编排 Agent 舰队与工作流、深度研究 |
| 10 | DietrichGebert/ponytail | JavaScript | +1,242 | 让 AI agent 像最懒的资深工程师一样思考——最好的代码是没写的代码 |
| 11 | anthropics/claude-plugins-community | Python | — | Claude Cowork 与 Claude Code 的社区插件市场(只读镜像) |
| 12 | ConardLi/garden-skills | CSS | — | 开源 Skills 集合:网页设计、知识检索、图像生成等 |
| 13 | browser-use/browser-use | Python | — | 让网站对 AI agent 可用,轻松实现网页任务自动化 |
| 14 | K-Dense-AI/scientific-agent-skills | Python | — | 让任意 AI agent 变身 AI 科学家:163 个验证技能 + 100+ 科学数据库,17.5 万科学家在用 |
| 15 | marin-community/marin | Python | — | 基础模型研究与开发的开源框架 |
💡 今日洞察
-
英伟达"许可+挖人+入股"三件套第三次落地(Groq、Enfabrica、Poolside):芯片巨头正从"卖铲人"变成"开矿人",亲自下场做开源模型后将与最大客户 OpenAI、Anthropic 正面竞争。这种绕开反垄断审查的交易结构正在成为 2026 年大厂获取 AI 技术的主流范式,监管与立法追赶只是时间问题。
-
推理 ASIC 化加速,推理成本战进入"每 token"决胜阶段:OpenAI Jalapeño 对标 GB300、英伟达 Vera Rubin 让 DeepSeek 吞吐提升 30 倍、GPT-5.6 Sol 降价 20%、DeepSeek 视觉 1 分钱 9 图——自研芯片 + 降价组合拳意味着"模型能力差距"正在被"单位算力成本差距"部分取代,价格战烈度只会更高。
-
中国开源模型已系统性地进入美国 AI 产品供应链:Harvey(法律)、Cursor、Devin、Thinking Machines 接连采用 Kimi/DeepSeek 做底座,汤森路透用 Qwen 替代 Claude。美国大厂(英伟达 Nemotron、OpenAI)开始以"开源对开源"回应,开源与闭源的竞争从舆论战升级为供应链争夺战。
-
资本狂热与社会抵制的张力被写进招股书:Anthropic 以约 2 万亿美元估值冲刺史上最大 IPO,同时必须在招股书中把"AI 抵制"列为风险因素(70% 美国人反对本地数据中心)。一级市场估值仍在膨胀,但"社会许可成本"已经首次成为上市公司必须披露的财务变量。
-
Agent 从"聊天"走向"自主操作",安全边界成为新竞争点:ChatGPT Work 自主登录网站办事(凭据不可见)、Claude Tag 主动插话、Perplexity 全本地 agent、ArXiv 上 StepGuard 步骤级护栏——自主性提升的同时,"可信操作边界"正成为下一轮产品差异化的核心战场。
✍️ 编辑策划 / 整理:Fan Jun AI Tech Notes 组
📅 发布日期:2026-08-26
数据来源:ArXiv API、GitHub API、TechCrunch、The Verge、Wired、VentureBeat、机器之心、量子位等

2万+

被折叠的 条评论
为什么被折叠?



