昨天下午刷到 Anthropic 官网的公告时,我盯着标题看了三秒——"Previewing the Model Hardware Standard"。
点进去往下翻,越看越坐不住。Claude 在 QuEra 的量子计算机上做激光校准,稳定率从人类专家的 58% 干到了 99.3%,单次校准从 5-10 分钟压到 6 秒。Genentech 的药物发现实验里,Claude 自己操控移液器跑实验,出了错还自己修。
这不是 Demo,这是真刀真枪在生产环境里跑出来的。
有人说这是"硬件版 MCP",我觉得不对。MCP 是让 AI 能调用软件工具,MHS 是让 AI 能直接操作物理设备——这中间差了整整一个次元。
一、MHS 到底解决了什么问题?
实验室和工厂里的设备,通信接口一直是个老大难。显微镜用 MATLAB 控制,相机走 Python 脚本,电生理设备跑 C#,机械臂又有自己那套 SDK。你想让它们协同工作?先花几周写胶水代码吧。
Anthropic 跟 HHMI Janelia 研究园区合作开发 MHS,核心思路说白了就一句话:给每台设备写一份"设备说明书",让 AI 能读懂。
这份说明书(MHS 管它叫 Device Description File)里写清楚: - 这台设备有哪些可操作的接口 - 每个接口的输入输出是什么 - 安全阈值在哪(比如机械臂不能转超过多少度,激光不能超过多少功率) - 设备的状态怎么读
然后通过标准化的驱动层(Standard Drivers),把各家的私有协议统一成一套读写原语(Read/Write Primitives)。AI 不需要知道底层是串口、USB 还是以太网,MHS 帮你屏蔽了。
这套思路跟 MCP 一脉相承。MCP 把各种软件工具统一成 Resources / Tools / Prompts 三个抽象,MHS 把各种硬件设备统一成 sensor reads 和 actuator writes。区别在于,MHS 多了一层安全约束——你让 AI 调个 API 最多把数据搞乱,让 AI 动机械臂是真能砸到人的。
二、三个落地案例,看 MHS 的"真实体感"
Anthropic 这次公布了三个合作方的实测数据,我挑最关键的列出来:
| 场景 | 合作方 | 之前 | 用了 MHS 之后 |
|---|---|---|---|
| 量子计算机激光校准 | QuEra | 稳定率 58%,单次 5-10 分钟 | 稳定率 99.3%,单次 6 秒 |
| 药物发现实验 | Genentech | 人工操作+手动调试 | Claude 自主跑实验、自动纠错 |
| 高通量成像实验 | HHMI Janelia | 数周集成+人工操作 | 8 小时跑通,1 天内完成全流程 |
QuEra 那个案例最让我意外。量子计算机的激光系统校准,以前全靠资深工程师凭经验手动调,稳定率才 58%——也就是说将近一半的校准结果是不合格的。Claude 通过 MHS 读取激光系统的实时状态,微调参数,再读反馈,循环优化,把稳定率拉到了 99.3%。
这不是"AI 比人强"的问题,是"AI 能 24 小时不间断地做精细调节,而人不行"。
Genentech 那边的情况更贴近实际。药物发现实验里移液器的设置经常需要微调,以前得研究员盯着,发现问题→打电话叫工程师→工程师来调→重新跑。Claude 接上 MHS 后,自己读实验数据,发现移液量偏差,自动调整参数,重新跑——整个闭环在几秒内完成。
三、MHS 的架构,到底长什么样?
我仔细读了 Anthropic 的技术文档,MHS 的分层架构大概是这样:
底层:设备驱动层(Standard Drivers) 为每类硬件定义标准化的驱动接口。不管底下是显微镜还是机械臂,暴露给上层的就是 read() 和 write() 两个原语,外加一个 describe() 返回设备描述文件。
中间层:安全沙箱(Safety Sandbox) 设备描述文件里定义的安全边界在这里强制执行。比如"激光功率最大 500mW"、"机械臂关节角度 0-270°",AI 发出的指令如果越界,沙箱直接拦截,不给硬件发送。
上层:MCP 桥接层 MHS 通过 MCP 协议跟 AI 模型通信。也就是说,AI 调用硬件设备的方式跟调用一个软件工具完全一样——tool call 的格式都不需要改。Anthropic 在这层加了一个 hardware: 命名空间前缀,方便做权限管理。
跨层:设备发现与注册 新设备接入时,自动广播自己的描述文件。AI 能实时感知到"多了台设备"、"这台设备能做什么"、"它的安全限制是什么"。
这个架构最聪明的地方在于,它没有重新发明轮子。MCP 已经跑通了,开发者社区也接受了,MHS 在 MCP 的基础上加了一层硬件抽象,让存量工具链可以直接复用。
四、冷静一下:MHS 的真实边界在哪
说了这么多好的,也得说说问题。
第一,MHS 目前还是研究预览版,不是正式标准。 Anthropic 只向首批合作实验室和制造商开放了试用,普通开发者还碰不到。官方说预览期结束后会开源,但没给时间表。
第二,设备描述文件谁来写? 每台设备都需要一份 MHS 兼容的描述文件。如果设备厂商不主动支持,就得靠第三方或者 Anthropic 自己去写。初期覆盖的设备种类肯定有限——显微镜、机械臂、液体处理器这些实验室设备是第一批,工厂里的 PLC、CNC 机床、工业机器人呢?还早。
第三,延迟问题。 实验室环境网络条件好,延迟可控。但如果是工厂场景,设备分布在几百米的产线上,AI 在云端推理,控制指令走一圈回来,延迟能不能接受?QuEra 的激光校准是 6 秒,听起来很快,但有些工业场景要求毫秒级的响应。
第四,安全问题。 安全沙箱能拦截预设的越界操作,但 AI 的"创造性"是出了名的。如果 AI 通过一系列看似安全的操作组合,最终导致设备损坏或安全事故,谁来负责?Anthropic 在文档里提到了"graduated safety measures"(分级安全措施),但具体怎么落地,还没有看到详细方案。
五、MHS 对 AI 行业意味着什么
往回看,MCP 让 AI 学会了用软件工具,Cursor 和 Claude Code 让 AI 学会了写代码,Cowork 让 AI 学会了操作浏览器。每一步都是 AI 能力边界的扩展。MHS 是这条路径上最激进的一步——AI 终于走出了数字世界,开始触碰物理世界。
但我更关心的是另一个问题:当 AI 能同时操控软件、代码、浏览器和物理设备时,我们还在用"工具"这个词来理解它,是不是已经不够了?
MHS 的长期影响,可能不在于它让 Claude 能校准激光或跑实验,而在于它模糊了"数字"和"物理"之间的那条线。当一个 AI Agent 可以自己写代码、自己部署、自己调用 API、自己操作浏览器、再自己操控机械臂去完成一个物理任务时,它到底算工具还是算操作者?
这个问题的答案,可能比 MHS 本身更值得讨论。
你觉得呢?欢迎评论区聊聊。

4723

被折叠的 条评论
为什么被折叠?



