英伟达 CUDA 的 20 年护城河一个周末崩了,Claude 独自跑通 AMD 新 GPU
一句话,一个周末,Claude 直接把自家最前沿的模型跑在了一台全新的 AMD MI355X 机架上!
人类工程师全程没动手改过一行代码。
谁能想到,英伟达花 20 年堆起的 CUDA 护城河,就这样被跨了过去。

一个周末,Claude 把 AMD 新 GPU 调通了
故事是这样的。
前段时间,AMD 给 Anthropic 送来一台搭载 MI355X 的机架。团队看完,心里已经做好了打硬仗的准备。新平台配新软件栈,注定需要新一轮适配。
不过,Anthropic 手里正好有 Claude。团队干脆先让一名工程师试试:把 Claude 接上机器,丢给它一句,「去,把这台机器跑起来。」
等周末结束回到工位,屏幕上已经多出一条持续上涨的性能曲线 —— 结果不仅跑起来了,性能还在一轮轮不停地提升。
Anthropic 联合创始人兼首席计算官 Tom Brown 讲完,苏姿丰马上接过话:听说 Anthropic 只有一名工程师在处理 MI355X 时,她第一反应是让 AMD 团队赶紧去帮忙。结果团队回来告诉她,对方说不用,已经全部搞定了。

很快,这场周末实验便接上了真正的部署计划。
就在最近,Anthropic 宣布,将在 AMD Helios 系统中部署最高 2GW 的 Instinct GPU,首批 1GW 计划于 2027 年上半年启动。
并且,双方还会直接使用 Claude 优化 AMD 工作负载,加速 ROCm 软件开发。
芯片说明书,迎来一位非人类读者
Claude 之所以能实现对 CUDA 生态的「降维打击」,是因为 AMD 直接给 AI 开发了一套能上手调 GPU 的工具。
在 AMD Advancing AI 2026 大会上发布的 ROCm.AI,就是给 Claude、Codex 和 Cursor 准备的一整套 GPU 工具箱。
入口叫 AMD Skills,里面装的全是经过验证的 ROCm 知识。
Agent 拿到这些知识后,可以自己装环境、部署模型、读日志、查故障,再通过 ROCm CLI 调用真实机器。开发者说出目标,剩下的路让 Agent 自己找。

划重点,AMD 甚至连芯片说明书的写法都改了。
公司 AI 软件与解决方案副总裁 Anush Elangovan 在现场透露,每一代 AMD GPU 都会公开指令集,并提供 AI 可读的 ISA。
Agent 在读懂手册之后,就能直接上手调性能。
AMD 把这部分工作交给 Hyperloom。它会拉起推理服务,先跑出基线,再去找 CPU 和 GPU 的瓶颈,测试不同配置,生成定制内核,最后把新方案重新跑一遍。
现场演示里,Hyperloom 把 MiniMax M3 的输出速度提升了 38%。AMD 还让它一次跑过 1.4 万个模型,把测试结果沉淀成下一次可以直接复用的经验。

AMD 还在和前沿模型公司一起训练这种能力。Elangovan 的原话很有意思:让前沿模型「天生会说 AMD 编程」。
以后看一块芯片,峰值算力和显存带宽当然重要,AI 能不能读懂它、调用它、把性能调出来,也会摆上同一张参数表。
芯片公司要争取的开发者,现在多了一类:Agent。
来自 ASI 的降维打击
CUDA 从 2006 年一路走到今天,靠的是无数工程师一行行码出来的生态。编译器、数学库、调试器、性能分析工具、开发文档,该有的全有。
更难复制的,是那一代代工程师攒下来的手感。算子怎么调,通信怎么提速,显存怎么分配,分布式部署哪里最容易出问题,这些经验全锁在少数专家的脑子里。
后来者就算造出性能接近的芯片,也得把这条软件长路从头走一遍。芯片流片可以按季度推进,生态积累却只能按年去熬。
而 Agent 补的就是这一段。它会读平台文档,调用性能分析工具,找到速度卡在哪里,再改代码、编译、测试。一个方案没有效果就换下一个;跑分变好就沿着这个方向继续优化。
人类培养一名顶级 GPU 工程师要按年算,多启动一个 Agent 只需要再开一个任务。
一名工程师放出一群 Agent,就能并行排查报错、定位性能瓶颈。一次跑通的配置、写好的内核和踩过的坑,也能马上成为下一批 Agent 的起点。
把按年计算的追赶压缩成按任务计算,AI 最值钱的地方就在这里。这也是 ASI 式能力对 CUDA 生态的降维打击。
如今,中国工程师已经站在这场 AI 改造 GPU 软件栈的最前线,他们沉淀下来的底层经验,也在被整理成更多 Agent 可以调用的能力。
追赶 CUDA 的新起点已经出现:把硬件接口和软件工具交给 AI,让 Agent 直接开工。
20 年的生态差距,第一次可以交给一群 Agent 昼夜不停地往回追。
本文来自微信公众号:新智元(ID:AI_era),作者:ASI 启示录,原标题《CUDA 20 年护城河一个周末崩了!Claude 独自跑通 AMD 新 GPU》
《英伟达 CUDA 的 20 年护城河一个周末崩了,Claude 独自跑通 AMD 新 GPU》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
贾跃亭称聚焦 EAI 机器人战略后,法拉第未来经营基本面进入历史上最好时期
贾跃亭今日发布视频,称聚焦 EAI 机器人战略之后,法拉第未来的经营基本面由于机器人业务快速发展,已经进入了历史上最好的时期。另外,贾跃亭还谈及了 FFAI 此次合股。他表示,由于现在已经出现了连续 10 个交易日等于或低于 0.10 美元可能触发的纳斯达克退市风险,于是实施了合股方案。... -
韩国 SK 电信斥资 7500 亿韩元成立 SK Hyper 子公司,计划建设 15GW 的 AI 数据中心
SK 电信成立子公司 SK Hyper,专注于 AI 数据中心业务。计划到 2030 年投资 7500 亿韩元,先在 2029 年建成 5 吉瓦容量,随后根据需求在 2035 年前扩容至 15 吉瓦。公司将在蔚山、忠清等地建设基础设施,推动韩国 AI 算力发展。#AI数据中心# #SK电信#... -
消息称英伟达与 OpenAI 洽谈,拟为其“全球最大”数据中心项目提供 2500 亿美元担保
据《华尔街日报》报道,英伟达正与 OpenAI 谈判,拟为其租赁软银旗下 10GW 级数据中心项目提供约 2500 亿美元的融资担保。该项目总投资超 5000 亿美元,或成全球最大数据中心。Anthropic、微软、谷歌等企业也对该项目表现出兴趣。#AI算力#... -
英伟达用 Vera 处理器加速下一代 CPU 和 GPU 设计,EDA 应用提速最高 1.5 倍
英伟达联合楷登、新思科技优化 EDA 应用适配 Vera CPU,部署该架构加速自有下一代 CPU、GPU 的芯片研发流程... -
进一步增强逻辑性能:三星电子计划在 HBM5 内存导入 2nm 基础裸片
HBM5 的运行速率预计将较 HBM4E 提升 50% 以上,其基础裸片将支持更高密度的硅通孔 (TSV) 以满足行业需求。...












