Asta Lab · 全栈情报站AI FULL-STACK INTELLIGENCE每日 · 全栈 · 精选

AstaNews

AI 全栈每日情报

Claude Meets Blackwell Ultra: Anthropic’s Models Now Run on NVIDIA GB300 in Azure

把时间线拉出来看更清楚。微软、英伟达、Anthropic 在 2025 年 11 月谈成合作,让企业能在微软云上用上 Claude;这次是把其中一档配置从预览推到正式可用,时间点是 6 月 29 日。改动不大,信号不小。 先说这块卡。GB300 Blackwell Ultra 是英伟达当前最新一代的数据中心 AI 芯片,定位在训练和推理的最顶端,比前两代 Hopper、Blackwell 更靠上。企业实际拿到的不是单张卡,而是 NVL72——72 块 GPU 通过高速互联拼成一个机柜、对上层当一台超大机器用,机柜之间再用 Quantum-X800 InfiniBand 这种高带宽网络连起来。这种整柜方案的意义,是把一个模型塞不进单卡的麻烦在硬件层就消化掉。 再说在 Foundry 里正式可用是什么意思。Foundry 是微软给企业挑模型、部署模型的托管平台,你不用自己搭机器、调环境,选好模型点开通就能调 API。正式可用,意味着这套 Claude 加 GB300 的组合不再是限量预览,所有付费企业客户都能直接开。 有意思的是参与方各自的位置。Claude 的东家 Anthropic 是 OpenAI 最直接的对手,而微软是 OpenAI 最大的出资方,如今却在自家云上把对手的旗舰模型端给客户;英伟达则乐见任何一家把卡用起来。三方立场并不天然一致,能站到一起,说明企业那句既要最强模型、又要最新硬件的需求,已经大到让各家先把竞争放一边。 通稿里真正落到产品的,是英伟达把一批工具塞进了 Anthropic 的技术栈:一套经过验证的 agent 技能,和一个叫 Secure Agent Workspace 的参考设计,用来给能自己动手的 agent 圈定权限、做治理。换句话说,这次卖的不只是算力,还有一套让企业敢把自动化 agent 放进生产的合规底座。 但要泼一点冷水:整份通报几乎没有数字,没有跑分,没有延迟,没有和上一代卡的对比,也没有价格。它是一个“可用性”里程碑,不是一个“性能”结论——GB300 比手里的旧卡快多少、贵多少、值不值得迁移,通稿一概没说。对正在选型的企业,这条新闻把“能不能用上”这一格打了勾,至于“该不该用”,还得自己拿业务负载去 Foundry 里真跑一遍才知道。