CoreWeave今日宣布,已赢得与Anthropic的多年期合同,将为其提供云基础设施服务。受此消息影响,CoreWeave股价当日收盘大涨11%。
Anthropic委托部署的数据中心容量将于今年晚些时候陆续上线。CoreWeave表示,这批基础设施将"支持Anthropic旗下Claude模型的研发与部署",这意味着Anthropic计划在该平台上同时运行模型训练与推理工作负载。
CoreWeave未披露合同的具体金额,但首席执行官迈克尔·因特拉托(Michael Intrator)在接受彭博社采访时透露,Anthropic将使用部署于美国数据中心的多种英伟达芯片。
CoreWeave目前提供的最先进英伟达显卡为Blackwell Ultra。该芯片由两块四纳米工艺的晶片组成,通过名为NV-HBI的定制互联技术连接,模块间数据传输速率高达每秒10太比特。
Blackwell Ultra不仅配备了矩阵乘法运算单元(AI加速器的核心构建模块),还集成了多种更专业的电路。其中包括所谓的"warp同步内存",用于加速AI模型各组件之间的数据共享;此外,名为"特殊功能单元"(Special Function Units)的计算核心还能加速涉及π等超越数的数学运算。
Anthropic合作关系的披露,恰好发生在CoreWeave扩大与Meta现有基础设施合同的次日。此次修订后的合同涵盖Blackwell Ultra继任产品Vera Rubin的"初期部署"。若相关部署近期上线,Anthropic或许也将借助这款新芯片驱动其托管于CoreWeave上的工作负载。
截至今年2月,CoreWeave在全球运营逾43座数据中心,总容量约达850兆瓦。该公司通过所谓的"专属访问可用区"(Dedicated Access AZs)为大客户提供基础设施服务——这是一种单租户架构的集群,专供单一客户使用,有别于云服务商通常采用的多客户共享模式。
CoreWeave在数据中心建设中融入了多项定制化设计。据该公司介绍,其设施能够预测工作负载的硬件使用峰值,并据此对冷却系统进行优化调配,同时对相关配电硬件实施重新配置。
除AI基础设施外,CoreWeave还提供多元化服务,包括仅由中央处理器驱动、可运行通用工作负载的计算实例,以及简化AI训练报错修复等任务的辅助服务。
据CoreWeave介绍,全球排名前十的AI模型提供商中,有九家正在使用其云平台。这一群体不仅包括Anthropic,还涵盖其竞争对手OpenAI。去年,OpenAI已与CoreWeave达成协议,租用总价值高达224亿美元的基础设施。
Q&A
Q1:CoreWeave与Anthropic签署的合同具体包含哪些内容?
A:CoreWeave与Anthropic签署了一份多年期云基础设施合同,Anthropic委托部署的数据中心容量将于今年晚些时候陆续上线。这批基础设施将支持Anthropic旗下Claude模型的研发与部署,涵盖模型训练与推理两类工作负载。Anthropic将使用部署于美国数据中心的多种英伟达芯片,但合同的具体金额未予披露。
Q2:CoreWeave的Blackwell Ultra芯片有哪些技术亮点?
A:Blackwell Ultra由两块四纳米工艺晶片组成,通过定制互联技术NV-HBI连接,模块间数据传输速率高达每秒10太比特。除矩阵乘法运算单元外,该芯片还集成了"warp同步内存"用于加速AI模型组件间的数据共享,以及"特殊功能单元"用于加速涉及π等超越数的数学运算,整体性能针对AI工作负载进行了深度优化。
Q3:CoreWeave目前的市场规模和客户情况如何?
A:CoreWeave目前在全球运营逾43座数据中心,总容量约达850兆瓦。全球排名前十的AI模型提供商中有九家使用其云平台,客户包括Anthropic和OpenAI。其中OpenAI去年已与CoreWeave达成协议,租用总价值高达224亿美元的基础设施。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。