AWS CEO Matt Garman 回应数据中心争议,称已不再使用 NDA
AWS CEO Matt Garman 在博客文章中表示,公司已停止在与政府机构合作建设数据中心时使用保密协议(NDA)。他同时反驳了数据中心耗水过多、推高电价、污染严重、无益社区四大说法,称直接数据中心用水仅占美国工业用水 0.5%,发电机 99.9% 时间闲置,并称亚马逊过去三年向数据中心所在社区投入超 10 亿美元。目前全美有 100 多项数据中心禁令正在审议中。
AWS CEO Matt Garman 在博客文章中表示,公司已停止在与政府机构合作建设数据中心时使用保密协议(NDA)。他同时反驳了数据中心耗水过多、推高电价、污染严重、无益社区四大说法,称直接数据中心用水仅占美国工业用水 0.5%,发电机 99.9% 时间闲置,并称亚马逊过去三年向数据中心所在社区投入超 10 亿美元。目前全美有 100 多项数据中心禁令正在审议中。
Airbnb CTO Ahmad Al-Dahle 接受 Latent Space 采访,介绍公司从 Meta 前沿模型转向规模化部署的 AI-native 改造:目前 60% 代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍。
Google 的轨道计算卫星原型随 SpaceX 火箭从加州升空,首次将其 TPU 送入太空,验证芯片能否在轨运行模型。Google 同日发布经同行评审的轨道数据中心白皮书,认为按 SpaceX 每年约 20% 的降本学习曲线,2035 年发射价格有望接近每公斤 200 美元,这需要 Starship 十年内将 37 万吨载荷送入轨道,约合 1800 次发射、每年 180 次。
NVIDIA 提出 AI 工厂投资回报由三要素决定:每兆瓦产出能力、硬件使用寿命和 token 需求。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 倍。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,成为首批交付该平台的云厂商之一,Cognition 是首个在生产环境运行 Vera Rubin 的客户。
推荐理由:CoreWeave 上线 Vera Rubin NVL72 并公布 Devin 实测吞吐数据,读者可据此判断智能体推理的算力成本走向。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将携手 BMW 开展碰撞仿真与工程 AI 合作、与 Siemens Energy 推进工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。
oMLX 作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将从副业转为有资金支持的正式项目,继续以 Apache 2.0 开源并由 Jun 领导,目标是提升稳定性并加快开发。Hugging Face 希望 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为可被各引擎使用的 MLX 参考实现。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 提出物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的全栈安全体系,并称 NVIDIA Halos 是首个也是唯一面向物理 AI 的全栈安全系统。
NVIDIA 在开罗大埃及博物馆举办活动,展示埃及 AI 生态从能力建设走向生产规模,其 Deep Learning Institute 埃及学员规模一年增长超十倍。
NVIDIA 在纽约气候周上介绍了五家用 AI 推进清洁能源的公司。ThinkLabs AI 用数字孪生和智能体把电网并网申请评估时间从 30-45 天缩短到 2 分钟。
NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
推荐理由:MLPerf v6.1 成绩单给出 Vera Rubin 与 GB300 的吞吐、扩展效率和软件优化数据,可用于比较推理基础设施的长期成本。
Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据,双方称此举面向对主权 AI 日益增长的需求。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司完成的最大规模股权融资,距其成立三年。本轮由三星电子领投,Scaleup Europe Fund(由 EQT 管理)和现有投资方 PSG Equity 联合领投,资金将用于扩大前沿研究、算力与基础设施,并加速商业增长和国际布局。
推荐理由:Mistral 以 30 亿欧元 D 轮融资为切口,说明其开源权重加全栈自建路线在欧洲主权 AI 语境下的商业定位。
Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型。合作规模达数亿欧元,Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特面向受监管行业制定联合市场策略。
Safetensors 已加入 PyTorch 基金会,成为 Linux 基金会旗下托管项目,与 DeepSpeed、Helion、Ray、vLLM 和 PyTorch 并列。
Google DeepMind 宣布深化与英国政府合作,向英国科学家优先开放 AlphaEvolve、AlphaGenome、AI co-scientist 和 WeatherNext 等 AI for Science 模型,并计划 2026 年在英国建立其首个自动化科学实验室,专注材料科学研究。