NVIDIA 与 CoreWeave 将 Vera Rubin NVL72 和 Vera CPU 投入生产,闭环智能体 AI
CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并将提供面向 AI 智能体的 NVIDIA Vera CPU,同时推出统一训练、评估与改进模型和智能体的环境 CoreWeave Forge。
CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并将提供面向 AI 智能体的 NVIDIA Vera CPU,同时推出统一训练、评估与改进模型和智能体的环境 CoreWeave Forge。
AI2 发布 Olmo-core 3,这是其大语言模型训练框架的一次重大升级,重新设计了开放的 MoE 训练系统,目标是把 MoE 训练扩展到万亿参数规模并保持计算效率。
推荐理由:原文给出了 MoE 训练栈的吞吐与显存对比数据,读者可据此判断万亿参数 MoE 训练的开源方案成熟度。
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。该方案将单次内容检索耗时从 250 分钟降至 2 分钟以内,覆盖超 14 万条视频,支持自然语言意图搜索、以图搜图和精确时间戳定位。
针对 RAG 在跨数百份合同的聚合问题上失效,AWS 给出了一套合同智能平台架构:AI 提取智能体(Claude Sonnet 系列)从 PDF 中抽取 8 个关键字段并附置信度,验证智能体(Claude Haiku)独立复核,签名识别分歧由 Amazon Textract 用计算机视觉做确定性裁决,结果存入 Amazon Aurora PostgreSQL。
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程不离开所调用的 AWS 区域。
DeepSeek 与华为合作为昇腾芯片打造编程工具并全部开源,核心是比 CUDA 更易上手的 TileLang 语言,该语言最初由北京大学研究人员开发,DeepSeek 已使用约一年。
NVIDIA 提出 AI 工厂投资回报取决于三个要素:每兆瓦产出能力、硬件使用寿命和 token 需求。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 倍。
前 Google 云业务、SpaceX Starlink 工程师 Rama Afullo 创办的 Satlyt 完成 800 万美元种子轮,由休斯顿 Non Sibi Ventures 领投,用于开发在卫星上运行 AI 模型的软件。
微软研究院实习生开发了一套端到端机器学习流水线,结合太阳风观测、AE 与 Dst 指数预报、地质电导率和电网数据,为美国本土 66,935 座变电站生成 30-60 分钟前的局地空间天气风险估计。
Amazon Bedrock Knowledge Bases 可通过 AgenticRetrieveStream API 用自然语言查询理赔文档,并返回带引用的答案。