NVIDIA 与 CoreWeave 将 Vera Rubin NVL72 和 Vera CPU 投入生产,闭环智能体 AI
CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并将提供面向 AI 智能体的 NVIDIA Vera CPU,同时推出统一训练、评估与改进模型和智能体的环境 CoreWeave Forge。
CoreWeave 宣布在 CoreWeave Cloud 上线 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网,并将提供面向 AI 智能体的 NVIDIA Vera CPU,同时推出统一训练、评估与改进模型和智能体的环境 CoreWeave Forge。
针对 RAG 在跨数百份合同的聚合问题上失效,AWS 给出了一套合同智能平台架构:AI 提取智能体(Claude Sonnet 系列)从 PDF 中抽取 8 个关键字段并附置信度,验证智能体(Claude Haiku)独立复核,签名识别分歧由 Amazon Textract 用计算机视觉做确定性裁决,结果存入 Amazon Aurora PostgreSQL。
AWS 发文拆解 Amazon Quick 各组件的提示词写法:Quick Research 需明确目标、受众与范围,并自行拆解子问题、限定来源;Quick Flows 要写清时间、数据源、计算与交付目标,复杂逻辑用编号步骤,并可通过对话迭代修改;Quick Sight 的查询需包含业务问题、指标与维度。
Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应准确度,本文是该两篇系列的第一部分,聚焦适用于各 Quick 组件的通用原则与可复用框架。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上以约五分之一的单任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
推荐理由:AWS 官方给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与数据隔离条款,便于评估企业落地条件。
Google Research 与 Google DeepMind 提出 SensorFM,一个直接从无标注可穿戴数据学习的大型传感器基础模型,预训练语料来自五百万名同意参与者、超过一万亿分钟的多模态传感器信号,覆盖 100 多个国家、50 个美国州和 20 多种 Fitbit 与 Pixel Watch 设备。
推荐理由:Google 用五百万人的万亿分钟可穿戴数据预训练通用生理表征,读者可了解基础模型在健康领域的规模化路径。