跳到正文
10月4日 · 周日

最新精选

10月2日周五
  1. NVIDIA Blog62

    NVIDIA DGX Spark 推出 64GB 版本,支持双机集群扩展本地 AI

    NVIDIA 宣布 DGX Spark 将于本月推出 64GB 统一内存版本,由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商发售,10 月 23 日上市,起售价 4,999 美元。

    推荐理由:原文给出 64GB 新配置的售价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。

  2. NVIDIA Blog78

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。

    推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。

10月1日周四
  1. Simon Willison85

    OpenAI DevDay 2026 现场实录:Dots 个人智能体、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布个人智能体产品 Dots,由 Astra 模型驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出团队协作空间 ChatGPT Space。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示成败,可对照 OpenAI 在智能体、编码与定价上的产品布局。

  2. AWS Machine Learning Blog72

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和日常专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上以约五分之一的单任务成本达到 GPT-6 Astra 的水平,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。

    推荐理由:AWS 官方给出 GPT-6.1 Sol 在 Bedrock 上的可用范围与数据隔离条款,便于评估企业落地条件。

  3. Latent Space88

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol、Ultrafast 与 Decisions API

    OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API 与 ChatGPT Spaces,并称 ChatGPT 周活达 12 亿。

    推荐理由:汇总 OpenAI DevDay 2026 的发布清单与独立评测数据,便于对照各家模型在价格与能力上的取舍。

9月29日周二
  1. OpenAI News80

    OpenAI DevDay 2026 回顾:GPT-6 Astra、ChatGPT、Codex 与 API 等 20 多项发布

    OpenAI 发布 DevDay 2026 回顾,汇总了 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。原文未展开各项发布的具体内容。

    推荐理由:OpenAI DevDay 2026 一次性放出 20 多项发布,读者可据此快速了解 GPT-6 Astra、Codex 与 API 的更新范围。

  2. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,便于判断长任务智能体的成本与延迟取舍。

9月25日周五
  1. GitHub Blog · AI & ML62

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体,自动完成 C/C++ 模糊测试全流程

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率补洞与崩溃分诊交给 LLM 智能体,并公开了完整实现与运行方式。

9月24日周四
  1. Latent Space76

    Meta Connect 2026:Muse 眼镜、语音、视频与 Charm

    Meta 在 Connect 2026 上把个人智能体 Muse 作为硬件加智能体战略的核心,发布眼镜等设备并预告但未发布新前沿模型。Muse 新增语音与实时视频能力,可后台执行任务,并登陆全部 Meta 眼镜;每台 Muse 拥有独立邮箱地址,Mac 版支持 computer use,连接器平台覆盖 1500+ 应用。

    推荐理由:Meta Connect 2026 把个人智能体与自研硬件绑在一起,读者可据此看清其分发优势与前沿模型缺位的落差。

9月22日周二
  1. NVIDIA Blog62

    NVIDIA 发布 Isaac ROS 5.0,推进智能体化开源机器人开发

    NVIDIA 在加拿大多伦多 ROSCon 大会上发布 Isaac ROS 5.0,为基于 ROS 的 GPU 加速包集合引入智能体工作流与新的平台支持,面向近 130 万 ROS 用户,免费开源。

    推荐理由:Isaac ROS 5.0 把智能体工作流引入机器人开发,并给出多家厂商的落地案例,可据此判断开源机器人栈的演进方向。

  2. Hugging Face Blog62

    Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型

    Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取 GGUF 检查点,用 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。

    推荐理由:Hugging Face 官方给出在 transformers 中直接加载 GGUF 的用法与性能对比,可据此判断本地推理工作流是否值得迁移。

9月21日周一
  1. Hugging Face Blog62

    Hugging Face 发布 tokenizers v1:编码提速 3 至 30 倍

    Hugging Face 发布 tokenizers v1 候选版本,在 Apple M4 Max 单线程下编码速度比 v0.23 快 3 至 30 倍,八线程扩展效率为线性的 76%,且输出的 token ID 与 v0.23 完全一致。

    推荐理由:原文给出 v1 相对 v0.23 的加速幅度与实现改动,可据此判断分词环节在训练与推理管线中的实际权重。

9月10日周四
  1. OpenAI News62

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 发布 ChatGPT for Financial Services,内置金融数据并接入 GPT-6 Astra,用于研究、建模和生成可直接交付客户的材料。

    推荐理由:OpenAI 面向金融行业推出专用 ChatGPT,内置金融数据并接入 GPT-6 Astra,可用于研究与建模。

  2. OpenAI News68

    OpenAI 在 API 中上线 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,为开发者提供自然的全双工语音对话能力。该模型在指令遵循上更强,并支持自定义音色和电话通信。

    推荐理由:OpenAI 把全双工语音对话能力开放到 API,开发者可据此判断语音应用的接入方式变化。

  3. Hugging Face Blog62

    用 Gradio Workflow 重建 AUTOMATIC1111:Workflow1111 把 11 条媒体流水线做成 73 节点画布

    Hugging Face 用 Gradio Workflow 重建了 AUTOMATIC1111 的大部分功能,命名为 Workflow1111,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 存储和图生视频。

    推荐理由:用 73 个节点复刻 A1111 全部功能,并展示输出节点如何自动变成 REST 与 MCP 工具。

  4. OpenAI News62

    OpenAI 发布 Agents API,支持构建云端智能体

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务提供编排、长时间运行会话和工具调用能力。

    推荐理由:OpenAI 官方发布托管式 Agents API,读者可据此了解云端智能体的编排与工具调用入口。

9月8日周二
  1. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。

    推荐理由:官方给出 ChatGPT Images 2.5 的定位,读者可据此了解图像生成在个性化与成图质量上的变化方向。

9月5日周六
  1. GitHub Blog · AI & ML71

    GitHub 发布 Project HydraFusion:多模型编排实现前沿级编码质量

    GitHub 推出研究预览版 Project HydraFusion,在 GitHub Copilot CLI 中通过 /experimental 启用,可在多个提供商的模型间做运行时编排。

    推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断路由式编排在编码任务上的取舍。

9月3日周四
  1. Hugging Face Blog69

    Hugging Face 发布 funes:给编码智能体一个自己拥有的记忆层

    Hugging Face 发布 funes,一个面向 Claude Code、Codex、pi 和 Hermes 的持久记忆层,从本机已有会话构建索引,一条命令即可接入智能体。

    推荐理由:原文给出 funes 的本地索引与跨智能体召回机制,读者可据此判断编码智能体记忆如何落地。

  2. Google DeepMind71

    Google DeepMind 推出 Fairwind Program,向政府和关键基础设施开放 Gemini 3.8 Flash Cyber

    Google 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全合作伙伴限量开放其网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:Google 把前沿网络防御模型以限量访问方式开放给政府和关键基础设施,读者可了解其能力组合与准入条件。