跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 21–35 条 · 共 39 条
5月20日周三
5月17日周日
  1. Google DeepMind68

    Google 将 SynthID 与 C2PA 内容验证扩展到 Search、Gemini、Chrome 和 Pixel

    Google 宣布扩展内容透明度与验证工具,把 SynthID 验证从 Gemini 应用扩展到 Search,并将在未来几周进入 Chrome;该验证功能已在全球被使用 5000 万次。

    推荐理由:Google 把 SynthID 与 C2PA 验证铺到 Search、Gemini、Chrome 和 Pixel,读者可据此了解内容溯源工具的实际覆盖范围。

5月16日周六
  1. Google DeepMind62

    斯坦福团队用 Co-Scientist 筛选抗肝纤维化药物

    斯坦福大学医学院遗传学家 Gary Peltz 团队在《Advanced Science》发表研究,测试 Google DeepMind 的 Co-Scientist 能否从已有药物文献中筛选出可重定位治疗肝纤维化的候选药。

    推荐理由:斯坦福团队用 Co-Scientist 筛选抗纤维化药物,实验显示其候选药优于人工挑选,可观察 AI 辅助药物重定位的实证效果。

  2. Google DeepMind66

    WeatherNext 如何帮助美国国家飓风中心预测飓风 Melissa 登陆牙买加

    Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天预测飓风 Melissa 将以五级强度登陆牙买加,置信度达 80%,三天前升至接近 100%。

    推荐理由:原文给出 WeatherNext 在飓风路径与强度预测上的实际表现,读者可了解 AI 天气模型在极端事件中的落地方式。

  3. Google DeepMind87

    Google DeepMind 发布 Gemini 3.5 Flash,主打智能体与编码

    Google DeepMind 发布 Gemini 3.5 模型系列,首发 3.5 Flash,定位为面向智能体与编码的前沿模型,即日起通过 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API、Android Studio 及 Gemini Enterprise 等渠道开放。

    推荐理由:官方给出 3.5 Flash 在编码与智能体基准上的成绩和开放入口,可据此判断速度与质量能否兼得。

5月12日周二
5月6日周三
  1. Google DeepMind74

    Google DeepMind 发布 AlphaEvolve 一年落地成果

    Google DeepMind 汇总了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的应用成果,涵盖数学、量子物理、基因组学、电网优化和 AI 基础设施等领域。

    推荐理由:官方汇总 AlphaEvolve 一年落地案例,从基因组到 TPU 设计,可看编码智能体在真实基础设施中的边界。

4月30日周四
  1. Google DeepMind62

    Google DeepMind 发布 AI co-clinician 医疗 AI 研究计划

    Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,医生更偏好其回答而非现有证据综合工具;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体表现更好。

    推荐理由:Google DeepMind 公开 AI co-clinician 研究计划,给出医生端与患者端两类评测结果,可了解医疗 AI 当前能力边界。

4月23日周四
4月16日周四
  1. Google DeepMind66

    Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

    Google DeepMind 发布新一代文本转语音模型 Gemini 3.1 Flash TTS,主打更强的可控性、表现力与语音质量,已在 Gemini API 和 Google AI Studio 面向开发者预览、在 Vertex AI 面向企业预览,并通过 Google Vids 向 Workspace 用户开放。

    推荐理由:官方给出 Elo 1,211 与多说话人、70+ 语言等能力,可据此判断语音生成的可控性提升。

4月13日周一
  1. Google DeepMind71

    Google DeepMind 发布 Gemini Robotics-ER 1.6,新增仪表读数能力

    Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人推理的模型升级版,重点增强空间推理与多视角理解,并新增仪表读数能力,可读取压力表、液位计和数字读数。

    推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并首次加入仪表读数能力,可据此判断机器人在巡检等场景的自主程度。

3月31日周二
  1. Google Research66

    Google Quantum AI 发布白皮书:量子计算机破解加密货币椭圆曲线密码所需资源大幅下降

    Google Quantum AI 发布白皮书,称未来量子计算机破解保护加密货币的椭圆曲线密码(ECDLP-256)所需的量子比特和门数比此前认为的更少。

    推荐理由:Google Quantum AI 给出破解 ECDLP-256 的更新资源估算,并用零知识证明确认结论,读者可了解量子威胁与后量子迁移的紧迫性。

3月25日周三
  1. Google Research60

    Google 发布 Vibe Coding XR:用 Gemini 和 XR Blocks 把自然语言变成 Android XR 应用

    Google 发布 Vibe Coding XR 工作流,把 Gemini 与基于 WebXR 的 XR Blocks 框架结合,可将自然语言提示直接转成具备物理感知的 Android XR 应用,耗时不到 60 秒。

    推荐理由:Google 把 Gemini 的长上下文推理接到 WebXR 框架上,读者可据此判断自然语言生成 XR 原型的可行边界。

3月12日周四
  1. Google Research62

    Google 推出 Groundsource:用 Gemini 把新闻报道转为灾害数据

    Google Research 推出 Groundsource,一套用 Gemini 从非结构化新闻中提取灾害事件的可扩展方法,并发布首个开放数据集,包含 2.6 百万条城市山洪记录,覆盖 150 多个国家、时间跨度从 2000 年至今。

    推荐理由:Google 用 Gemini 把 80 种语言的新闻报道转成结构化灾害数据,其人工核验准确率与覆盖范围可供评估这类方法的上限。