Google DeepMind 公布塞拉利昂 AI 教学试验结果
Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,八周内完成。
推荐理由:原文给出塞拉利昂预注册试验的量化结果与交互数据,读者可据此判断 AI 辅助教学的实际效果与边界。
值得读的 AI 论文与研究成果:架构创新、训练方法、能力测量与理论进展的精选解读。
Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,八周内完成。
推荐理由:原文给出塞拉利昂预注册试验的量化结果与交互数据,读者可据此判断 AI 辅助教学的实际效果与边界。
Google Research 在 Nature 发表 PHRM 研究系统,利用手机前置摄像头在面部解锁后拍摄 8 秒视频,通过深度学习在后台估算心率和静息心率。
推荐理由:Google 用手机前摄在解锁后被动测心率,并公开迄今最大规模多肤色 rPPG 数据集与预训练模型。
Google DeepMind 的 Co-Scientist 被用于加速细胞衰老研究:它扫描数万篇论文后提出 20 多个新的候选基因因子,实验室验证其中几个成功让细胞进入更年轻状态并改善整体功能。
推荐理由:原文给出 Co-Scientist 在衰老研究中的具体产出与验证结果,读者可据此判断 AI 辅助科研的实际落地程度。
斯坦福大学医学院遗传学家 Gary Peltz 团队在《Advanced Science》发表研究,测试 Google DeepMind 的 Co-Scientist 能否从已有药物文献中筛选出可重定位治疗肝纤维化的候选药。
推荐理由:斯坦福团队用 Co-Scientist 筛选抗纤维化药物,实验显示其候选药优于人工挑选,可观察 AI 辅助药物重定位的实证效果。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,医生更偏好其回答而非现有证据综合工具;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体表现更好。
推荐理由:Google DeepMind 公开 AI co-clinician 研究计划,给出医生端与患者端两类评测结果,可了解医疗 AI 当前能力边界。
Google Research 介绍其 Empirical Research Assistance(ERA)在四个真实科研场景中的应用:公共卫生方面,团队每周向 CDC 的流感。
推荐理由:Google 官方汇总 ERA 在流行病预测、宇宙学、碳监测和神经科学四类真实科研场景中的使用结果,可了解 LLM 辅助科研的落地边界。
Google DeepMind 发布论文提出 Decoupled DiLoCo 分布式训练架构,将大规模训练拆分为解耦的计算孤岛,孤岛间以异步数据流通信,从而隔离局部硬件故障并降低带宽需求。
推荐理由:原文给出跨数据中心异步训练的具体带宽与加速数据,读者可据此判断分布式预训练的工程可行性。
Google Quantum AI 发布白皮书,称未来量子计算机破解保护加密货币的椭圆曲线密码(ECDLP-256)所需的量子比特和门数比此前认为的更少。
推荐理由:Google Quantum AI 给出破解 ECDLP-256 的更新资源估算,并用零知识证明确认结论,读者可了解量子威胁与后量子迁移的紧迫性。
Google Research 发布 TurboQuant 压缩算法,并配套提出 QJL 与 PolarQuant,用于解决向量量化中的内存开销问题,三篇工作将分别亮相 ICLR 2026 和 AISTATS 2026。
推荐理由:Google 提出 TurboQuant 等三种向量量化算法,在 KV cache 压缩与向量搜索上给出可复用的压缩思路与实测数据。
Google Research 与多家 NHS 机构合作的 AIMS 研究在 Nature Cancer 发表两项姊妹研究,评估 AI 乳腺癌检测系统。
推荐理由:两项 Nature Cancer 研究给出 AI 在 NHS 乳腺筛查中的独立与双读表现,并暴露数据漂移与仲裁误判等落地问题。
Google Research 与 Beth Israel Deaconess Medical Center 合作开展了一项前瞻性单中心可行性研究,让 AMIE 在门诊初级保健就诊前与患者进行病史采集对话,全程由医生通过视频监督。
推荐理由:Google 与 BIDMC 首次在真实门诊流程中前瞻性测试对话式诊断 AI,给出了安全监督、诊断准确率与医患体验的具体数据。