强化学习控制量子纠错
Sivak 等人在 Nature 发表研究,利用强化学习优化量子纠错过程,这对构建稳定的量子计算机至关重要。该研究展示了 AI 在量子信息科学中的应用潜力。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3,称其为针对美国专有技术的大规模秘密工业蒸馏,这是美国高官首次直接点名特定中国实验室
发布首个系统性基准 UniFFBench,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子动力学模拟提供标准化工具。该基准涵盖多种材料体系,推动 AI4Material 方法的验证与改进。
展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,在保持精度的同时大幅降低计算成本。该方法为精确模拟复杂分子和材料的电子结构提供更高效的途径。
Anthropic 第二季度游说支出达 197 万美元(环比增长 26%),超过英伟达并接近甲骨文,OpenAI 支出 120 万美元(增长 18%),AI 实验室总支出达 317 万美元
Google 发布 Gemini 3.6 Flash,这是截至 7 月 21 日最新跟踪到的前沿模型发布
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
BREAKING
白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3,称其为针对美国专有技术的大规模秘密工业蒸馏,这是美国高官首次直接点名特定中国实验室
Anthropic 第二季度游说支出达 197 万美元(环比增长 26%),超过英伟达并接近甲骨文,OpenAI 支出 120 万美元(增长 18%),AI 实验室总支出达 317 万美元
Google 发布 Gemini 3.6 Flash,这是截至 7 月 21 日最新跟踪到的前沿模型发布
OpenAI 发布 Presence 企业 AI 代理平台,用于部署客服、销售等语音和聊天代理,已在自有客服热线处理 75% 来电,7 月 22 日通过有限 GA 计划上线
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Sivak 等人在 Nature 发表研究,利用强化学习优化量子纠错过程,这对构建稳定的量子计算机至关重要。该研究展示了 AI 在量子信息科学中的应用潜力。
Obermeyer 团队利用深度学习从心电图数据中发现心源性猝死的生物标志物,能够识别出医生未能预测的高风险患者,可能每年挽救大量生命。该模型在检测方面比传统方法更准确。
Fry 等人开发神经迭代选择-扩展方法,实现零样本设计能够与小分子药物结合的蛋白质,同时优化蛋白质序列、结构和配体构象,为药物开发提供新工具。
Park 等人在 Nature Machine Intelligence 发表研究,通过强化学习引导生成模型在巨大的组合设计空间中发现多样化的新型功能晶体材料,拓展材料发现的边界。
Mannan 等人发布 UniFFBench 基准,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子模拟提供标准化工具,推动 AI4Science 方法的验证与改进。
研究团队在 Nature Computational Science 展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,为精确模拟复杂分子体系提供更高效的计算方法。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
结合强化学习与生成式 AI 在巨大的晶体材料设计空间中发现多样化的新型功能材料。该方法通过引导采样策略,克服了生成模型倾向于采样已知结构的局限性,显著提升了材料发现的效率和多样性。
利用强化学习优化量子纠错控制策略,为构建容错量子计算机提供关键技术。该方法展示了 AI 在量子信息处理中的实际应用,有望加速量子计算的实用化进程。
通过深度学习从心电图中发现心源性猝死的预测性生物标志物,填补了医生无法预测的风险缺口。该模型能够识别出需要植入除颤器的高风险患者,可能每年挽救数千生命。
开发神经迭代选择-扩展方法,实现蛋白质序列、结构和配体构象的同时优化,零样本设计能够结合小分子药物的蛋白质。该方法克服了传统蛋白质设计中需要大量已知结构的限制,为药物靶点开发开辟新路径。
提出将神经网络架构扩展到函数空间的原则性方法,用于算子学习以解决偏微分方程。该研究为 AI 求解复杂科学计算问题(如材料模拟、流体动力学等)提供理论基础和实用架构。
发布首个系统性基准 UniFFBench,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子动力学模拟提供标准化工具。该基准涵盖多种材料体系,推动 AI4Material 方法的验证与改进。
展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,在保持精度的同时大幅降低计算成本。该方法为精确模拟复杂分子和材料的电子结构提供更高效的途径。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Sonnet 4.5 | Anthropic | N/A | N/A | 97.6 | HumanEval 排行榜第一(截至 7 月 21 日) |
| Claude Fable 5 | Anthropic | N/A | N/A | N/A | 7 月 1 日恢复全球访问,新增安全分类器 |
| GPT-5.6 Sol | OpenAI | N/A | N/A | N/A | OSWorld 基准创纪录,高端推理和编码 |
| Gemini 3.1 Pro | 94.3 | N/A | N/A | GPQA Diamond 94.3%,SWE-Bench 80.6% | |
| DeepSeek V4 | DeepSeek | N/A | N/A | N/A | SWE-bench Verified 81%,自研推理芯片 |
| Claude Opus 4.7 | Anthropic | N/A | N/A | N/A | GPQA Diamond 94.2%,100 万上下文 |
| Muse Spark 1.1 | Meta | N/A | N/A | N/A | 声称 MCP Atlas、JobBench 等多项评估第一 |
过去 24 小时在 GitHub 上获得最多 Star 的五个开源项目
A hive mind communication platform
Real-time global intelligence dashboard. AI-powered news aggregation, geopolitical monitoring, and infrastructure tracking in a unified situational awareness interface
Kronos: A Foundation Model for the Language of Financial Markets
A skill for your coding agent to stop it from burying the answer. ADHD-friendly output.
Empowering everyone to host fast and efficient Minecraft servers.
行业领袖在想什么,说了什么
"AGI 可能在五年内到来"
哈萨比斯呼吁建立国际监管机构和美国主导的联盟来审查前沿模型,警告通用人工智能可能在五年内到来。他的提议获得了包括 OpenAI 和微软竞争对手在内的多方支持,成为行业统一的声音。
"用 AI 将生命科学研发周期压缩 10 倍"
阿莫代伊宣布 Anthropic 通过收购计算生物学初创公司和聘请 AlphaFold 团队领导者 John Jumper,推进 AI 在生命科学领域的应用,目标是大幅压缩研发周期。Anthropic 在 2026 年上半年营收预计达到 470 亿美元。
"Muse Spark 在代理评估中领先"
扎克伯格宣布 Meta 推出 Muse Spark 1.1 代理模型,拥有 100 万 token 上下文,在 MCP Atlas、JobBench 等多项评估中声称排名第一,并推出 Meta 首个付费开发者 API。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?