量子纠错强化学习突破
Nature 发表 Sivak 等人工作,利用强化学习控制量子纠错,为量子计算实用化提供新方法。该研究展示了 AI 在量子系统控制中的应用潜力。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
利用强化学习引导深度生成模型在巨大的晶体结构空间中进行高效探索,系统性地发现化学合理且功能导向的新型晶体材料。该方法克服了传统生成模型仅靠预训练数据分布产生结构的局限,为材料发现提供了可解释的、多样化的设计路径。
NVIDIA 与日本政府、Noetra 公司宣布建设全球首个国家级 AI 基础设施,部署 13,750 个 Vera CPU 和 27,500 个 Rubin GPU,支持日本 FRONTia 多模态基础模型项目
Anthropic、Blackstone 和 Hellman & Friedman 正式推出 Ode with Anthropic,这是一家价值 15 亿美元的 AI 实施服务公司,帮助企业部署 AI 代理和集成系统
Future of Life Institute 发布 2026 AI 安全指数,Anthropic 获最高等级 C+,OpenAI 和 DeepMind 获 C,Meta 获 D+,xAI、DeepSeek 和 Mistral 不及格
200+ 经济学家和 AI 研究者(含16位诺奖得主)7月13日发表斯坦福公开信"We Must Act Now",警告 AI 可能在10年内以比工业革命更快的速度重塑经济,呼吁立即建立治理框架
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
NVIDIA 与日本政府、Noetra 公司宣布建设全球首个国家级 AI 基础设施,部署 13,750 个 Vera CPU 和 27,500 个 Rubin GPU,支持日本 FRONTia 多模态基础模型项目
MAJOR
Anthropic、Blackstone 和 Hellman & Friedman 正式推出 Ode with Anthropic,这是一家价值 15 亿美元的 AI 实施服务公司,帮助企业部署 AI 代理和集成系统
Future of Life Institute 发布 2026 AI 安全指数,Anthropic 获最高等级 C+,OpenAI 和 DeepMind 获 C,Meta 获 D+,xAI、DeepSeek 和 Mistral 不及格
IBM 警告称 AI 基础设施支出正在改变企业技术预算分配,导致第二季度收入和利润低于预期,传统软件厂商面临预算竞争压力
200+ 经济学家和 AI 研究者(含16位诺奖得主)7月13日发表斯坦福公开信"We Must Act Now",警告 AI 可能在10年内以比工业革命更快的速度重塑经济,呼吁立即建立治理框架
Sam Altman 警告 GPT-5.6 Sol 因需求激增可能面临扩展性问题,表示"可能很快会有一些小故障",但 OpenAI 将全力确保扩展能力
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Nature 发表 Sivak 等人工作,利用强化学习控制量子纠错,为量子计算实用化提供新方法。该研究展示了 AI 在量子系统控制中的应用潜力。
Nature 报道 Obermeyer 团队用深度学习从 ECG 数据发现心脏骤停预测新生物标志物,可提前识别高风险患者,为植入除颤器决策提供依据。
Nature 刊登 Fry 等人研究,提出基于神经网络的迭代选择-扩展方法(neural iterative selection-expansion),实现零样本设计与小分子结合的蛋白质,克服了传统方法需同时优化序列、结构和配体构象的难题。
Nature Machine Intelligence 报道 Park 等人利用强化学习引导生成模型发现多样化新型晶体材料,克服了传统生成模型仅产生化学合理但缺乏功能导向的结构的局限。
Nature Computational Science 发布 UniFFBench,首个针对通用机器学习力场的实验测量基准,由 Mannan 等人构建,用于评估 AI 力场在真实材料预测中的准确性。
6月底 ScienceDaily 报道,新 AI 框架通过分析 Ia 型超新星图像并精细建模其环境,可前所未有地精确估算宇宙距离,有望揭示暗能量秘密,改变天文学家测量宇宙膨胀的方式。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
利用强化学习引导深度生成模型在巨大的晶体结构空间中进行高效探索,系统性地发现化学合理且功能导向的新型晶体材料。该方法克服了传统生成模型仅靠预训练数据分布产生结构的局限,为材料发现提供了可解释的、多样化的设计路径。
构建首个针对通用机器学习原子间力场的实验测量基准,系统评估 AI 力场在预测真实材料性质(如弹性模量、晶格参数)时的准确性,为 AI4材料模型的实用化提供可靠验证框架。
将局域赝势集成到神经网络波函数量子蒙特卡罗方法中,显著加速电子结构计算,使神经网络 QMC 能够处理更大规模的分子和材料体系,推进 AI 辅助量子化学模拟。
提出生成式 AI 模型用于信息超材料设计,自动生成具有特定电磁响应的超材料结构,为通信、传感器和雷达隐身等应用提供高效设计工具。
提出对比表示学习方法 CatRetriever,解决催化剂生成模型中表面-体相结构匹配问题。该方法通过学习表面吸附结构与体相材料的嵌入空间,加速催化剂逆向设计流程,为 AI 驱动的催化剂发现提供高效检索工具。
系统研究 SO(2) 理论在机器学习原子间势中的应用,识别传统 SO(2) 架构相对于 SO(3) Clebsch-Gordan 张量积的局限性,并提出直接笛卡尔坐标方法结合径向旋转注意力,改进原子势的精度与效率。
开发电荷条件等变力场 EquiFiLM,通过特征线性调制处理外部电荷诱导的电子态变化。弥补了基础机器学习力场(如 MACE-MP-0)仅适用平衡态物理的局限,使 AI 力场能模拟带电体系和非平衡过程。
提出 AquaGen,首个全原子显式溶剂、周期边界条件感知的生成模型,直接从 Boltzmann 分布生成分子构象,成本仅为分子动力学模拟的一小部分。突破了现有生成模型去除细节的限制,将生成模型扩展到数千原子规模的精确分子动力学应用。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | 92.5 | N/A | 97.0 | 综合质量评分 100/100,领跑 7月排行榜 |
| GPT-5 | OpenAI | 92.5 | N/A | N/A | MMLU 与 Fable 5 并列第一 |
| Claude Sonnet 4.5 | Anthropic | N/A | N/A | 97.6 | HumanEval 排行榜第一,编码能力最强 |
| GPT-5.6 Sol | OpenAI | N/A | N/A | N/A | ARC-AGI-3 得分 7.8%,代理任务效率领先 |
| Gemini Deep Think | N/A | N/A | N/A | IMO 金牌,但模拟时钟识别仅 50.1% | |
| R1 | DeepSeek | N/A | N/A | 97.4 | 推理模型,HumanEval 第二 |
| Llama 5 | Meta | N/A | N/A | N/A | 开源模型,7月新发布 |
过去 24 小时在 GitHub 上获得最多 Star 的五个开源项目
👩🏿💻👨🏾💻👩🏼💻👨🏽💻👩🏻💻中国独立开发者项目列表 -- 分享大家都在做什么
Apache Ossie, industry wide specification effort to standardize how we exchange semantic metadata across analytics, AI and BI platforms, providing a vendor neutral, single source of truth for semantic
Anti-AI-slop design skill for Claude Code, Cursor, and Codex.
The open-source CapCut alternative
🦔 PostHog is an all-in-one developer platform for building successful products. We offer product analytics, web analytics, session replay, error tracking, feature flags, experimentation, surveys, data
行业领袖在想什么,说了什么
"GPT-5.6 是目前世界上最好的模型"
7月9日接受CNBC采访时表示,OpenAI在与特朗普政府讨论过程中对模型做了"许多改变",新模型在代理任务上的效率比竞争对手高54%。
"这是日本 AI 的幕开けだ"
7月15日来日宣布与日本政府及产业界合作建设全球首个国家级 AI 基础设施,部署27,500个 Rubin GPU 用于物理 AI 和机器人应用。
"AI 能力超越了科学理解和政府应对能力"
7月6日在日内瓦联合国全球 AI 治理对话会上警告,AI 正在接近或超越人类能力,但缺乏足够的科学理解和安全保障机制。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?