强化学习控制量子纠错
Nature 7月8日刊文,Sivak团队展示强化学习方法在量子纠错实时控制中的应用,为容错量子计算提供新路径。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
开发生成式基础模型TranscriptFormer,在1.12亿细胞、跨15.3亿年进化的单细胞转录组数据上训练,实现跨物种细胞类型比较与转录程序推断,为进化生物学与比较基因组学提供AI工具。
OpenAI发布GPT-5.6 Sol、Terra、Luna三款模型,这是AI史上首次三家前沿实验室同日公开发布新旗舰模型(OpenAI、xAI、Anthropic)
xAI公开发布Grok 4.5,马斯克称其达到Opus级性能但更快、更低成本;SuperGrok Heavy订阅用户与xAI API用户可访问
中国计划允许阿里巴巴、字节跳动、DeepSeek等顶级AI公司限量采购英伟达H200芯片,总量或不足20万片;NVIDIA股价当日上涨3.7%
将强化学习应用于量子纠错的实时控制,通过自适应策略优化量子比特状态保持,为容错量子计算提供了新的控制范式,展示AI在量子信息科学中的决策能力。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
OpenAI发布GPT-5.6 Sol、Terra、Luna三款模型,这是AI史上首次三家前沿实验室同日公开发布新旗舰模型(OpenAI、xAI、Anthropic)
BREAKING
xAI公开发布Grok 4.5,马斯克称其达到Opus级性能但更快、更低成本;SuperGrok Heavy订阅用户与xAI API用户可访问
中国计划允许阿里巴巴、字节跳动、DeepSeek等顶级AI公司限量采购英伟达H200芯片,总量或不足20万片;NVIDIA股价当日上涨3.7%
Anthropic Claude Sonnet 5以$2/$10推出推广价(至8月31日),成为新的Pro默认模型,SWE-bench Pro得分63.2%逼近Opus 4.8
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Nature 7月8日刊文,Sivak团队展示强化学习方法在量子纠错实时控制中的应用,为容错量子计算提供新路径。
Nature 6月24日发表Obermeyer团队研究,通过深度学习从ECG信号中识别出心脏猝死新生物标志物,可提前预测风险并部署除颤器。
Nature 6月24日Fry等人论文,利用神经迭代选择-扩展方法实现零样本蛋白设计,可同步优化蛋白序列、结构与配体构象,突破小分子结合蛋白设计瓶颈。
Nature Machine Intelligence 7月6日Park团队论文,通过强化学习引导晶体生成模型探索多样性与新颖性,加速功能性材料发现。
Nature Communications 7月7日Markakis等人提出ARCADIAMP平台,耦合扩散建模与虚拟筛选,发现强效低毒抗菌肽,应对多重耐药菌威胁。
Science 7月2日Pearce等人开发基础模型TranscriptFormer,在1.12亿细胞、跨15.3亿年进化历史的数据上训练,实现跨物种转录组程序比较。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
开发生成式基础模型TranscriptFormer,在1.12亿细胞、跨15.3亿年进化的单细胞转录组数据上训练,实现跨物种细胞类型比较与转录程序推断,为进化生物学与比较基因组学提供AI工具。
将强化学习应用于量子纠错的实时控制,通过自适应策略优化量子比特状态保持,为容错量子计算提供了新的控制范式,展示AI在量子信息科学中的决策能力。
结合强化学习与生成式AI,引导晶体生成模型在化学空间中探索多样性与新颖性区域,解决传统生成模型易陷入已知结构的问题,加速功能性晶体材料的自主发现。
提出ARCADIAMP平台,利用扩散生成模型与迭代学习筛选流程,设计并验证强效低毒抗菌肽。该方法在应对多重耐药细菌危机中具有重要应用价值,展示AI在药物分子设计中的生成与优化能力。
针对MACE-MP、UMA等基础力场无法原生处理外部电荷扰动问题,提出EquiFiLM方法,通过特征线性调制实现电荷条件下的等变力场预测,扩展ML力场在非平衡态化学与电化学中的应用。
首个支持全原子、显式溶剂、周期性边界条件的生成模型,从玻尔兹曼分布生成分子构象,计算成本仅为分子动力学模拟的一小部分,可扩展至数千原子规模,推动生成式AI在统计力学中的应用。
系统评估SOAP、Muon等新型优化器在机器学习原子间势训练中的表现,证明相比Adam默认选择可显著提升标签效率与收敛速度,为MLIP训练提供优化器选择新范式。
提出统一框架整合化学、自旋、结构无序度,用于预测无序磁性合金的热力学性质。该方法结合多尺度机器学习,突破传统计算框架无法同时处理多自由度耦合的瓶颈,适用于复杂材料体系。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | N/A | N/A | N/A | 7月9日刚发布,独立基准测试尚未公布 |
| Claude Opus 4.8 | Anthropic | 91.3 | N/A | 89.2 | 当前综合排名第一,Humanity's Last Exam 64.7% |
| Claude Fable 5 | Anthropic | N/A | N/A | N/A | SWE-bench Pro 80.3%,编码能力顶尖 |
| Gemini 3.1 Pro | N/A | N/A | N/A | GPQA Diamond 94.3%,ARC-AGI-2 77.1%,推理领先 | |
| GPT-5.5 | OpenAI | N/A | N/A | 88.6 | FrontierMath Tier 4 39.6%,日常默认模型 |
| Grok 4.5 | xAI | N/A | N/A | N/A | 7月9日发布,自称Opus级但无独立验证 |
| Claude Sonnet 5 | Anthropic | N/A | N/A | N/A | 性价比首选,近Opus表现,推广价$2/$10 |
过去 24 小时在 GitHub 上获得最多 Star 的五个开源项目
AI-powered job application framework built on Claude Code. Fork it, fill in your profile, and let Claude evaluate jobs, tailor CVs, write cover letters, and prepare you for interviews.
Source code for Unturned, a free open-world zombie survival sandbox game.
Production-grade engineering skills for AI coding agents.
A collection of DESIGN.md files analysis by popular brand design systems. Drop one into your project and let coding agents generate a matching UI.
OfficeCLI is the first and best Office suite purpose-built for AI agents to read, edit, and automate Word, Excel, and PowerPoint files. Free, open-source, single binary, no Office installation require
行业领袖在想什么,说了什么
"我们需要美国主导的国际AI联盟"
6月在G7峰会上,阿莫代伊与Demis Hassabis共同呼吁建立美国主导的AI标准与规则联盟。Anthropic在5月宣布年化收入达470亿美元,已超越OpenAI。
"需要全球公认的AI测试标准国际论坛"
奥特曼在G7峰会上呼吁建立国际论坛以制定测试标准、风险分析与国家合作框架。OpenAI已向美政府提议授予5%股权,7月9日正式公开发布GPT-5.6系列。
"离开DeepMind九年,加入Anthropic"
AlphaFold首席设计师朱姆珀6月19日宣布离开Google DeepMind转投Anthropic,加入后者新成立的Claude Science科学研究部门,专注AI驱动的蛋白质与药物发现。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?