量子纠错强化学习控制
Nature发表Sivak团队论文,利用强化学习实现量子纠错的实时控制,为容错量子计算开辟新路径,展示AI在量子系统中的控制能力。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
OpenAI、Anthropic、DeepMind超1000名员工联名声明,要求美国政府建立工具以"有意放缓"前沿AI自动化开发,这是行业首次大规模呼吁主动减速
谷歌DeepMind发布Gemini Robotics 2三模型套件,包括全身人形机器人控制模型、多步规划协作模型和几小时内适应新机器人的设备端变体
欧盟正式启动AI超级工厂招标,投入100亿欧元公共资金,目标300亿欧元总投资,建设7座各容纳10万AI芯片的设施,11月12日截标
中国实施全球首个专门针对AI智能体的约束性监管框架《智能体规范应用与创新发展实施意见》,建立分级决策授权体系,禁止未成年人使用虚拟伴侣服务
Nscale以16.5亿美元收购Anyscale(Ray框架商业化公司),承诺加入PyTorch基金会支持开源治理,预计2026年下半年完成交易
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
谷歌DeepMind发布Gemini Robotics 2三模型套件,包括全身人形机器人控制模型、多步规划协作模型和几小时内适应新机器人的设备端变体
欧盟正式启动AI超级工厂招标,投入100亿欧元公共资金,目标300亿欧元总投资,建设7座各容纳10万AI芯片的设施,11月12日截标
Nscale以16.5亿美元收购Anyscale(Ray框架商业化公司),承诺加入PyTorch基金会支持开源治理,预计2026年下半年完成交易
OpenAI、Anthropic、DeepMind超1000名员工联名声明,要求美国政府建立工具以"有意放缓"前沿AI自动化开发,这是行业首次大规模呼吁主动减速
中国实施全球首个专门针对AI智能体的约束性监管框架《智能体规范应用与创新发展实施意见》,建立分级决策授权体系,禁止未成年人使用虚拟伴侣服务
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Nature发表Sivak团队论文,利用强化学习实现量子纠错的实时控制,为容错量子计算开辟新路径,展示AI在量子系统中的控制能力。
研究人员开发AI驱动框架,通过分析Ia型超新星图像并以前所未有的细节建模其环境,可大幅提升宇宙距离测量精度,有望揭示暗能量奥秘。
科学家开发可编程DNA机器人,能够递送药物、追踪病毒并构建分子尺度设备,结合传统机器人学理念,为精准医疗提供纳米级解决方案。
SpaceX提出在轨建设AI数据中心以应对算力需求激增,轨道设施可获取充足太阳能并避免地球环境挑战,但技术可行性仍待验证。
研究人员推出革命性AI方法,在提升准确性的同时将能耗降低100倍,解决AI已消耗美国超10%电力且需求持续加速的能源危机。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
利用强化学习引导生成模型探索晶体材料设计空间,在化学合理性基础上发现多样化的新型晶体结构,为功能材料发现提供高效筛选路径,解决传统方法难以覆盖的组合爆炸挑战。
提出用于信息超材料设计的生成模型,通过AI自动化设计具有特定电磁响应特性的超材料结构,加速从概念到原型的开发周期,为光电子器件和通信技术开辟新路径。
构建UniFFBench基准测试框架,首次系统性地将通用机器学习力场与实验测量对比验证,评估力场在真实材料体系中的预测准确性,推动AI力场从理论走向实际应用。
将局域赝势加速技术整合到神经网络量子蒙特卡罗中,显著降低分子电子结构计算成本,使神经网络波函数方法在实际化学体系中更具实用性。
提出集成机器学习框架用于光催化剂的计算发现,耦合强化学习应对多参数光催化行为的高计算成本和稀疏实验数据,为环境修复和CO₂转化提供理性设计工具。
提出催化剂扩散Transformer,实现异相催化剂的生成式逆向设计,可基于目标性质条件生成催化剂结构,克服传统方法受限于单一性质调控的局限,加速多目标催化剂发现。
ATLAS是首个针对非晶材料的基础神经网络采样器,在玻璃转变温度以下克服传统分子动力学依赖罕见屏障跨越的低效问题,高效探索非晶材料的崎岖能量景观。
提出扰动增强空间群结构采样方法,针对铁-氧体系结构与磁性复杂性,构建代表性第一性原理数据集,训练出可迁移的机器学习原子间势,实现对铁氧化过程的准确原子尺度建模。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| GPT-5 | OpenAI | 92.5 | N/A | N/A | MMLU榜单领先,但公开基准数据有限 |
| Claude Fable 5 | Anthropic | N/A | N/A | N/A | 综合质量指数100/100,SWE-bench Verified 95.0%领跑 |
| Claude Opus 5 | Anthropic | N/A | N/A | N/A | 智能指数61,代理指数55.3双榜第一,价格仅Fable 5一半 |
| GPT-5.5 (Spud) | OpenAI | N/A | 51.7 | 82.7 | Terminal-Bench 2.0达82.7%,FrontierMath Tier 1-3为51.7% |
| Claude Opus 4.8 | Anthropic | N/A | N/A | N/A | SWE-bench Verified 88.6%,编码能力强劲 |
| Gemini 3.1 Pro | N/A | N/A | N/A | SWE-bench约80%,但Gemini 3.5 Pro连续第三次错过目标 | |
| Grok 4.5 | xAI | N/A | N/A | N/A | Opus级性能,实时与编码优化,更低成本 |
过去 24 小时在 GitHub 上获得最多 Star 的五个开源项目
Reverse Engineering / Authorized Penetration Testing / Security Research Skill Router Pack AI-powered routing + On-demand toolchain bootstrapping + Self-evolving knowledge base Supports Claude Code, K
The open-source alternative to Claude Cowork (powered by opencode)
AI agent skill that researches any topic across Reddit, X, YouTube, HN, Polymarket, and the web - then synthesizes a grounded summary
A curated list of awesome libraries, packages, strategies, books, blogs, tutorials for systematic trading.
12 Weeks, 24 Lessons, AI for All!
行业领袖在想什么,说了什么
"我们已经身处奇点之中"
7月25日奥特曼在播客中表示我们已进入技术奇点,引发业界广泛讨论。这一言论与DeepMind和xAI领袖观点形成有趣对比。
"AI将在2027年前达到诺奖级能力"
Anthropic CEO预测AI将在2026年底至2027年初在大多数学科达到或超越诺贝尔奖得主水平,并与OpenAI、谷歌领导人共同呼吁政府监管前沿AI。
"这次真的不一样,AI是工业驱动"
黄仁勋7月24日首次在X平台发文力挺开源AI模型,7月25日接受采访时表示芯片繁荣不会很快破灭,因为这是由计算基础技术变革驱动的工业革命。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?