强化学习首次控制量子纠错
Nature论文展示使用RL控制量子比特纠错系统,实现比传统方法更高的容错率,为可扩展量子计算开辟新路径。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
使用强化学习引导生成式AI模型探索晶体材料空间,在保证化学合理性前提下发现多样化新型晶体结构,突破传统基于已知数据训练的局限,为功能材料发现提供新范式。
中国月之暗面发布Kimi K3,首个3万亿参数开源模型,性能接近Claude Fable 5,引发美股科技板块暴跌,纳指跌1.4%,台股跌超6%
习近平宣布29国在上海签署协议成立世界人工智能合作组织(WAICO),包括俄罗斯、巴西、巴基斯坦等,联合国秘书长古特雷斯出席
提出首个针对通用机器学习力场的实验验证基准UniFFBench,对比MACE-MP-0、UMA等前沿力场模型与真实测量数据,为材料模拟AI建立可信评估标准。
将局部赝势集成到神经网络波函数量子蒙特卡罗中,大幅加速材料电子结构计算,使神经网络QMC方法在材料科学中更加实用。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
中国月之暗面发布Kimi K3,首个3万亿参数开源模型,性能接近Claude Fable 5,引发美股科技板块暴跌,纳指跌1.4%,台股跌超6%
MAJOR
习近平宣布29国在上海签署协议成立世界人工智能合作组织(WAICO),包括俄罗斯、巴西、巴基斯坦等,联合国秘书长古特雷斯出席
美国旧金山爆发最大规模反AI开发抗议,100-350人游行至OpenAI、Anthropic和Google办公室,要求暂停前沿AI开发
TSMC发布Q2财报利润同比激增77.4%至220亿美元,宣布亚利桑那州再投1000亿美元,AI芯片营收占比达66%,全年收入指引上调至40%+增长
Google第三次推迟Gemini 3.5 Pro发布,内部因性能缺陷探索推出Gemini 3.6 Flash过渡版本
OpenAI、Anthropic、Google DeepMind三家CEO首次在书面文件上就AI监管框架达成共识,均支持独立第三方测试、统一监管体系及美国主导国际标准
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Nature论文展示使用RL控制量子比特纠错系统,实现比传统方法更高的容错率,为可扩展量子计算开辟新路径。
Nature研究利用深度学习从心电图数据中识别出新的猝死风险生物标志物,有望提前部署除颤器挽救生命。
Nature论文提出零样本神经迭代选择扩展方法,同时优化蛋白序列、结构和配体构象设计药物结合蛋白,突破传统深度学习局限。
Nature Computational Science报道深圳大学开发全光纤光子AI平台,使用黑磷可调谐器件处理医学影像,诊断速度比GPU快246倍。
加州大学圣迭戈分校结合生成AI与物理数据,提供比现有方法快25倍的气候预测模型,无需大型超算即可运行。
美国Ames实验室使用物理训练AI模型DuctGPT发现无稀土永磁体,理解底层物理并考虑生产成本,降低对中国稀土依赖。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
使用强化学习引导生成式AI模型探索晶体材料空间,在保证化学合理性前提下发现多样化新型晶体结构,突破传统基于已知数据训练的局限,为功能材料发现提供新范式。
提出首个针对通用机器学习力场的实验验证基准UniFFBench,对比MACE-MP-0、UMA等前沿力场模型与真实测量数据,为材料模拟AI建立可信评估标准。
将局部赝势集成到神经网络波函数量子蒙特卡罗中,大幅加速材料电子结构计算,使神经网络QMC方法在材料科学中更加实用。
开发生成式AI模型用于信息超材料逆向设计,自动生成满足目标电磁响应的超材料结构,为功能材料设计提供高效工具。
提出对比学习方法CatRetriever,从催化剂表面-吸附物生成模型的输出中检索对应的体相材料,解决生成式催化剂发现中的逆向设计问题,提升异质催化剂发现效率。
提出主动学习策略减少机器学习力场训练所需的标注数据量,使用模型委员会不确定性估计,在保持全数据精度前提下显著降低DFT计算成本,加速材料模拟MLFF构建。
系统研究SO(2)理论在机器学习原子间势中的应用,识别传统SO(2)线性架构相对SO(3) Clebsch-Gordan张量积的局限,提出径向旋转注意力机制的边簇扩展方法改进MLIP性能。
提出电荷条件化等变力场EquiFiLM,通过特征线性调制处理外部电荷诱导的电子态变化,扩展MACE-MP-0等基础力场对非平衡态材料体系的适用性。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Qwen3.7 Max | 阿里云 | 93.7 | N/A | N/A | MMLU和MMLU-Pro双榜首,闭源API限定 |
| GPT-5 | OpenAI | 93.5 | N/A | N/A | MMLU第二,o3推理模型变体 |
| Claude Opus 4.8 | Anthropic | 91.2 | N/A | N/A | MMLU-Pro 89.5%,SWE-Bench Pro 69.2%代码能力突出 |
| Gemini 3 Pro Preview | 90.1 | N/A | N/A | MMLU-Pro领先89.8%,GPQA Diamond 94.3%并列第一 | |
| Claude Fable 5 | Anthropic | 91.8 | N/A | N/A | 7月1日解禁回归,综合能力最强公开模型 |
| DeepSeek V4 Pro | DeepSeek | 89.0 | N/A | N/A | MIT许可开源,性价比之王 |
| Grok 4.20 | SpaceXAI | N/A | N/A | N/A | Humanity's Last Exam 50.7%领先,实时X数据集成 |
过去 24 小时在 GitHub 上获得最多 Star 的五个开源项目
A feed-forward 3D foundation model for reconstructing scenes from streaming data
Apache Ossie, industry wide specification effort to standardize how we exchange semantic metadata across analytics, AI and BI platforms, providing a vendor neutral, single source of truth for semantic
🦔 PostHog is the leading platform for building self-driving products. Our developer tools – AI observability, analytics, session replay, flags, experiments, error tracking, logs, and more – capture al
Skills for Design Engineers
Learn it. Build it. Ship it for others.
行业领袖在想什么,说了什么
"AI能力进步远超我们对经济影响的理解"
7月13日联合200多位经济学家和AI研究者发表公开信,警告AI可能在十年内引发比工业革命更大的经济转型,呼吁立即构建政策框架以确保AI普惠社会。
"AGI可能在五年内到来需要安全防护"
7月16日发表监管框架提案,呼吁建立国际监督机构和美国主导联盟对前沿模型进行审查,获得Altman、Nadella及马斯克罕见公开支持。
"AI发展应是全球交响而非单一独奏"
7月17日在上海世界人工智能大会发表主旨演讲,反对以国家安全为由限制AI技术,宣布29国成立世界人工智能合作组织(WAICO),推动中国在全球AI治理中的话语权。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?