系统在线 --:--:-- AI Progress Hub · v4.0
Top 3 今日 For Scientists 材料 趋势 模型 基准 GitHub 领袖 归档
AI Research Radar · 每日更新

AI Progress Hub

A daily radar for AI · AI4Science · Materials Discovery

Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.

4 条资讯
7 篇论文
3 位领袖
6 项进展
历史访客
LAST UPDATE 2026年7月23日
今日 Top 3
精选三条最重要进展
For Scientists
AI4Science 进展
材料发现
AI4Materials 论文
流行词趋势
半月热度变化
模型动态
最新发布与更新
基准测试
主流模型性能对比
领袖观点
行业重要声音
今日精选

今日 Top 3

编辑精选 · 最重要的三条

从今日资讯与论文中提炼出最値得关注的三项进展

01
Blog

白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型…

白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3,称其为针对美国专有技术的大规模秘密工业蒸馏,这是美国高官首次直接点名特定中国实验室

为何重要 重磅消息——对 AI 格局有显著影响
02
Paper Nature Computational Science

UniFFBench: evaluating universal machine learning force fields against experimental measurements

发布首个系统性基准 UniFFBench,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子动力学模拟提供标准化工具。该基准涵盖多种材料体系,推动 AI4Material 方法的验证与改进。

为何重要 发表于 Nature Computational Science,是本期 AI4Materials 精选论文
03
Paper Nature Computational Science

Local pseudopotentials accelerate neural network wavefunction simulations

展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,在保持精度的同时大幅降低计算成本。该方法为精确模拟复杂分子和材料的电子结构提供更高效的途径。

为何重要 发表于 Nature Computational Science,是本期 AI4Materials 精选论文
04
Unknown

Anthropic 第二季度游说支出达 197 万美元(环比增长 26%),超过…

Anthropic 第二季度游说支出达 197 万美元(环比增长 26%),超过英伟达并接近甲骨文,OpenAI 支出 120 万美元(增长 18%),AI 实验室总支出达 317 万美元

为何重要 値得关注的行业动态
05
Unknown

Google 发布 Gemini 3.6 Flash,这是截至 7 月 21 日…

Google 发布 Gemini 3.6 Flash,这是截至 7 月 21 日最新跟踪到的前沿模型发布

为何重要 値得关注的行业动态
今日资讯

今日大事

由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展

白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3 BREAKING

白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3

白宫指控中国 Moonshot AI 蒸馏 Anthropic Fable 模型开发 Kimi K3,称其为针对美国专有技术的大规模秘密工业蒸馏,这是美国高官首次直接点名特定中国实验室

UPDATE

Anthropic 第二季度游说支出达 197 万美元(环比增长 26%)

Anthropic 第二季度游说支出达 197 万美元(环比增长 26%),超过英伟达并接近甲骨文,OpenAI 支出 120 万美元(增长 18%),AI 实验室总支出达 317 万美元

BREAKING

Google 发布 Gemini 3.6 Flash

Google 发布 Gemini 3.6 Flash,这是截至 7 月 21 日最新跟踪到的前沿模型发布

OpenAI 发布 Presence 企业 AI 代理平台
BREAKING

OpenAI 发布 Presence 企业 AI 代理平台

OpenAI 发布 Presence 企业 AI 代理平台,用于部署客服、销售等语音和聊天代理,已在自有客服热线处理 75% 来电,7 月 22 日通过有限 GA 计划上线

科研前沿

For Scientists · AI×Science

精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型

强化学习控制量子纠错

Sivak 等人在 Nature 发表研究,利用强化学习优化量子纠错过程,这对构建稳定的量子计算机至关重要。该研究展示了 AI 在量子信息科学中的应用潜力。

深度学习预测心源性猝死

Obermeyer 团队利用深度学习从心电图数据中发现心源性猝死的生物标志物,能够识别出医生未能预测的高风险患者,可能每年挽救大量生命。该模型在检测方面比传统方法更准确。

零样本设计药物结合蛋白

Fry 等人开发神经迭代选择-扩展方法,实现零样本设计能够与小分子药物结合的蛋白质,同时优化蛋白质序列、结构和配体构象,为药物开发提供新工具。

AI 引导生成模型发现晶体

Park 等人在 Nature Machine Intelligence 发表研究,通过强化学习引导生成模型在巨大的组合设计空间中发现多样化的新型功能晶体材料,拓展材料发现的边界。

机器学习力场评估基准

Mannan 等人发布 UniFFBench 基准,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子模拟提供标准化工具,推动 AI4Science 方法的验证与改进。

局部赝势加速神经网络波函数

研究团队在 Nature Computational Science 展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,为精确模拟复杂分子体系提供更高效的计算方法。

论文精选

AI4Material 最新论文

材料科学 × 机器学习:从催化剂发现到晶体结构预测

🔬 Yang's Pick
Nature Machine Intelligence

Guiding generative models to uncover diverse and novel crystals via reinforcement learning

Park et al.

结合强化学习与生成式 AI 在巨大的晶体材料设计空间中发现多样化的新型功能材料。该方法通过引导采样策略,克服了生成模型倾向于采样已知结构的局限性,显著提升了材料发现的效率和多样性。

🔬 Yang's Pick精选理由:该论文对 AI 驱动材料发现具有重要方法论意义,值得优先阅读。
2026-07-06 阅读
Nature

Reinforcement learning control of quantum error correction

Sivak et al.

利用强化学习优化量子纠错控制策略,为构建容错量子计算机提供关键技术。该方法展示了 AI 在量子信息处理中的实际应用,有望加速量子计算的实用化进程。

2026-07-08 阅读
Nature

An ECG biomarker for sudden cardiac death discovered with deep learning

Obermeyer et al.

通过深度学习从心电图中发现心源性猝死的预测性生物标志物,填补了医生无法预测的风险缺口。该模型能够识别出需要植入除颤器的高风险患者,可能每年挽救数千生命。

2026-06-24 阅读
Nature

Zero-shot design of drug-binding proteins via neural iterative selection−expansion

Fry et al.

开发神经迭代选择-扩展方法,实现蛋白质序列、结构和配体构象的同时优化,零样本设计能够结合小分子药物的蛋白质。该方法克服了传统蛋白质设计中需要大量已知结构的限制,为药物靶点开发开辟新路径。

2026-06-24 阅读
Nature Machine Intelligence

Principled approaches for extending neural architectures to function spaces for operator learning

Berner et al.

提出将神经网络架构扩展到函数空间的原则性方法,用于算子学习以解决偏微分方程。该研究为 AI 求解复杂科学计算问题(如材料模拟、流体动力学等)提供理论基础和实用架构。

2026-07-03 阅读
Nature Computational Science

UniFFBench: evaluating universal machine learning force fields against experimental measurements

Mannan et al.

发布首个系统性基准 UniFFBench,对比通用机器学习力场与实验测量结果,为评估 AI 驱动的分子动力学模拟提供标准化工具。该基准涵盖多种材料体系,推动 AI4Material 方法的验证与改进。

2026-07-14 阅读
Nature Computational Science

Local pseudopotentials accelerate neural network wavefunction simulations

et al.

展示局部赝势如何显著加速基于神经网络的量子化学波函数模拟,在保持精度的同时大幅降低计算成本。该方法为精确模拟复杂分子和材料的电子结构提供更高效的途径。

2026-07-13 阅读
模型动态

本周模型动态

当前主流大模型一览,持续跟踪能力边界

OAI OpenAI Presence A
X 热议:OpenAI 正式进军企业级代理市场,与 Salesforce 和 ServiceNow 直接竞争
ANT Claude Sonnet 5 A
X 热议:Sonnet 5 成为 Free 和 Pro 用户新默认模型,价格更低性能更强
OAI GPT-5.6 (Sol/Terra/Luna) S
X 热议:首个政府管理访问清单的前沿模型发布,Sol 在 OSWorld 基准创纪录
META Muse Spark 1.1 S
X 热议:Meta 首个付费开发者 API,声称在多项代理评估中排名第一
SXAI Grok 4.5 A
X 热议:用真实 Cursor 代理交互数据训练,效率优先架构但爆出训练污染问题
GOOG Gemini 3.6 Flash B
X 热议:Google 最新追踪模型,强调速度和成本优势
基准速查

模型基准速查

每日更新

关键基准横向对比,数字不说谎

模型 机构 MMLU MATH HumanEval 亮点
Claude Sonnet 4.5 Anthropic N/A N/A 97.6 HumanEval 排行榜第一(截至 7 月 21 日)
Claude Fable 5 Anthropic N/A N/A N/A 7 月 1 日恢复全球访问,新增安全分类器
GPT-5.6 Sol OpenAI N/A N/A N/A OSWorld 基准创纪录,高端推理和编码
Gemini 3.1 Pro Google 94.3 N/A N/A GPQA Diamond 94.3%,SWE-Bench 80.6%
DeepSeek V4 DeepSeek N/A N/A N/A SWE-bench Verified 81%,自研推理芯片
Claude Opus 4.7 Anthropic N/A N/A N/A GPQA Diamond 94.2%,100 万上下文
Muse Spark 1.1 Meta N/A N/A N/A 声称 MCP Atlas、JobBench 等多项评估第一
会议雷达

会议截稿日历

大佬观点

领袖观点

行业领袖在想什么,说了什么

德米斯·哈萨比斯 (Demis Hassabis)
Google DeepMind CEO
"AGI 可能在五年内到来"

哈萨比斯呼吁建立国际监管机构和美国主导的联盟来审查前沿模型,警告通用人工智能可能在五年内到来。他的提议获得了包括 OpenAI 和微软竞争对手在内的多方支持,成为行业统一的声音。

政策AGI监管7月15日
达里奥·阿莫代伊 (Dario Amodei)
Anthropic CEO
"用 AI 将生命科学研发周期压缩 10 倍"

阿莫代伊宣布 Anthropic 通过收购计算生物学初创公司和聘请 AlphaFold 团队领导者 John Jumper,推进 AI 在生命科学领域的应用,目标是大幅压缩研发周期。Anthropic 在 2026 年上半年营收预计达到 470 亿美元。

生物企业7月初
马克·扎克伯格 (Mark Zuckerberg)
Meta CEO
"Muse Spark 在代理评估中领先"

扎克伯格宣布 Meta 推出 Muse Spark 1.1 代理模型,拥有 100 万 token 上下文,在 MCP Atlas、JobBench 等多项评估中声称排名第一,并推出 Meta 首个付费开发者 API。

多模态Agent7月中旬

⌨️ Keyboard Shortcuts

下一条新闻
J /
上一条新闻
K /
收藏当前条目B
打开原文链接O
切换深色模式D
切换列表/卡片模式V
搜索/
显示/隐藏快捷键?