AI预测心脏猝死生物标志物
Obermeyer团队在Nature发表研究,利用深度学习从心电图中发现隐藏的心脏猝死预测因子,为高危患者植入除颤器提供新的筛查工具。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
利用强化学习引导生成式AI模型探索化学设计空间,突破传统生成模型倾向于采样已知结构的局限,发现化学合理且结构多样的新型晶体材料,为功能材料发现提供系统性方法。
联合国AI治理全球对话今日在日内瓦启动,科学专家小组警告AI治理窗口正在关闭,呼吁各国立即建立有效的全球治理框架以应对技术快速演进。
Google四位顶级AI研究员在六天内离职,其中三人加入Anthropic、一人转投OpenAI,市场单日蒸发近2500亿美元市值,引发对Google AI竞争力的质疑。
Meta宣布裁员约8000人(占比10%),另有7000人转岗至AI团队,扎克伯格承认AI agent项目停滞四个月,股价当日下跌4.9%。
OpenAI提议向美国政府提供5%股权作为IPO战略一部分,这一前所未有的安排引发治理冲突担忧,监管方持有被监管公司股权的合规性受到质疑。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
联合国AI治理全球对话今日在日内瓦启动,科学专家小组警告AI治理窗口正在关闭,呼吁各国立即建立有效的全球治理框架以应对技术快速演进。
MAJOR
Google四位顶级AI研究员在六天内离职,其中三人加入Anthropic、一人转投OpenAI,市场单日蒸发近2500亿美元市值,引发对Google AI竞争力的质疑。
Meta宣布裁员约8000人(占比10%),另有7000人转岗至AI团队,扎克伯格承认AI agent项目停滞四个月,股价当日下跌4.9%。
OpenAI提议向美国政府提供5%股权作为IPO战略一部分,这一前所未有的安排引发治理冲突担忧,监管方持有被监管公司股权的合规性受到质疑。
Anthropic推出Claude Science工作台,为研究人员提供60+预配置工具,并宣布启动内部药物研发项目,聚焦被忽视的疾病,标志着从AI工具提供商向科研应用的战略转型。
Claude Fable 5解禁恢复全球访问(7月1日),美国商务部在19天出口管制后解除限制,Anthropic测试证明该模型无独特攻击能力,其他模型可复现相同漏洞。
Claude Sonnet 5正式发布(6月30日)成为所有免费和Pro用户的默认模型,在SWE-Bench Pro上得分63.2%,8月31日前限时定价每百万token输入$2/输出$10。
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Obermeyer团队在Nature发表研究,利用深度学习从心电图中发现隐藏的心脏猝死预测因子,为高危患者植入除颤器提供新的筛查工具。
Fry等人在Nature发表神经迭代选择扩展方法,实现蛋白质序列、结构和配体构象的同步优化,零样本设计与小分子结合的蛋白质,突破传统设计瓶颈。
Ames实验室开发物理训练模型DuctGPT,发现无需稀土元素的永磁体,该模型理解底层物理并可设计新材料,同时考虑生产成本和供应链安全。
Park等人在Nature Machine Intelligence发表研究,通过强化学习引导生成式AI模型探索化学空间,发现多样化新型晶体材料,克服传统生成模型的局限性。
Pearce等人在Science发表生成式基础模型TranscriptFormer,基于1.12亿细胞训练,跨越15亿年进化历史,实现跨物种转录程序的可比较分析。
Berner等人在Nature Machine Intelligence发表研究,将神经架构扩展至函数空间用于算子学习,为物理系统建模提供原则性方法,突破有限维表示限制。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
利用强化学习引导生成式AI模型探索化学设计空间,突破传统生成模型倾向于采样已知结构的局限,发现化学合理且结构多样的新型晶体材料,为功能材料发现提供系统性方法。
提出将神经架构扩展至函数空间的原则性方法用于算子学习,解决偏微分方程等科学问题,突破有限维表示限制,为物理系统建模和材料性质预测提供新的理论框架。
基于1.12亿细胞训练的生成式基础模型家族,跨越15.3亿年进化历史,实现跨物种转录程序比较,为理解细胞多样性和分子机制提供统一框架,推动跨物种生物学研究。
提出图原生强化学习框架,通过概念重组生成可追溯的材料科学假设,解决标准大语言模型难以追溯推理路径的问题,使AI系统能够进行多步骤、领域基础的材料设计推理。
提出NMO基准测试,将生成式分子设计从药物发现扩展到纳米技术领域,克服现有模型局限于药物数据集的问题,为结构上不同于药物的材料设计提供可迁移的评估框架。
利用自主LLM研究循环优化专家设计的晶体图神经网络,用于带隙预测任务,展示AI如何自动优化材料性质预测模型架构,在固定基准上实现性能提升。
引入LLM4MOF闭环框架,利用语言模型agent进行金属有机框架的可解释逆向设计,在组合空间巨大的情况下通过推理识别成功结构的原因,克服传统机器学习模型的黑箱限制。
开发溶剂条件机器学习隐式溶剂势,填补非水溶剂环境下分子模拟的空白,为化学合成、材料科学和催化等领域提供准确高效的溶剂效应建模工具。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | 92.5 | N/A | N/A | 最高综合质量指数100/100,顶级推理模型 |
| Claude Opus 4.8 | Anthropic | 91.3 | N/A | N/A | SWE-bench 80.8%,代码生成领先 |
| GPT-5 | OpenAI | 92.5 | N/A | N/A | MMLU排行榜领先,政府管控发布 |
| Gemini 3.1 Pro | N/A | N/A | N/A | GPQA Diamond 94.3%,ARC-AGI-2领先77.1% | |
| Claude Sonnet 5 | Anthropic | N/A | N/A | N/A | SWE-bench Pro 63.2%,性价比旗舰 |
| Qwen 3.5-plus | Alibaba | N/A | N/A | N/A | LiveCodeBench v6 83.6%,开源编码领先 |
| GLM-5.2 | Zhipu AI | N/A | N/A | N/A | SWE-bench Pro 62.1%,MIT开源可商用 |
行业领袖在想什么,说了什么
"建立国际论坛制定AI标准"
在G7峰会上呼吁建立国际论坛以制定全球AI测试标准,并为各国合作提供平台。OpenAI正准备历史性IPO,并提议向美国政府提供5%股权。
"民主国家应避免在AI部署上分裂"
在G7峰会上与Google DeepMind CEO共同呼吁美国领导制定AI国际规则。Anthropic年化营收达470亿美元,已超越OpenAI,并于7月1日推出Claude Sonnet 5。
"AI的目的是放大人类智慧而非取代"
在6月文章中警告不能让价值集中在少数AI模型中,强调需要避免权力集中。微软已向OpenAI和Anthropic分别投资超过130亿美元和50亿美元。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?