深度学习预测心脏骤停
Nature 发表研究,深度学习识别出心电图中隐藏的心脏骤停生物标志物,可提前预测患者风险,有望挽救数千生命。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
通过深度学习实现跨材料催化剂发现,模型能够在不同材料体系间迁移知识,加速新型催化剂设计并提升预测准确度。
Google DeepMind 诺贝尔奖得主 John Jumper 离职加入 Anthropic,加剧谷歌顶级 AI 人才流失危机。
OpenAI 联合 Broadcom 发布首款定制 AI 芯片 Jalapeño,瞄准 50% 成本削减的 LLM 推理服务。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
OpenAI 联合 Broadcom 发布首款定制 AI 芯片 Jalapeño,瞄准 50% 成本削减的 LLM 推理服务。
Google DeepMind 诺贝尔奖得主 John Jumper 离职加入 Anthropic,加剧谷歌顶级 AI 人才流失危机。
MAJOR
Anthropic 正式指控阿里巴巴对 Claude 进行 2880 万次欺诈性蒸馏调用,推动出口管制立法。
Google Gemini 2.5 Pro Deep Think 模式发布,GPQA Diamond 达 82.4%、MMLU-Pro 89.8%,领跑科学推理基准。
SpaceX 以 600 亿美元全股票收购 AI 编码助手 Cursor,创风投史最大收购记录。
Microsoft 在 Build 2026 发布 7 款 MAI 模型,包括 MAI-Thinking-1 推理模型与 MAI-Code-1-Flash 编码模型。
Anthropic 提交 S-1 IPO 文件,估值 9650 亿美元,年收入运行率达 470 亿美元,超越 OpenAI 估值。
美国五眼联盟发布《谨慎采纳 Agent AI 服务》指南,针对关键基础设施中的 AI Agent 安全风险。
阿姆斯实验室发布 DuctGPT,基于物理模型的 AI 工作流,发现无稀土永磁材料突破供应链瓶颈。
ChatGPT 市场份额首次跌破 50% 至 46.4%,Claude 增至 10.3%、Gemini 升至 27.7%,竞争白热化。
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Nature 发表研究,深度学习识别出心电图中隐藏的心脏骤停生物标志物,可提前预测患者风险,有望挽救数千生命。
Nature 报道神经迭代选择-扩展方法,无需训练数据即可优化蛋白序列、结构与配体构象,实现小分子结合蛋白从头设计。
UC San Diego 研究显示,结合生成方法与物理数据的 AI 模型,可将气候模拟速度提升约 25 倍,并加速钠电池材料筛选。
Nature Communications 发表脉冲神经网络从高密度肌内微电极阵列解码手指力量,为康复辅助技术提供低延迟、高精度方案。
深度学习系统 MycoBCP 检测结核菌细胞微妙变化,加速治疗药物筛选,展示 AI 在传染病研发中的应用潜力。
宾夕法尼亚大学研究人员创建混合光-物质粒子,可大幅提升 AI 计算速度并降低能耗,为未来 AI 芯片提供新路径。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
通过深度学习实现跨材料催化剂发现,模型能够在不同材料体系间迁移知识,加速新型催化剂设计并提升预测准确度。
神经迭代选择-扩展方法实现药物结合蛋白零样本设计,同时优化蛋白序列、结构与配体构象,突破传统小分子结合蛋白设计瓶颈。
机器学习势能函数建模跨成分合金,捕捉从化学计量化合物到完全无序固溶体的复杂化学排列,显著扩展材料性质预测范围。
溶剂条件机器学习隐式溶剂势能模型,超越水溶液局限,覆盖多种非水溶剂环境,提升分子模拟精度与适用性。
原子语言模型实现原子结构与自然语言原生多模态,可理解并生成材料结构,避免文本编码中原子信息损失。
大规模自回归预训练实现可控催化剂逆向设计,通过耦合表面-吸附物相互作用跨越广阔化学空间,提升非均相催化剂筛选效率。
量子力学与机器学习混合力场框架,兼顾化学精度与计算可扩展性,精准模拟溶质-位错相互作用,助力核工业材料演化研究。
机器学习势能函数刻画硅酸钠熔体动态异质性,通过均方位移与四点关联函数分析温度依赖行为,揭示材料微观动力学机制。
追踪流行词随半月周期的热度变化,并标出本期首次出现或显著冒头的新词。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | 91.8 | 88.5 | 95.0 | SWE-bench 95% 创历史新高 |
| Gemini 2.5 Pro | 89.8 | 91.2 | 91.5 | GPQA Diamond 82.4% 领跑科学推理 | |
| GPT-5.5 | OpenAI | 90.5 | 86.7 | 92.3 | MedChemBench 25.1% 生命科学优势 |
| Claude Opus 4.8 | Anthropic | 90.2 | 85.1 | 88.0 | SWE-bench 88% 前代旗舰 |
| Claude Mythos 5 | Anthropic | N/A | N/A | N/A | 长程自主任务专用,代码与网络能力顶级 |
| Gemini 3.1 Pro | 87.6 | 83.5 | 87.2 | 2月发布,已落后最新梯队 | |
| MAI-Thinking-1 | Microsoft | 88.3 | 84.0 | 89.5 | 与 Sonnet 4.6 相当,无蒸馏训练 |
行业领袖在想什么,说了什么
"AI 将大幅加速生物学与药物发现"
6月17日在法国 G7 峰会上呼吁建立美国主导的国际 AI 联盟,与 Sam Altman、Demis Hassabis 等共同讨论前沿 AI 风险与标准。
"呼吁建立全球标准检测论坛"
在 G7 峰会上提议建立国际讨论论坛,确立全球 AI 能力与风险测试标准。OpenAI 近期发布 GPT-5.5-Cyber 预览版及 Jalapeño 定制芯片。
"微软模型可超越 GPT-5.5 且成本降十倍"
6月2日在 Microsoft Build 大会上发布 7 款 MAI 自研模型,包括 MAI-Thinking-1 推理模型与 MAI-Code-1-Flash 代码模型,并推出 Frontier Tuning 企业定制训练。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?