AI 在等离子体中发现新物理
Emory 大学团队使用物理定制的机器学习在尘埃等离子体(第四态物质)中发现了意外的物理现象,研究发表于 PNAS 2025年。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
MatterChat 是一个有效整合材料结构数据与大语言模型的多模态框架,实现高精度属性预测并提供可解释推理以加速材料发现。论文于2026年4月发表。
Google I/O 2026 将于5月19日揭晓 Gemini 4.0 及 agentic coding 更新,同时发布 Android XR 眼镜与多项 AI 工具
OpenAI 与 Dell 合作将 Codex 引入混合云和本地企业环境,并于5月15日推出 ChatGPT 个人财务体验功能
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
Google I/O 2026 将于5月19日揭晓 Gemini 4.0 及 agentic coding 更新,同时发布 Android XR 眼镜与多项 AI 工具
OpenAI 与 Dell 合作将 Codex 引入混合云和本地企业环境,并于5月15日推出 ChatGPT 个人财务体验功能
Anthropic Claude Mythos 通过 Project Glasswing 向 AWS、Apple、Cisco 等机构开放,数周内发现数千个零日漏洞
Meta Avocado 模型延期至6月发布,内部测试显示性能介于 Gemini 2.5 与 3.0 之间,低于 GPT-5.5 和 Claude Opus 4.7
Anthropic 正在谈判 900 亿美元估值的 300 亿美元融资,Q1 年化收入超 440 亿美元(同比增长80倍)
美国政府推动 AI 模型上市前测试制度,Microsoft 和 xAI 等公司同意向监管机构提供早期访问权限
IBM 报告显示 76% 企业已设立首席AI官(CAIO)职位,较2025年的26%大幅提升
OpenAI 推出自助广告管理平台,目标今年实现25亿美元、2030年实现1000亿美元广告收入
Snap 与 Perplexity 终止 4 亿美元 AI 合作伙伴关系,同时裁员16%以进行 AI 重组
arXiv 宣布禁止明显由 AI 生成的论文,提交者将被禁止投稿一年,并不再接受计算机科学综述和立场论文
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
Emory 大学团队使用物理定制的机器学习在尘埃等离子体(第四态物质)中发现了意外的物理现象,研究发表于 PNAS 2025年。
新 AI 系统 Synthegy 允许化学家用自然语言指导合成与反应规划,强大算法可自动生成复杂分子合成路径,大幅降低化学设计门槛。
Google DeepMind 已将 AI 应用于核聚变控制,并与 EVE Online 合作在游戏复杂环境中测试 AI 算法,推动科学 AI 应用边界。
Google DeepMind 团队通过 AI 筛选超3200万候选材料,预测约50万种潜在稳定材料,并为电池固态电解质应用验证了18种新组成材料。
加州大学圣地亚哥分校开发的新型芯片设计通过压电元件与创新电路布局,可大幅提高数据中心能源效率,解决 GPU 功耗瓶颈。
研究人员开发的 DNA 机器人系统可在人体内递送药物并捕获病毒,标志着纳米医疗技术的重大突破。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
MatterChat 是一个有效整合材料结构数据与大语言模型的多模态框架,实现高精度属性预测并提供可解释推理以加速材料发现。论文于2026年4月发表。
研究展示如何使用 LLM 从材料科学摘要构建语义概念图,并训练 ML 模型从历史数据预测新兴主题组合,帮助专家发现研究灵感。
TrajCast 神经网络绕过力计算直接预测原子轨迹,使时间步长提高30倍,同时准确再现分子和材料的物理性质,发表于5月5日。
LLaMat 是专为材料科学设计的语言模型系列,基于数百万材料论文训练,在关键科学任务上超越商业通用 AI 系统,展示领域专用 LLM 的有效性。
全面综述材料科学中的基础模型,按任务、架构和预训练策略分类,讨论多模态跨域模型、早期成功案例、数据偏差等挑战及未来方向。
论文探讨如何将机器学习与生命周期评估(ML-LCA)整合,通过玻璃、水泥、半导体光刻胶和聚合物案例研究,推动可持续设计材料发现。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Sonnet 4.5 | Anthropic | N/A | N/A | 97.6 | HumanEval 领跑者(截至5月11日) |
| Claude Opus 4.7 | Anthropic | 91.3 | N/A | N/A | SWE-bench Pro 64.3% 第一 |
| GPT-5.5 | OpenAI | N/A | N/A | N/A | 智能指数破60,agentic coding 强 |
| Gemini 3.1 Pro | 94.3 | N/A | N/A | MMLU 领先,多模态 200 万上下文 | |
| R1 | DeepSeek | N/A | N/A | 97.4 | HumanEval 第二 |
| Grok 4 | xAI | N/A | N/A | 97.0 | HumanEval 第三 |
| Qwen 3.6 Max-Preview | Alibaba | N/A | N/A | N/A | 同时领跑6个编码与代理基准 |
行业领袖在想什么,说了什么
"AI 将赋予人们前所未有的能力与代理"
奥特曼于4月26日发表OpenAI新原则声明,强调AI应广泛分配给所有人而非由少数公司控制,并提出政府需考虑新的经济模型以确保普遍繁荣。
"AI 可能在1-5年内引发严重就业危机"
阿莫代5月19日接受Fox News采访时警告,AI已达到大学生水平认知能力,入门级白领工作面临被取代风险。Anthropic Q1收入同比增长80倍,并推出10个金融专用AI代理。
"AI 发展速度放缓或许是好事"
哈萨比斯1月接受Semafor采访时指出,高带宽内存短缺和开放研究减少等自然瓶颈为AI技术提供了必要的护栏,让社会有更多时间思考伦理和商业问题。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?