AI 驱动超导材料发现
日本东北大学与富士通利用 AI 平台 Kozuchi 开发因果图压缩技术,成功识别 CsV3Sb5 超导机制,该技术将因果图压缩至原始大小的 1/20,并将于 2026 年 3 月开放试用环境。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
Anthropic 以 9650 亿美元估值融资 650 亿美元,首次超越 OpenAI 成为全球最高估值私有 AI 公司,并于 6 月 1 日秘密提交 IPO 文件。
Microsoft Build 2026 发布七款自研 AI 模型(MAI-Thinking-1、MAI-Code-1-Flash、MAI-Image-2.5 等),标志着微软减少对 OpenAI 依赖的战略转向。
OpenAI、Anthropic、Google DeepMind 和微软 CEO 联名致信美国国会,呼吁强制合成 DNA 供应商实施生物安全筛查。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
Anthropic 以 9650 亿美元估值融资 650 亿美元,首次超越 OpenAI 成为全球最高估值私有 AI 公司,并于 6 月 1 日秘密提交 IPO 文件。
BREAKING
Microsoft Build 2026 发布七款自研 AI 模型(MAI-Thinking-1、MAI-Code-1-Flash、MAI-Image-2.5 等),标志着微软减少对 OpenAI 依赖的战略转向。
OpenAI、Anthropic、Google DeepMind 和微软 CEO 联名致信美国国会,呼吁强制合成 DNA 供应商实施生物安全筛查。
GitHub Copilot 于 6 月 1 日正式切换为基于 token 计费模式,开发者社区反应强烈,部分用户月费从 29 美元暴涨至 750 美元。
SpaceX 计划于 6 月 12 日以 1.75 万亿美元目标估值 IPO,S-1 文件披露 xAI Q1 亏损 24 亿美元,并与 Anthropic 达成每月 12.5 亿美元算力租赁协议。
Google 宣布 Gemini 3.5 Flash 正式发布,速度为同类模型 4 倍,定价 1.50/9 美元每百万 token,在 Terminal-Bench 2.1 上得分 76.2%。
Boston Dynamics 与 Google DeepMind 合作,将 Gemini Robotics-ER 1.6 集成到 Spot 机器狗和 Orbit AI 视觉检测平台。
Sysdig 记录首例确认的 LLM Agent 网络攻击,AI 自主渗透并在 1 小时内窃取 AWS 数据库数据。
美国众议院提出《伟大美国 AI 法案》,试图以联邦法规抢占各州 AI 监管,科罗拉多 AI 法案将于 6 月 30 日生效。
Apple WWDC 2026 将于 6 月 8 日举行,预计宣布 Siri 默认采用 Google Gemini,并支持 ChatGPT、Claude 多模型切换。
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
日本东北大学与富士通利用 AI 平台 Kozuchi 开发因果图压缩技术,成功识别 CsV3Sb5 超导机制,该技术将因果图压缩至原始大小的 1/20,并将于 2026 年 3 月开放试用环境。
西班牙罗维拉-威尔吉利大学开发 CoCoGraph 系统,可生成数百万种符合化学定律的新分子,该成果已发表于 Nature Machine Intelligence,有望加速药物和可持续材料开发。
KAIST 研究团队开发基于黎曼去噪模型的 AI 系统,可快速准确预测分子能量和最稳定原子排列,成果发表于 Nature Computational Science,被认为是 AI 首次自主理解化学基本原理。
Google DeepMind 的 GNoME 系统利用图神经网络和主动学习,识别出超过 220 万种新的稳定无机材料,并发现 4.5 万种新晶体原型,实现材料发现的数量级跃迁。
Nature Materials 发表综述文章,总结过去数十年材料设计的计算进展,强调从传统筛选方法向深度生成模型驱动的逆向设计的范式转变,并讨论当前挑战与未来展望。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Claude Opus 4.8 | Anthropic | N/A | N/A | 88.6 | SWE-bench Verified 得分 88.6%,领先编码基准 |
| GPT-5.5 | OpenAI | N/A | 85.0 | N/A | 推理和通用任务表现强劲 |
| Gemini 3.5 Flash | N/A | N/A | N/A | Terminal-Bench 2.1 得分 76.2%,速度 4 倍提升 | |
| Gemini 3.1 Pro | N/A | N/A | 80.6 | GPQA-Diamond 94.3%,领先科学推理 | |
| MAI-Thinking-1 | Microsoft | N/A | N/A | N/A | 中等权重级别推理模型,匹配领先基准 |
| Qwen 3.7 Max | Alibaba | N/A | N/A | N/A | 成本优化下接近 Claude Opus 性能 |
| DeepSeek V4 | DeepSeek | N/A | N/A | N/A | 开源推理模型,竞争力强 |
行业领袖在想什么,说了什么
"Claude 写下了我们生产系统中 80% 的代码"
Anthropic 在 6 月发布的安全论文中披露,Claude AI 已编写了其生产系统中超过 80% 的合并代码,标志着 AI 能力自我迭代的速度正在加速。
"人文主义超级智能将以人为本而非替代人"
在 Microsoft Build 2026 大会上,苏莱曼发布 7 款自研 AI 模型,强调微软致力于开发「人文主义超级智能」,优先支持而非取代人类工作。
"我们能将技术立即部署到数十亿美元产品"
哈萨比斯在接受 Axios 采访时表示,与 OpenAI 和 Anthropic 不同,Google 拥有庞大的分发和现金流优势,能够快速将 AI 技术整合到多款旗舰产品中。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?