量子AI预测混沌系统
研究人员展示将量子计算与AI结合可显著改善对复杂混沌系统的预测能力,让量子计算机识别数据中的隐藏模式,使AI更准确且稳定。
A daily radar for AI · AI4Science · Materials Discovery
Track frontier model releases, scientific ML breakthroughs, materials discovery, benchmarks, and conference deadlines — updated daily.
从今日资讯与论文中提炼出最値得关注的三项进展
综述AI在材料设计中的关键进展,展示从传统筛选到深度生成模型驱动的逆向生成的范式转变,讨论当前挑战和未来前景。
英国AI安全研究所报告显示前沿模型的网络攻击能力每4个月翻倍,Claude Mythos和GPT-5.5均能完成32步端到端攻击。
OpenAI发布GPT-5.5 Instant取代GPT-5.3成为ChatGPT默认模型,支持基于历史对话、文件和Gmail的个性化增强。
由 Claude 搜索汇总,覆盖模型发布、政策动态、行业进展
OpenAI发布GPT-5.5 Instant取代GPT-5.3成为ChatGPT默认模型,支持基于历史对话、文件和Gmail的个性化增强。
Cisco宣布裁员近4000人(占比不足5%),称AI技术进步使小团队能完成相同产出,股价暴涨15%。
Anthropic与美国国防部因拒绝将AI用于大规模监控和自主武器而被列为"供应链风险",引发行业支持。
英国AI安全研究所报告显示前沿模型的网络攻击能力每4个月翻倍,Claude Mythos和GPT-5.5均能完成32步端到端攻击。
MAJOR
Elon Musk宣布xAI不再独立运营,将大部分AI算力移交给Anthropic,引发业界对AI竞争格局的重大猜测。
中国四大实验室发布开源编程模型(DeepSeek V4、GLM-5等),在SWE-bench上达到西方前沿水平,成本仅为Claude的三分之一。
Google计划在下周I/O大会发布新Gemini模型,性能介于GPT-5.5和Mythos之间,重点加强多模态推理能力。
MIT发布2026 AI指数报告,显示AI在客服和软件开发中分别提升生产力14%和26%,但普及速度超越PC和互联网。
Anthropic获得Google和Amazon额外450亿美元投资,并与Google、Broadcom签署数千亿美元芯片协议。
NASA的毅力号火星车首次使用Anthropic的Claude视觉模型自主规划行驶路线,实现AI驱动的星际探索。
精选 AI4Science 突破,涵盖材料发现、自动化实验与科学基础模型
研究人员展示将量子计算与AI结合可显著改善对复杂混沌系统的预测能力,让量子计算机识别数据中的隐藏模式,使AI更准确且稳定。
Emory大学团队结合定制神经网络与3D粒子追踪,在第四态物质——尘埃等离子体中揭示隐藏的粒子相互作用模式。
西北大学工程师成功打印能与真实神经元实际通信的人工神经元,这些柔性低成本设备可生成逼真的电信号。
一种新的量子启发算法成功破解传统超级计算机难以接近的问题,可模拟极其复杂的量子材料如准晶体。
Synthegy新系统让化学家用简单语言指导合成和反应规划,强大算法生成路径,改变分子设计方式。
Nature Communications Materials发表综述,提出构建透明、可扩展、可持续的AI驱动基础设施框架,从概念到商业化加速材料发现和先进制造。
材料科学 × 机器学习:从催化剂发现到晶体结构预测
综述AI在材料设计中的关键进展,展示从传统筛选到深度生成模型驱动的逆向生成的范式转变,讨论当前挑战和未来前景。
提出构建透明、可扩展AI驱动基础设施框架,强调开源工具统一数据采集、建模、模拟和部署,民主化材料科学研究。
提出ME-AI机器学习框架,将专家直觉转化为可量化描述符,从基于测量的数据中提取特征,揭示超价态作为拓扑半金属关键预测因子。
印度理工团队开发专门面向材料科学的语言模型LLaMat,在420亿token科学语料上训练,在42项任务上超越Claude、GPT等商业模型。
提出新催化描述符"吸附能分布",聚合不同催化剂面、位点和吸附物的结合能,通过机器学习加速CO2转甲醇热催化剂发现。
全面综述AI在材料科学中的变革影响,覆盖化学信息学、成像、药物发现、增材制造等领域进展,并强调数据质量与可及性挑战。
当前主流大模型一览,持续跟踪能力边界
关键基准横向对比,数字不说谎
| 模型 | 机构 | MMLU | MATH | HumanEval | 亮点 |
|---|---|---|---|---|---|
| Gemini 3.1 Pro | 93.5 | N/A | N/A | GPQA领先94.3%,多模态科学推理最强 | |
| Claude Opus 4.7 | Anthropic | 91.3 | N/A | N/A | SWE-bench 80.8%,编程和代理最佳 |
| GPT-5.5 | OpenAI | 92.1 | 81.2 | N/A | AIME 2025数学测试81.2%,通用推理强 |
| Qwen 3.5-plus | Alibaba | 88.4 | N/A | N/A | LiveCodeBench 83.6%领先,编程顶级 |
| DeepSeek V4 | DeepSeek | N/A | N/A | N/A | 开源编程达西方前沿水平,成本优势显著 |
| GLM-5 | Zhipu AI | N/A | N/A | N/A | 幻觉率1.2%最低,Arena Elo 1451开源领先 |
| Llama 4 Maverick | Meta | 88.6 | N/A | N/A | 10M token上下文窗口,开源旗舰 |
行业领袖在想什么,说了什么
"我们正走向白领工作的血洗"
阿莫代警告未来1-5年内,50%的入门级白领工作将消失,AI模型将在2026-2027年达到诺奖级科学研究能力。
"真正的AGI还需要5到10年"
在达沃斯论坛上,哈萨比斯指出当前AI系统距离人类水平的通用智能"还差得远",批评了行业的过度乐观。
"我们想构建增强人类的工具"
在5月13日法庭作证时,奥特曼为OpenAI辩护,称其并未背叛非营利使命,并强调AI应增强而非取代人类。
每天早上推送到你的邮箱,领袖观点 · 大事 · 论文,不错过 AI 前沿。
分享 AI4Science 前沿、科研心得与个人实验笔记。欢迎来聊。
对话 AI 与科学交叉领域的一线研究者。每期一位,一个问题:AI 正在如何改变你的研究?