← 资料站  /  AI Scientist  /  全景综述与路线梳理
论文 全景综述与路线梳理 背景

From AI for Science to Agentic Science: A Survey on Autonomous Scientific Discovery

从 AI for Science 到 Agentic Science:自主科学发现综述
一句话浙大/上海AI Lab 等 27 位作者的大规模综述(arXiv 2508.14111,S2 引用 85),把『Agentic Science』立为 AI4Science 的新阶段,提出 Level 1-4 自主性分级 + 五大能力 + 四阶段工作流的统一框架,并按生命科学/化学/材料/物理做了第一个面向学科的全景梳理。

这是什么

这篇综述的核心立场是:AI 在科学中的角色正从『计算工具』(computational oracle)演进为『自主科研主体』,作者把这个阶段命名为 Agentic Science,并给出四级演进:Level 1 专家工具 → Level 2 部分代理发现(人监督下自动化部分环节)→ Level 3 完全代理发现(agent 独立走完假设到发现的全流程)→ Level 4 生成式架构师(agent 网络发明新科学方法,尚属展望)。Level 2-4 统称 Agentic Science。

它声称统一了此前三类割裂的视角——process-oriented(按科研流程)、autonomy-oriented(按自主程度)、mechanism-oriented(按 agent 架构)——落成一个三层框架:底层五大基础能力(planning、tool use、memory、multi-agent collaboration、optimization/evolution),中层四阶段动态工作流(假设生成 → 实验规划执行 → 数据分析 → 综合与迭代精炼),顶层按生命科学、化学、材料、物理四个自然科学学科逐一梳理落地系统。这是它自称的差异化卖点:『第一个 domain-oriented 的自主科学发现综述』。

全文的核心分类学:AI for Science 的四级演进。Level 1 计算工具(expert tools)→ Level 2 自动化研究助手(部分代理发现,人监督)→ Level 3 自主科学伙伴(完全代理发现,独立走完假设到发现)→ Level 4 生成式架构师(agent 网络发明新科学方法,展望)。Level 2-4 被定义为 Agentic Science,这是引用这篇文章时最常被提到的框架。
全文的核心分类学:AI for Science 的四级演进。Level 1 计算工具(expert tools)→ Level 2 自动化研究助手(部分代理发现,人监督)→ Level 3 自主科学伙伴(完全代理发现,独立走完假设到发现)→ Level 4 生成式架构师(agent 网络发明新科学方法,展望)。Level 2-4 被定义为 Agentic Science,这是引用这篇文章时最常被提到的框架。

机制与做法

组织方式:三层框架 + 学科纵览

正文先讲 AI for Science 的演化史和 Level 1-4 分级,再逐一展开五大能力与四阶段工作流,然后每个学科一章:生命科学(基因组/蛋白质/药物发现)、化学(有机合成/分子设计/量子化学)、材料(自动化工作流/功能材料)、物理与天文,每章按『通用框架 + 细分任务』列系统。核心的端到端系统(The AI Scientist、AI co-scientist、Agent Laboratory、Coscientist、CycleResearcher、Robin、Virtual Lab、NovelSeek、AgentRxiv 等)在 tex 源码中均有覆盖。最后一章综合挑战与机会(可信性、评估、人机协作等)。

配套 awesome list

GitHub 仓库 AgenticScience/Awesome-Agent-Scientists(294 stars,MIT)是论文的论文清单版,按 Part 0 全自动科研管线 + Part 1-4 四学科组织,属于上海AI Lab『Intern Discovery』项目的一部分。仓库以 README 更新为主,大约每 1-2 个月动一次,最近一次 commit 2026-06-27。

关键结果

实证核查

有水分作为『地图』基本称职:框架清楚,核心端到端系统都覆盖了,repo 也还在低频维护;水分在自我定位与实际的差距——自称『系统性、全景式』却漏掉定稿前已有的 Curie/Zochi/Denario,README 引用徽章虚标,Level 分级也未像其期望的那样被后续沿用。论文一年未更新版本,2025 年底以来的关键工作(Kosmos、OmniScientist 等)全部缺席,当作 2025 年中的快照用即可。
系统性、全景式地梳理自主科学发现,配套 awesome list 持续收录领域进展。
论文停在 arXiv v2(2025-10-20,arxiv.org/abs/2508.14111 提交历史),对照本站 catalog 抽查:v2 之后的 Kosmos(2025-11)、Jr. AI Scientist、OmniScientist、InternAgent-1.5 均未收,这可以归因于时间;但 v2 定稿前已有的 Curie(2025-02)、Zochi(2025-06)、Denario(2025-10)在 tex 源码 grep 均为 0 命中,README 也没有,属于真实遗漏。核心系统(AI Scientist、co-scientist、Agent Laboratory、Coscientist、CycleResearcher、Robin、Virtual Lab、NovelSeek、AgentRxiv)tex 中均有覆盖。
配套 repo Awesome-Agent-Scientists 是活跃维护的领域论文清单。
gh api 查证:294 stars,未 archived,最近 commit 2026-06-27『Update README.md』,此前 2026-03/02/01 各一次,全是 README 增补——维护在继续但频率低(月级),且截至今天已近 2 个月没动。README 引用数徽章自标 98,而 S2 实际 85,略有虚标。
提出的 Agentic Science 框架(Level 分级 + 五能力 + 四阶段)被领域接受为结构化范式。
S2 抽查 30 条引用语境:绝大多数是背景性引用(『agentic science 兴起 [45-49]』)或与 LLM4SR 等其它综述并列引用;少数如《A New Paradigm: Agentic AI for Scientific Discovery》明确采用其 Agentic Science Framework。即『被广泛引用』属实,『分类学成为标准』尚未发生——Level 1-4 术语没有像 SAE 自动驾驶分级那样被后续论文直接沿用。

与我们方向的关系

对课题组的用法:这是干湿闭环/跨学科方向的『入口地图』,不是方法论文。建议在两个场景用它:一是给新同学建立 AI-scientist 领域的坐标系(先看它的 Level 1-4 分级和四阶段工作流,再去精读站内 core 条目 the-ai-scientist、towards-an-ai-co-scientist、agent-laboratory、autonomous-chemical-research-with-large);二是查湿实验/自然科学方向的系统时当索引用,它的学科章节比站内偏 CS 的综述(llm4sr、from-automation-to-autonomy、a-survey-of-ai-scientists)覆盖更宽。

注意时效:内容截至 2025-10(v2),Kosmos、OmniScientist、InternAgent-1.5 这批 2025 年底以后的工作要回到本站 catalog 补;awesome list 更新到 2026-06,比论文新,查最新条目优先看 repo README 而不是 PDF。

阅读笔记

同团队(上海AI Lab)还有姊妹综述《A Survey of Scientific Large Language Models》(arXiv 2508.21148,偏数据与模型底座),README 里互相推荐,两篇合起来是该团队对 AI4Science 的完整叙事;读它时留意作者立场——InternAgent/Intern Discovery 是他们自家项目。

材料清单

TeX 源码
已存档:Raw/agentic-science-survey/source/
代码仓库github.com/AgenticScience/Awesome-Agent-Scientists
294★ · 最近推送 2026-06-27
项目主页agenticscience.github.io/
论文配套主页
姊妹综述arxiv.org/abs/2508.21148
A Survey of Scientific Large Language Models(同团队,偏科学 LLM 的数据基础与模型)

相关条目

同子模块 · 全景综述与路线梳理
跨方向 · 同标签