2026 年 5 月 5 日,Nature 刊发了一封引人注目的 Correspondence——来自新南威尔士大学的 Jing Hu 和澳门大学的 Tony Huiquan Zhang,分享了他们深度使用 Claude Code 和 OpenClaw 做科研的亲身体验。文章提出了一个尖锐问题:当 AI Agent 能在几分钟内完成原本需要数周的数据清洗、文献综述、代码调试时,初级研究人员的「学徒期」去哪了?

这不是一篇反对 AI 的檄文。恰恰相反,两位作者坦承自己「tempting to outsource most data collection, cleaning and curation to these tools」——他们清楚地看到了效率诱惑,也清楚地看到了代价。


📌 核心问题:效率 vs 学习的根本矛盾

作者用了一个精准的比喻:就像流水线取代了手工艺学徒,效率提升了,但大师傅的直觉没了。

在传统科研模式中,junior researcher 的成长路径是:

  • 数据收集:学会判断数据质量、识别异常值、理解数据背后的业务含义
  • 数据清洗:学会处理缺失值、标准化格式、解决不一致性——这些「脏活」恰恰是理解数据本质的过程
  • 代码调试:学会定位问题、阅读报错信息、理解系统行为——调试能力是工程师最核心的手艺
  • 文献综述:学会批判性阅读、识别研究空白、建立知识地图

当 Agent 把这些任务从「周」压缩到「分钟」,效率暴增的同时,junior researcher 失去了通过实践积累直觉的机会。


🔥 关键数据与背景

AI 在科研中的渗透速度

根据 Stanford AI Index Report 2026 的数据,自然科学领域提及 AI 的论文数量从 2010 年到 2025 年增长了近 30 倍。这不是渐进式 adoption,是爆发式渗透。

人类科学家仍然领先

Nature 4 月 13 日另一篇报道「Human scientists trounce the best AI agents on complex tasks」指出:在复杂科学任务上,人类科学家仍大幅领先最强 AI Agent。这说明 Agent 的能力边界仍然清晰——它擅长的是「执行型」任务(数据清洗、代码调试、格式转换),而非「创造型」任务(提出假说、设计实验、解释结果)。


🧠 技术架构:Agent 在科研中如何工作

作者使用的两个工具——Claude Code 和 OpenClaw——代表了当前 AI Agent 在科研中的两种典型形态:

  • Claude Code:编码 Agent,直接在代码仓库中工作,能读懂上下文、修改代码、运行测试、调试错误
  • OpenClaw:通用 Agent 框架,支持多工具编排、定时任务、跨系统集成

在实际使用中,Agent 承担了大量「重复性高、判断性低」的工作:文献检索与整理、数据预处理、代码模板生成、格式转换、报告初稿撰写。这些工作耗时但不需要太多创造性判断,是 Agent 的理想场景。


🔑 关键洞察

洞察一:Agent 替代的不是「工作」,而是「学习过程」

这是文章最深刻的洞察。我们通常把 Agent 的价值定义为「替代重复性劳动」,但作者指出:很多所谓的「重复性劳动」,其实是 junior researcher 的学习过程。数据清洗不是「浪费时间」,而是理解数据的方式。调试代码不是「苦差事」,而是理解系统的方式。

当 Agent 把这些过程外包掉,junior researcher 获得了效率,但失去了深度。这不是 Agent 的错——是我们在部署 Agent 时没有设计好「什么该自动化、什么该保留给人」。

洞察二:「渐进式披露」是解决矛盾的关键

这与 Harness Engineering 的核心理念高度一致。渐进式披露(Progressive Disclosure)的设计思路是:

  • 初级阶段:Agent 做助手,人类做主体——Agent 提供提示和建议,人类执行和决策
  • 中级阶段:Agent 做执行者,人类做监督者——Agent 执行任务,人类审查结果
  • 高级阶段:Agent 做自主执行者,人类做架构师——Agent 闭环完成任务,人类设计系统

不是不用 Agent,而是设计好 Agent 何时「做」、何时「陪练」。让 Agent 在初级阶段充当「教练」而非「替身」,才是真正解决效率与学习矛盾的方式。

洞察三:「手艺」的价值在 Agent 时代反而上升了

当所有人都能用 Agent 生成代码、清洗数据、写报告时,区分「好」和「普通」的不再是「能不能做」,而是「做得对不对」。判断 Agent 输出的质量、识别 Agent 的错误、理解 Agent 的局限——这些能力恰恰需要通过「学徒期」的实践来获得。

讽刺的是:Agent 越强大,人类的「手艺」越值钱——因为只有具备手艺的人,才能有效监督 Agent。


🚀 引发思考

对工程团队的启示

这篇文章的洞察不仅适用于科研,同样适用于软件工程。当 Coding Agent 能自动完成 CRUD、写测试、修 bug 时,初级工程师的「学徒期」也在被压缩。如何在提效的同时保护成长路径?

一个可行的思路:用 Agent 做「陪练」而非「替身」。让 Agent 在初级工程师写代码时提供实时反馈,而非直接替他们写。让 Agent 在调试时引导思路,而非直接给出答案。

对 Harness Engineering 的启示

Harness Engineering 的「渐进式披露」理念,本质上就是在解决这个问题。好的 Harness 不是让 Agent 越强越好,而是在「Agent 能力」和「人类成长」之间找到平衡点。

这可能是 2026 年 AI 工程化最被低估的议题:效率和学习如何共存?不是二选一,而是设计出同时服务两者的系统。

对 AI Agent 产品设计的启示

当前大多数 Agent 产品的设计目标是「最大化任务完成效率」。但这篇文章提醒我们:最好的 Agent 产品应该同时服务两个目标——效率提升和技能培养。

一个具体的设计方向:Agent 在完成任务后,自动生成「学习摘要」——解释它做了什么、为什么这样做、有哪些替代方案。这样 junior 在享受效率红利的同时,也能从 Agent 的行为中学习。


📎 相关阅读

  • Nature 原文:https://www.nature.com/articles/d41586-026-01440-9
  • Nature 4/13:Human scientists trounce the best AI agents on complex tasks
  • Stanford AI Index Report 2026:自然科学领域 AI 论文 30 倍增长
  • Anthropic RCT 论文:AI 辅助编程损害技能形成(arXiv:2601.20245)——与本文形成呼应

逍遥云初 | 2026.05.18