top of page

用编程智能体做可复现的数据分析:Claude Code、Codex 与 Gemini CLI

9月13日
讀畢需時 3 分鐘

Image via Wikimedia Commons (public domain).

直到不久前,用 AI 做数据分析还意味着把代码粘贴进聊天窗口,再把答案粘贴回来。2025 年,工具的形态变了。Claude Code、OpenAI Codex 和 Gemini CLI 这样的编程智能体直接运行在你的项目文件夹里,读取你的数据和脚本,编写并执行代码,检查输出并修正自己的错误。对研究者来说,这比更好的自动补全意义大得多:智能体可以从原始数据到图表完成整个分析,而你可以全程观看。本教程解释这些工具是什么、如何设置项目以保证结果可复现,以及在哪些环节必须保留人工介入。

三个工具分别是什么

  • Claude Code(Anthropic)可在终端、桌面应用或 VS Code 与 JetBrains 内运行。它擅长理解已有代码库和执行冗长的多步骤任务。

  • Codex(OpenAI)内置于 ChatGPT,在你代码仓库的隔离云端副本中工作,以 pull request 的形式提出修改。也有命令行版本。

  • Gemini CLI(Google)是开源的终端智能体,拥有 100 万 token 的上下文,个人 Google 账号可享有慷慨的免费额度。

三者都可以指向一个包含 CSV 文件和 README 的文件夹,并被要求"清洗数据、运行预注册的回归并生成表 2"。与聊天窗口的区别在于,它们会真正运行代码、看到错误信息并迭代。

先为可复现性搭好项目

智能体很乐意生成一份只能在你的机器上运行一次、再也无法重现的分析。在第一条提示之前,先做好四件事。

  1. 一个带版本控制的文件夹。 初始化 git 仓库。此后智能体的每一处修改都是一个可读、可接受或可撤销的 diff。

  2. 固定的运行环境。 一份写明精确版本的 requirements.txtrenv.lock。要求智能体在虚拟环境中安装,并记录它新增的每一个包。

  3. 一份项目说明文件。 Claude Code 读取 CLAUDE.md,Codex 读取 AGENTS.md,Gemini CLI 读取 GEMINI.md。写下研究问题、预注册的分析、变量定义,以及诸如"绝不修改原始数据文件夹"和"每张图都由 figures/ 中的脚本生成"这样的规则。

  4. 只读的原始数据。 把原始文件放在一个智能体被告知不得触碰的文件夹里,并让每个脚本写入单独的输出文件夹。

一个示范提示

好的第一个任务应当范围小、可核查。例如:"加载 data/raw/survey.csv。报告行数、每列的缺失值数量以及 condition 变量的分布。暂时不要修改任何内容。"阅读输出。然后:"编写 scripts/01_clean.py,应用 CLAUDE.md 中的排除标准,将结果保存到 data/clean/survey.parquet,并打印每条标准各删除了多少行。"要求把排除计数写入一个你可以引用的文本文件。只有在核对过这些计数之后,才能进入建模阶段。

人应该留在哪里

智能体擅长管道工程,不擅长判断。哪些变量进入模型、哪些检验是预注册的而哪些是探索性的、异常值如何处理,这些请你自己决定。阅读智能体写的每一个脚本,它们通常都很短。投稿前在全新环境中从原始数据重新运行整个流程,最好只用一条命令,并把这条命令写进 README。按照大多数期刊现在的要求,在方法部分披露所用工具和模型版本。

成本与获取

Claude Code 需要 Claude Pro 或 Max 订阅,或 API 额度。Codex 包含在 ChatGPT Plus 和 Pro 中。Gemini CLI 对个人账号免费,每日额度足以应付大多数分析。三家供应商都提供机构许可,通常附带消费者账号所不具备的数据处理条款;在把被试数据放入其中任何一个之前,请先咨询你所在机构的 IT 部门。

各工具的链接见我们的编程与数据分析工具库页面

留言


这项倡议得到了以下组织的支持:

  • Twitter
  • LinkedIn
  • YouTube
logo_edited.png
bottom of page