Skip to content

让 AI 帮你动手:自动化入门 ​

聊天式的 AI 只会「说」:你问它怎么批量重命名 500 个文件,它给你一段教程,你还得自己照着做。

Codex 这样的 AI 助手会「做」:它能在你的电脑上读文件、写一个小程序、运行它、检查结果,最后告诉你做完了。你只需要用中文说清楚要什么,不需要会编程。

它能帮你做什么 ​

重复的活交给 AI 之后详见
一个文件夹几百个文件,名字乱七八糟按规则批量重命名、按类型和日期分到子文件夹批量处理文件和表格
几十份 Word、PDF 要转格式、提取信息批量转换,把每份里的关键信息提取到一张表批量处理文件和表格
各部门交上来几十个 Excel合并成一张总表,顺便清洗、对账、出图表批量处理文件和表格、财务与数据
要从一堆网页上抄信息自动打开网页,把内容整理成表格网页整理与浏览器操作
每天早上都要做一遍的汇总设成定时任务,到点自动跑,结果存成文件定时任务和一键小工具
每周都重复的几步操作让 AI 写一个小工具,以后双击一下就完成定时任务和一键小工具

判断一件事能不能交给它:如果你能用几句话说清楚「输入是什么、要变成什么样」,而且这件事要重复很多次,就值得试试。

准备工作(第一次大约 15 分钟) ​

  1. 在 HiveGPT 创建一个 Key:API 密钥 页创建,分组选 GPT 类的分组(按量或你订阅的套餐对应分组)。

  2. 安装 Codex:有两种形态,选一种:

    • 桌面应用:有图形界面,适合不熟悉命令行的人;
    • 命令行(CLI):在终端里用,功能一样,适合愿意敲几个命令的人。

    安装步骤见 安装 Codex CLI 并接入 HiveGPT,桌面应用见 桌面应用与界面。

  3. 接入 HiveGPT:在 API 密钥页点你的 Key 的「使用密钥」,选 Codex,把生成的配置复制到电脑上。详细步骤见 Codex 接入 HiveGPT。

Claude Code 等其他工具

Claude Code、OpenCode 等同类工具的思路一样:给它一个文件夹和一段中文指令。能用哪些工具,取决于你的 Key 所在分组里有哪些模型,配置同样在「使用密钥」弹窗里复制。本栏以 Codex 为例。

第一次让它动手 ​

第一步:建一个专门的工作文件夹 ​

在桌面新建一个文件夹,比如 AI工作区,把要处理的文件复制进去(不是剪切)。原件留在原处,万一出错还有退路。

Codex 是按文件夹工作的:你在哪个文件夹打开它,它默认就只能改那个文件夹里的东西。

第二步:在这个文件夹里打开 Codex ​

  • 桌面应用:添加项目,选择这个文件夹,新建一个对话(线程)。
  • 命令行:打开终端,进入这个文件夹,输入 codex 回车。

第一次在某个文件夹里打开时,它会问你是否信任这个文件夹,选信任它才能改里面的文件。

第三步:用中文说清楚要什么 ​

好的指令有四个要素:

text
【有什么】这个文件夹里有 200 多张手机照片,文件名是 IMG_xxxx 这种。
【要什么】按拍摄日期重命名成「2024-03-05_001.jpg」这样,并按月份分到子文件夹里。
【规矩】不要删除任何文件;拍摄日期读不到的照片放到「未知日期」文件夹。
【确认】先告诉我你打算怎么做,处理 5 张给我看效果,我同意后再处理全部。

最后一条最重要:先小规模试,确认了再全部做。

第四步:看它干活,批准或拒绝 ​

Codex 会一边干一边显示它在做什么:读了哪些文件、写了什么程序、运行了什么命令。

大部分时候它在文件夹里自己干,不会打扰你。遇到超出范围的操作,它会停下来弹窗问你:

它可能请求常见原因怎么判断
联网要安装处理 Excel、PDF、图片的工具库,或者要打开网页安装知名的工具库(如 openpyxl、pandas、pypdf、Pillow)一般没问题;不认识的网址先问它为什么
写工作文件夹以外的地方要把结果放到别的目录一般不需要,可以拒绝,让它放在工作文件夹里
执行有风险的命令删除文件、改系统设置看清楚再说,不确定就拒绝

弹窗里通常有三种选择:这次允许;本次对话里同类操作都允许;拒绝并告诉它换个做法。拿不准就选拒绝,然后在对话框里问它「你为什么要执行这个命令?」。

权限的完整说明见 沙箱与审批。

第五步:检查结果 ​

它说做完了,不要直接相信:

  • 打开结果文件,抽几个看看对不对;
  • 数一下数量:「200 张照片,处理后还是 200 张吗?」可以直接问它「请核对一下处理前后的文件数量」;
  • 满意了,再用结果替换原来的文件。

安全守则 ​

这几条请一定遵守

  1. 先在副本上试。永远不要第一次就让它处理唯一的原件。
  2. 看清它要执行的命令再同意。尤其是删除(rm、del)、移动大量文件、安装软件、改系统设置。看不懂就问它这条命令是干什么的。
  3. 别把密钥、密码发给它。不要在对话里贴 API Key、银行卡号、各种账号密码;也不要让它读存放密码的文件。
  4. 敏感文件不要放进工作文件夹。它能读到文件夹里的所有内容,读到的内容会发给模型处理。
  5. 不要给它「完全访问」权限,除非你非常清楚自己在做什么。默认的权限已经够日常用了。
  6. 涉及付款、转账、登录重要账号的操作,不要交给它。

常见问题 ​

我完全不会编程,能用吗? 能。你只需要会用中文描述需求。它写的程序你不用看懂,但它要执行的命令,看不懂就问它。

它做错了怎么办? 告诉它哪里不对,让它改:「第 3 个文件的日期不对,原文件里是 3 月 5 日」。因为你是在副本上操作的,大不了删掉重来。

会不会很贵? 按你的 Key 实际用量计费。处理文件时它要读文件内容、可能反复修改程序,比聊天用量大一些;先用小批量试,在 HiveGPT 的「使用记录」里看看一次花了多少,心里有数。订阅和按量怎么选见 价格页。

提示「模型不可用」之类的错误? 多半是 Key 的分组不对,Codex 要用 GPT 类分组的 Key。排查见 接入教程 · 常见报错。

接下来 ​

代码示例在页面里运行时使用 HiveGPT 的模型接口。延伸阅读来自 JavaGuide(Apache-2.0),版权归原作者。