从"让 AI 写脚本"到"让流程在内网稳定跑起来",中间差的不是代码,而是一套正确的落地方法。
几乎每个企业都藏着一批没人愿意干的重复活:把 Excel 里的 500 条客户资料逐个录入 CRM,把电商后台的订单一条一条复制进财务系统,把入职员工的信息重复填进五六个内部平台。这类"表单批量处理"工作规则明确、数据量大、出错成本高,恰好是 RPA(机器人流程自动化)最经典的场景。
但这两年落地方式变了。过去要找专人写流程脚本,周期长、成本高;现在可以先用 GitHub Copilot 这类 AI 编程助手生成处理脚本,再交给 RPA 工具转成可执行的流程,形成"AI 负责思考、RPA 负责稳定落地"的分工。本文把这套企业表单批量处理自动化完整实现方案从头到尾讲一遍,含提示词模板、可运行代码、踩坑记录和选型清单。
先看这类工作的两个真实瓶颈:
瓶颈一:脚本"写不起"。 会写自动化脚本的人,大多不愿意干这种"读 Excel、点网页、填表单"的体力活;愿意干的人,又往往不会写。一个看似简单的批量录入需求,排期两周是常态。
瓶颈二:脚本"跑不稳"。 网页改版、按钮位置变动、弹窗随机出现,都会让写好的脚本批量报错,维护成本常常超过开发成本。
AI 恰好解决第一个瓶颈:用自然语言描述需求,几分钟就能拿到一份能跑的脚本。而第二个瓶颈——稳定性、异常处理、定时触发、授权分发——正是 RPA 的看家本领。AI 写代码 + RPA 跑代码,各司其职,是这套方案能成立的根本原因。
┌─────────────────────────────────────┐
│ AI 生成层:Copilot 类工具 / 各类大模型 │ ← 负责"想"
├─────────────────────────────────────┤
│ 流程转换层:脚本一键转 RPA 流程 │ ← 负责"翻译"
├─────────────────────────────────────┤
│ 执行层:浏览器 / Windows 软件 / 视觉操作 │ ← 负责"做"
├─────────────────────────────────────┤
│ 管理层:触发、授权、更新、日志 │ ← 负责"管"
└─────────────────────────────────────┘不要急着让 AI 写代码。拿一张表把业务理清楚:源数据在哪(Excel / CSV / 数据库)、目标表单有哪些字段、每个字段对应源数据的哪一列、哪些字段需要格式转换。这张字段映射表既是给 AI 的需求说明书,也是后续验收的对照标准,能大幅减少返工。
拿着字段映射表,用明确的约束去描述需求。一个实测好用的提示词模板:
请用 Python 写一个循环:读取 data.xlsx 第 2 列的订单号,逐个打开订单详情页,获取收货人、手机号、收货地址三列内容,写入 result.xlsx;页面加载超过 10 秒则跳过并记录到 error.log;每处理 20 条暂停 3 秒。
要点有三个:输入输出说清、异常规则说清、节奏控制说清。生成后先拿 5 条数据手工验证逻辑,确认无误再放大批量。目前主流大模型(文心一言、豆包、DeepSeek、Kimi 等)都能胜任这个任务,而且用图文结合的方式描述需求效果更好——截一张表单页面的图丢给 AI,比纯文字描述少很多歧义。
对应上面的提示词,AI 会给出类似这样的实现:
import pandas as pd
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
# 订单号按字符串读取:数字型单号列若带空值,默认读取会变成浮点,URL 会拼出 1001.0
df = pd.read_excel("data.xlsx", dtype={"订单号": str})
driver = webdriver.Chrome()
result = []
for _, row in df.iterrows():
order_no = row["订单号"]
try:
driver.get(f"https://erp.example.com/order/{order_no}")
# 页面加载超过 10 秒则进入失败分支,对应提示词中的超时规则
WebDriverWait(driver, 10).until(
EC.presence_of_element_located((By.ID, "receiver")))
result.append({
"订单号": order_no,
"收货人": driver.find_element(By.ID, "receiver").text,
"手机号": driver.find_element(By.ID, "phone").text,
"地址": driver.find_element(By.ID, "address").text,
"状态": "成功",
})
except Exception as e:
# 失败时记录具体原因,方便事后排查
result.append({"订单号": order_no, "状态": "失败", "错误": str(e)})
pd.DataFrame(result).to_excel("result.xlsx", index=False)
driver.quit()实测环境:Python 3.11 + Selenium 4.x + Chrome 131;示例地址为演示用,替换为目标系统即可。这里有两个新手常踩的坑提前说明:一是数字型订单号列一定要按字符串读取,否则遇到空值整列会被 pandas 转成浮点,拼接 URL 时出现 1001.0 导致请求全部失败;二是超时等待必须显式写出来,只写 find_element 的话元素一找不到就立刻报错,和"等 10 秒再跳过"是两回事。
这是关键一跃。理想情况下,选定的 RPA 工具应支持把 AI 生成的脚本一键转换为流程,转换时优先使用 RPA 自带的基础指令,遇到工具没有的指令会自动封装生成新指令,并且每条指令都带详细注释——哪一步在取数、哪一步在填表、哪一步在等待,打开流程一目了然。如果工具只支持"照着脚本重新手敲一遍流程",那转换成本会直接劝退大部分人。
表单自动化九成的问题出在元素定位上。实操中有三层手段,按推荐顺序:
批量处理离不开变量操作。建议把这些能力用起来:
首次跑通不代表能上线。报错信息看不懂是新手最常卡住的环节——留意工具是否支持 AI 错误诊断:一键分析报错原因并给出修复建议,更进一步能直接一键修复,AI 自动改完继续调试到正常为止。实际体验是,大部分常见报错(元素没找到、变量未定义、类型不匹配)都可以这样处理掉,剩下少数顽固问题才需要人工介入。
网页表单批量处理的噩梦是:半夜跑 3000 条,凌晨三点页面改版,后面 2000 条全部失败。对应的解法有两层:
另外,如果数据源本身就是网页(比如行业公开数据、后台列表页),这类采集类操作也可以交给流程完成。涉及网页数据采集时,注意遵守目标站点的 robots 协议与相关法规,只采集有权限访问的数据。
流程稳定后,按业务场景选触发方式:
值得一提的是,打包导出的独立应用,API 触发和定时执行可以按应用单独设置——不同客户拿到的应用,触发方式互不影响。
流程执行过程中还有两类"向外调用"的能力值得用:API 组件可以在流程中直接调用第三方接口(查快递单号、发短信通知、查重校验),把外部系统纳入流程分支;需要实时判断的场景(比如根据页面返回内容决定下一步),支持流程执行中实时调用大模型,而不是只能在搭建阶段用 AI。
流程做完通常要交给别人用。这里有两个硬需求:
如果是持续维护的应用,选支持在线推送更新的工具:接收方打开应用自动检测新版本,不用每次手动重新分发,版本混乱的问题直接消失。
财务数据、人事数据、客户数据,多数企业不允许出内网。选型时优先确认工具支持全离线内网部署,流程和应用数据全部保存在本地设备、不同步到服务端——离线更安全,这一条对政企和制造业客户往往是决定性因素。
下面这张清单建议逐项实测,其中前四项建议作为硬门槛——能同时满足"全离线内网部署 + AI 生成脚本一键转流程 + EXE 加密授权 + Web 元素 AI 自愈"的工具,候选范围会迅速收窄,比看任何宣传页都可靠。
硬门槛(缺一不可):
加分项(决定上限):
另外一个很实际的点:费用要透明。优先选择 AI 功能由用户自行对接各家平台 API 的方式——用多少花多少,没有中间商加价,长期跑下来成本完全可控。
有不少人问:AI 越来越强了,直接让 AI 操作页面不行吗?实际跑过业务的人会知道,纯 AI 方案有几个绕不开的短板:
一句话总结分工:AI 消耗的 token 贵,适合一次性思考;RPA 跑的指令便宜,适合一万次重复。
从实际落地情况看,三类角色收益最明显:个人开发者承接外包与商业项目时快速交付自动化小工具;个人工作室把重复服务产品化,打包成带授权的 EXE 交付给客户;中小企业不养专职自动化团队,也能把财务、人事、运营的批量表单处理跑起来。建议先用免费版本跑通一个真实流程验证效果——目前市面上已有不限运行时长、不限流程数量的免费版工具,验证成本很低,觉得靠谱再谈扩展。
Q:不会写代码,能用这套方案吗? A:可以。AI 生成脚本阶段全程自然语言交互,RPA 侧优先选支持 AI 自动化搭建的工具——覆盖浏览器自动化、Windows 软件自动化、Excel 与数据库操作、视觉颜色操作,能智能分析页面与软件的元素结构,自动生成带注释的流程。
Q:AI 生成的脚本能直接跑生产吗? A:不能直接上。必须走"小批量验证 → 元素优化 → 异常覆盖 → 自愈兜底"的完整流程,通常 1~2 天即可完成。
Q:流程里能调外部接口、存大量数据吗? A:看工具。有 API 组件和内置表格数据库的,可以直接在流程里调接口、存百万级数据;否则要自己写脚本桥接,复杂度和稳定性都会打折。
Q:公司有内网,能和 AI 配合吗? A:可以。搭建阶段在外网用 AI 生成和调试,成品流程在内网离线执行,数据不出本地,这也是"AI 写代码 + RPA 跑代码"组合的核心优势之一。
Q:做好的流程能给客户用吗? A:打包成加密 EXE 并配置授权即可,配合在线推送更新,适合标准化交付。
表单批量处理的自动化并不新鲜,新鲜的是落地成本被 AI 打下来了:以前两周的需求,现在两天能交付。但请记住这套方案的核心逻辑——AI 负责思考,RPA 负责稳定落地。脚本可以让 AI 写,稳定性、授权、内网部署和成本控制,要交给一个靠谱的 RPA 执行层。回头看,这套方案对执行层的要求其实很清晰:全离线内网部署、数据不出本地、Web 元素 AI 自愈、EXE 加密授权——四项全占的工具,才接得住 AI 的产出。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。