【影刀RPA + AI + 飞书自动化实战】从RPA数据爬取到AI数据分析与群通知
·
大家好!今天想和大家分享一个基于真实业务场景的自动化实战案例。
很多朋友在尝试将AI接入业务时会发现,大模型虽然聪明,但往往会“一本正经地胡说八道”,这种“部分准确”在严谨的业务场景中是致命的;而且大模型虽然具备理解能力,却无法替我们去点击按钮、填表执行。
因此,单纯依靠大模型无法独立完成闭环,真正的解法是 “大模型负责思考判断,RPA负责动手执行”

今天这套影刀RPA + AI中间件 + 飞书自动化的架构,正是基于这个理念打造的手脑协同完美搭档。
一、 实际场景与痛点对比
改造前(纯人工操作:费时费力)
- 收集像“搬砖”: 业务数据分散在各大内容平台(小红书、抖音、公众号等)和不同的后台程序里,每天手动复制粘贴,非常繁琐。
- 数据像“乱码”: 抓下来的非结构化数据杂乱无章,抓不到重点。
- 分析靠“感觉”: 缺乏AI的智能总结,全靠运营人员的个人经验主观判断。
- 通知总“晚点”: 整理好的数据经常无法及时触达团队,全靠人工在各种微信/飞书对话框里手动转发,信息协同严重滞后。
改造后(全链路自动化:丝滑运转)
- 影刀RPA(充当双手): 自动登录各个后台,精准抓取原本分散的原始数据。
- AI大模型(充当大脑): 核心Python中间件调用大模型,对非结构化数据进行“秒级”清洗、提炼和总结分析。
- 飞书自动化(充当传话筒): 结合多维表格,实现分析结果的自动审核与群组精准推送。
二、整体操作流程图
这里是我们设计的底层数据流转架构。特别注意第7-9步的飞书人工审核设计,这是为了防止AI“幻觉”导致的不可控风险而设置的关键兜底动作。
┌───────────────────────┐
│ RPA 客户端/脚本 │ 前置操作:RPA执行脚本抓取
└──────────┬────────────┘
│ 1. 传入参数: 业务数据 (raw_data) + 场景名称 (scenario_name)
▼
┌────────────────────────────────────────────────────────┐
│ Python 核心逻辑中间件 │
│ │
│ ┌─────────────────┐ ┌─────────────────────────┐ │
│ │ 2. 匹配场景配置 │─────►│ 3. 组装 Prompt & 调用API│ │
│ └─────────────────┘ └────────────┬────────────┘ │
│ │ 4. 返回原生字符串 │
│ ┌────────────▼────────────┐ │
│ │ 5. JSON 解析与异常处理 │ │
│ └────────────┬────────────┘ │
└────────────────────────────────────────┼───────────────┘
│
┌─────────────────────────┴─────────────────────────┐
│ 6. 数据库落表 (记录溯源,方便复盘与查错) │
▼ ▼
┌─────────────────────────────┐ ┌──────────────────────────────┐
│ Mysql (本地数据库) │ │ 返回标准 JSON 给 RPA │
│ - 记录流水号、耗时、Token │ │ - 成功: {"status": "ok", ...} │
│ - 记录入参和出参用于复盘 │ │ - 失败: {"status": "error"} │
└─────────────────────────────┘ └──────────────┬───────────────┘
│ 触发飞书 webhook
┌──────────────▼───────────────┐
│ 7. 飞书多维表格 (写入新记录) │
│ - 初始状态:待审核 │
└──────────────┬───────────────┘
│ 触发自动化流程
┌──────────────▼───────────────┐
│ 8. 推送审核卡片给管理员 │
│ (人工兜底:防止大模型幻觉) │
└─────────┬─────────┬──────────┘
[确认]│ │[拒绝]
┌─────────▼─┐ ┌──▼────────┐
│ 9. 推送群组 │ │ 10. 中止/ │
│ (全员播报) │ │ 打回修改 │
└───────────┘ └───────────┘
三、 飞书自动化与“人机协同”设计
哪怕AI再聪明,在严肃的业务群里播报错误数据也是灾难性的。因此我们引入了人机协同的理念:
飞书设计思路

1.静默落表触发: 流程执行完后,首先会在“飞书多维表格”新增一条记录,此时状态初始化为待审核,并不会直接发群打扰大家。
2. 人工审核兜底: 飞书机器人会给指定的管理员单独发送一条审核卡片。管理员一眼就能扫过AI分析的结果。没问题就点【确认发送】,发现AI产生幻觉瞎编了数据,就点【拒绝】。这一步花不到5秒钟,却能确保最终群通知数据100%准确无误~
四、 最终实现效果

五、 实施这套方案带来了哪些效率提升?
- 极简的工作流体验: 从原来的**“打开多个网页 -> 手动复制 -> 整理表格 -> 构思文案 -> 截图发群”,缩减为现在的“点一下RPA运行按钮(或者设置定时自动运行) -> 在飞书点一下确认”**。
- 耗时指数级降低: 过去业务人员每天需要花费 1-2小时 处理的跨平台数据统计与播报工作,现在缩短到了 不到1分钟 的机器运行时间,彻底解放了员工的双手。
- 0 漏报与 0 延误: 摆脱了由于员工请假、开会或遗忘导致的日报/周报延误,机器的定时执行确保了信息的绝对准时。
六、 场景扩展:这套架构还能做什么?
这套架构最大的魅力在于它的高复用性与模块化。 底层的 Python中间件 + 数据库溯源 + 飞书审批通知 流程是完全通用的。如果您想把它应用到其他业务线,完全不需要重写主体代码,只需要做两处简单的替换:
- 替换数据源(RPA端): 让影刀去爬取/抓取新的目标程序或网页(例如:抓取竞品的价格页面、抓取淘宝的客户评价、抓取邮箱里的发票PDF)。

- 替换大脑指令(AI提示词): 在配置表中修改发给大模型的Prompt(例如:从“请分析社媒粉丝增量” 改为 “请提取以下评价中的客户负面情绪”、“请核对发票金额与订单金额是否一致”)。
# 以DeepSeek API文档例 https://api-docs.deepseek.com/zh-cn/
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ.get('DEEPSEEK_API_KEY'),
base_url="https://api.deepseek.com")
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "system", "content": "请你帮我分析一下这段数据,格式要求...."}, # 提示词
{"role": "user", "content": "Hello"}, # RPA抓取的数据
],
stream=False,
reasoning_effort="high",
extra_body={"thinking": {"type": "enabled"}}
)
print(response.choices[0].message.content)
几个衍生场景举例:
- 电商竞品价格监控: RPA抓取竞品价格 -> AI判断是否跌破红线并生成调价建议 -> 飞书推送给运营总监审核。
- 智能客服客诉预警: RPA抓取昨日售后聊天记录 -> AI分析提取出带有“愤怒”、“投诉”情绪的对话 -> 飞书生成工单推送给客服主管跟进。
- 财务发票智能初审: RPA读取共享文件夹的报销单和发票 -> AI对比金额与抬头 -> 无误则推送到财务群记录,有误则打回重提。
结语
把重复的劳作交给RPA,把繁杂的总结交给AI,把最终的决策留给人类。希望这篇实战分享能为你的自动化转型提供新思路!
更多推荐




所有评论(0)