自动化

Creator Operations Automation Toolkit

把社交数据采集从 Excel 批处理演进为可由飞书触发、可校验、可回写的运营自动化链路。

当前版本
Current toolkit
状态
工作原型
我的角色
工作流设计 / 浏览器自动化 / 飞书集成 / 可靠性设计
公开状态
本地演示
最后验证
2026.07.18
当前产品事实

这是一个面向创作者运营的自动化工具集合,而不是三个独立旗舰产品。它记录了从 Excel Batch、浏览器自动化到 Feishu Workflow Bot 的演进,并把幂等、锁、重试、回读验证和错误分类作为工作流的一部分。

问题

先定义真实工作流问题,再选择技术。

01

运营数据分散在社交平台链接、Excel 和飞书多维表格中,人工复制与核对成本高。

02

浏览器自动化会受到登录态、页面结构、风控页和网络波动影响,不能只追求抓到数据。

03

写回动作必须避免重复执行、覆盖有效值或在部分失败后给出错误成功提示。

当前工作流

已经存在并可验证的业务路径。

  1. 01
    Excel Batch

    从链接列批量识别平台并回填浏览、点赞等公开指标。

  2. 02
    Browser Automation

    复用登录态访问目标页面,并对失败与浏览器恢复做处理。

  3. 03
    Feishu Trigger

    通过群内 @ 或私聊消息启动一次受控同步任务。

  4. 04
    Read

    读取多维表格记录、目标字段和当前值。

  5. 05
    Parse

    解析卡片与社交链接,并匹配表、字段和平台。

  6. 06
    Write

    按空值或刷新策略串行写回,跳过未变化数据。

  7. 07
    Verify

    写入后回读目标字段,确认值与预期一致。

  8. 08
    Reply

    把成功、部分成功、登录风险或字段错误反馈给操作者。

关键产品决策

决定产品边界的选择与取舍。

01

把幂等和任务锁放在入口

背景
飞书事件可能重复投递,用户也可能在前一任务未结束时再次触发。
决策
按消息 ID 去重,并使用单任务锁限制并发执行。
取舍
当前更适合串行运营任务,不追求高并发。
结果
降低重复抓取、重复写回和状态相互覆盖的风险。
02

先读后写,并跳过未变化数据

背景
盲目覆盖会破坏人工维护值,也会制造不必要的 API 请求。
决策
读取当前字段,按空值/刷新策略决定是否写入,并跳过相同值。
取舍
每次同步增加一次读取与比较。
结果
写回行为更可控,也保留人工运营判断。
03

写回后必须回读验证

背景
API 返回成功不等于业务字段已正确落位。
决策
写入后重新读取目标记录,验证字段和值。
取舍
执行时间和 API 调用增加。
结果
回复消息基于已验证结果,而不是只基于请求状态。
04

显式区分可重试与人工处理错误

背景
网络错误、登录失效、风控页、字段不匹配需要不同处理。
决策
对 API 与浏览器操作设置有限重试,并分类记录登录、风控、404 和配置错误。
取舍
错误模型和日志结构更复杂。
结果
系统不会把所有失败都包装成同一种提示,也不会无限重试。

架构

技术围绕产品责任组织。

触发层

入口只负责确认操作者、目标表与任务意图,避免在消息层混入采集逻辑。

Feishu long connection

群内 @ / 私聊

允许用户列表

消息幂等

编排层

把读、解析、采集、写回和回复拆成可观察的顺序步骤。

任务锁

多表配置

DRY_RUN

结构化日志

浏览器自动化

浏览器只承担公开页面读取,并把登录态和页面异常作为显式边界。

Playwright

本地登录态

平台链接识别

风险页检测

可靠性

结果必须经过写前比较、串行写入与回读验证后才能对外回复。

unchanged skip

有限重试

read-back verification

错误分类

TypeScriptPlaywrightFeishu SDKZodExcelStructured Logs

产品证据

先看证据,再判断能力。

该案例优先展示真实工作流、代码边界和可靠性机制。为避免公开飞书表格、账号登录态或运营数据,本阶段不使用敏感后台截图。

Current:Feishu 长连接、群内 @ / 私聊触发、表格卡片与链接解析。

Current:小红书公开指标读取、字段匹配、串行写回与回读验证。

Current:消息幂等、单任务锁、DRY_RUN、有限重试和错误分类。

Prototype:Instagram / YouTube Excel 批量采集与浏览器恢复。

Planned:服务监督、多平台统一连接器与更完整的可观测性。

项目成果

系统为运营工作带来的改变。

将一次性 Excel 批处理沉淀为可复用的数据采集基础。

把小红书公开指标同步接入飞书消息触发与多维表格回写链路。

通过幂等、锁、DRY_RUN、重试和回读验证降低误写与重复执行风险。

让运营人员在飞书中收到可解释的成功、部分成功或人工处理提示。

当前限制

边界本身也是产品设计的一部分。

当前边界

当前飞书链路只确认支持小红书公开点赞、评论和收藏指标;Instagram / YouTube 仍属于独立 Excel 批处理原型。

Creator Metrics Crawler 当前可靠实现集中在浏览量与点赞量,不将 README 中未被代码充分验证的评论能力列为完成项。

Playwright 登录态仍需人工维护,风控与页面结构变化可能要求人工介入。

当前没有确认的云端常驻服务或生产部署,不把本地运行描述为无人值守平台。

后续多平台连接器、任务队列和服务监督属于 Planned,不是 Current。

版本演进

持续记录产品如何形成。

  1. Current 01

    Excel Batch

    从表格链接批量识别 Instagram / YouTube 并回填公开浏览、点赞指标。

  2. Current 02

    Browser Automation

    加入登录态、重试、浏览器恢复和部分成功状态。

  3. Current 03

    Feishu Workflow Bot

    完成触发、读取、解析、小红书采集、写回、验证与回复。

  4. Prototype

    本地常驻工作流

    可在受控本地环境运行,但仍依赖人工登录态和环境维护。

  5. Planned

    统一连接器与运行保障

    多平台、服务监督和更完整可观测性尚未实现。

下一步

从已经验证的边界继续。

为本地常驻进程补充正式服务监督与健康检查。

把平台解析器收敛为一致接口,并为 DOM 变化增加回归样本。

在公开展示前继续脱敏日志和表格数据,保留流程证据而非业务数据。