AI Agent · 已上线运行

把剧情,精确定位到正片的那一秒

配图定位师是一个影视剧配图助手:把写好的甄嬛传文章发给它,它自动识别每处剧情,定位到第几集第几分几秒,抽出画面截图,并写进飞书多维表格。

它省了什么

原来 25–45 分钟一篇,现在约 5 分钟

最耗时的"逐帧找画面"被自动化;集数不再靠猜,时间戳精确到秒,还自带截图。

≈5分钟
单篇处理耗时
原人工 25–45 分钟
秒级
正片时间戳
原来只能到"第几集"
100%
附真实截图
原来没有截图

⏱ 之前 · 纯人工

  • 通读文章、逐条摘剧情
  • Google/Gemini 查集数,只到"第几集"
  • 打开视频全集拉进度条找画面、手动截图
  • 逐条填表,集数常靠 UGC 猜、易错

⚡ 现在 · Agent

  • 识别剧情 + 抽定位台词
  • 官方字幕匹配台词 → 秒级时间戳,集数自动校正
  • 本地下整集 → 抽帧 → 视觉确认画面
  • 自动写回飞书表格 + 执行报告

在线体验

发一篇文章给它,看它怎么定位

下面是一段真实运行的回放(2026-08-25 处理「滴血验亲」)。点击发送,观看它识别、定位、截图、写表的全过程。

配图定位师
在线
机器人
你好,我是配图定位师 👋 把今天写好的甄嬛传文章发给我,我会定位到正片的集数与精确时间点,并抽好截图写进飞书表格。

※ 纯前端回放,不联网、不调用任何真实账号或接口。重新播放

工作流

从一篇文章到一张截图,7 步

每一步都有判断与人工兜底:定位不到就标"待确认",绝不编造数据。

1

读取文章

接收 Markdown 全文,为空则终止并提示。

2

识别剧情 + 台词锚点

逐段提取剧情,为每条抽一句最具辨识度的台词。

3

字幕定位

下官方英文字幕,匹配台词取正片时间戳;哪集命中即为正确集数。

4

本地下整集 + 抽帧

yt-dlp 原生下载整集,ffmpeg 在时间点抽帧截图。

5

视觉确认

比对画面与硬字幕,不符则邻近微调重取(≤2 次)。

6

写入飞书

日期/剧情/集数/时间段/截图路径,逐条写入多维表格。

7

执行报告

汇总识别数、成功数、待确认与失败项,异常不遗漏。

能力边界

它能做什么,不能做什么

诚实划界,是这个 Agent 可靠的前提。

✅ 它能做

  • 识别文章中的甄嬛传剧情并提取台词锚点
  • 用官方字幕定位到正片集数 + 秒级时间戳
  • 靠"字幕命中哪集"自动校正集数,不依赖 UGC
  • 本地抽帧截图并做视觉确认
  • 结果逐条写入飞书多维表格并生成执行报告

⚠️ 它不做 / 需人工

  • 只处理甄嬛传,其他影视剧一律跳过
  • 不修改原文、不评价选题、不自动发布
  • 截图取自官方源,自带中文硬字幕(非纯净画面)
  • 台词匹配不到 → 标「待确认」交人工,不编造
  • 截图多次确认仍不符 / 写入失败 → 人工介入

技术栈

底层怎么搭的

各司其职:一个负责收发与推理,一个负责读写飞书,一套负责定位与截图。

Hermes 运行时

加载岗位 Profile,驱动工作流;飞书网关以机器人身份收发消息(长连接、后台常驻)。推理模型 DeepSeek。

飞书 CLI 数据

以你本人身份读写飞书多维表格:建字段、批量写记录,文件归属你自己。

yt-dlp + ffmpeg 定位

下官方字幕做台词→时间戳匹配,原生下载整集,ffmpeg 抽帧截图。

🔒 隐私与安全说明:本展示页为静态回放,不包含任何密钥、令牌、账号或私有数据,不接入你的 API,访客无法触发任何真实操作。页面所示表格与截图均为一次真实运行的公开样例。