AGENT PROFILE · 已在飞书运行

分镜小文

一个固定内容账号专属的分镜提示词策划 Agent:把已经完成的中文口播,转化成下游生图、生视频人员可以直接执行的完整提示词包。

已部署 Hermes · 飞书
服务对象一个固定内容账号
工作方式先方案,后逐镜
人工节点方向与镜头审核

它是什么

这是一个视频前期策划助手。它不负责把视频真的生成出来,而是负责把“口播想法”翻译成下一位员工不用猜就能执行的镜头说明书。

省了什么人工

之前

每条视频重新拆解

人工区分镜头、反复补写主体、场景、动作、声音和模型限制;一次记录中,提示词环节约 35 分钟仍只完成 80%。反馈容易散落在聊天记录里。

现在

Agent 先出可审核初稿

小文按固定流程先给整体方案,确认后逐镜生成;已确认镜头锁定,反馈进入相应规则。首次回复通常约 1–3 分钟,之后由人工审核。

当前量化:提示词初稿约 35 分钟且未完成 → Agent 首次回复约 1–3 分钟。人工审核与模型抽卡耗时不计入这一数字,后续会继续用真实任务校准。

用了什么工具

Codex
阅读真实工作复盘,把 SOP 整理成 Profile、Skill、模型适配器和可维护的规则文件,并协助测试。
Hermes
承载小文的身份、主模型、Skill 与工具,让她按固定岗位流程运行,并连接消息渠道。
飞书开放平台与命令行配对
模板中所称的“飞书 CLI”环节:创建机器人入口、接收消息,并通过 Hermes pairing 完成用户授权。

输入

  1. 已完成的中文口播文案直接粘贴,或提供可读取的 Markdown / 文本文件。核心观点应已确认。
  2. 目标时长例如“约 3 分钟”,用于控制镜头数量、单镜时长与整体节奏。
  3. 账号主人物标准参考图人物正面图与四视图;没有图片时可以先做方案,但不能保证人物一致性。
  4. 目标生成模型(建议提供)例如可灵 2.6、可灵 3.0、Vidu;未指定时先输出模型中立方案,并标记待适配项。
  5. 可选补充音频偏好、已有实拍素材、网络梗图标记、禁用画面与保存目录。

如何触发

在飞书中找到“分镜小文”,发送一条包含任务、文案和必要参数的消息。第一次只要求整体方案,不要让她提前批量写完整提示词。

使用分镜小文。请读取下面这篇已完成口播,主人物使用账号标准参考图。

目标时长:约 3 分钟
目标模型:可灵 2.6

先只给我情节与画面方向方案,不要开始逐镜写完整提示词。

文案:[粘贴正文或提供文件]

确认整体方向后回复:“方向确认,从分镜 1 开始。”小文会一次只交付一个镜头。满意时回复“锁定”;需要修改时说明原因,小文应生成新版本而不是覆盖旧结果。

输出示例

阶段一会给出叙事推进、镜头类型、时长、对应原文、画面梗概、风险与备选;阶段二则按固定结构交付每个镜头:

场景主体动作台词 / 配音镜头语言画面风格音频限制限制
在飞书中向分镜小文提交完整口播并附参考图的真实运行截图
真实任务输入:完整口播、镜头标记与人物参考图已提交给飞书中的分镜小文;公开版已遮挡账号与赛道信息。点击查看公开版原图。

成功运行截图

分镜小文输出分镜一完整提示词包的真实运行截图
2026 年 8 月 19 日真实运行:小文进入阶段二,输出分镜 1 的版本、时长、模型、音频策略、素材预检、画面说明和提示词。点击查看原图。

圈友怎么用

这个机器人是内容账号的内部岗位,展示页不开放直接对话权限;圈友可以按下面的结构复现自己的版本:

  1. 选一个小职责。用“同一职责、同一结果、同一验收”划边界,不从全自动工作流开始。
  2. 整理 Profile。写清它是谁、服务谁、唯一交付物、不能做什么、什么时候必须停下来问人。
  3. 沉淀 Skill。把 SOP、输出格式、异常处理和反馈更新规则写成可反复读取的文件。
  4. 在 Hermes 建 Profile。配置主模型,把 Profile 与 Skill 放入对应目录,并在本地完成一次真实任务。
  5. 连接飞书。在飞书开放平台创建机器人,配置所需权限与事件,通过 Hermes pairing 批准使用者。
  6. 用失败更新规则。模型特有限制放到模型适配器,通用经验才进入主规则;每次修改后重新跑真实样例。

复现的最低验收:一个陌生人只看说明书,就知道要提交什么、小文先输出什么、何时需要确认、怎样继续到下一镜,以及哪些结果不能直接相信。

注意事项

  • 它做不了:不改写已确认的核心观点;不替人实际生图、生视频、配音、剪辑或发布;不搜索文案中标记的网络梗图。
  • 必须人工介入:确认整体方向、审核并锁定每个镜头、选择参考图、判断抽卡结果和最终审美;登录、付费、发布和重要写入必须再次确认。
  • 已知问题:不同视频模型的时长、声音、文字和参考图能力不同,不能把 Vidu 或可灵某一版本的经验写死为通用规律。
  • 视觉能力:当前主模型为 DeepSeek。没有成功调用视觉工具时,小文必须标记“未视觉检查”,水印保险提示词也不等于技术保证。
  • 后续改进:接入独立视觉模型;继续积累可灵、Vidu 等模型适配器;用更多真实任务测量人工审核与总耗时。