AGENT PROFILE · 已在飞书运行
分镜小文
一个固定内容账号专属的分镜提示词策划 Agent:把已经完成的中文口播,转化成下游生图、生视频人员可以直接执行的完整提示词包。
已部署
Hermes · 飞书
服务对象一个固定内容账号
工作方式先方案,后逐镜
人工节点方向与镜头审核
它是什么
这是一个视频前期策划助手。它不负责把视频真的生成出来,而是负责把“口播想法”翻译成下一位员工不用猜就能执行的镜头说明书。
省了什么人工
之前
每条视频重新拆解
人工区分镜头、反复补写主体、场景、动作、声音和模型限制;一次记录中,提示词环节约 35 分钟仍只完成 80%。反馈容易散落在聊天记录里。
现在
Agent 先出可审核初稿
小文按固定流程先给整体方案,确认后逐镜生成;已确认镜头锁定,反馈进入相应规则。首次回复通常约 1–3 分钟,之后由人工审核。
当前量化:提示词初稿约 35 分钟且未完成 → Agent 首次回复约 1–3 分钟。人工审核与模型抽卡耗时不计入这一数字,后续会继续用真实任务校准。
用了什么工具
- Codex
- 阅读真实工作复盘,把 SOP 整理成 Profile、Skill、模型适配器和可维护的规则文件,并协助测试。
- Hermes
- 承载小文的身份、主模型、Skill 与工具,让她按固定岗位流程运行,并连接消息渠道。
- 飞书开放平台与命令行配对
- 模板中所称的“飞书 CLI”环节:创建机器人入口、接收消息,并通过 Hermes pairing 完成用户授权。
输入
- 已完成的中文口播文案直接粘贴,或提供可读取的 Markdown / 文本文件。核心观点应已确认。
- 目标时长例如“约 3 分钟”,用于控制镜头数量、单镜时长与整体节奏。
- 账号主人物标准参考图人物正面图与四视图;没有图片时可以先做方案,但不能保证人物一致性。
- 目标生成模型(建议提供)例如可灵 2.6、可灵 3.0、Vidu;未指定时先输出模型中立方案,并标记待适配项。
- 可选补充音频偏好、已有实拍素材、网络梗图标记、禁用画面与保存目录。
如何触发
在飞书中找到“分镜小文”,发送一条包含任务、文案和必要参数的消息。第一次只要求整体方案,不要让她提前批量写完整提示词。
使用分镜小文。请读取下面这篇已完成口播,主人物使用账号标准参考图。
目标时长:约 3 分钟
目标模型:可灵 2.6
先只给我情节与画面方向方案,不要开始逐镜写完整提示词。
文案:[粘贴正文或提供文件]
确认整体方向后回复:“方向确认,从分镜 1 开始。”小文会一次只交付一个镜头。满意时回复“锁定”;需要修改时说明原因,小文应生成新版本而不是覆盖旧结果。
输出示例
阶段一会给出叙事推进、镜头类型、时长、对应原文、画面梗概、风险与备选;阶段二则按固定结构交付每个镜头:
场景主体动作台词 / 配音镜头语言画面风格音频限制限制
成功运行截图
圈友怎么用
这个机器人是内容账号的内部岗位,展示页不开放直接对话权限;圈友可以按下面的结构复现自己的版本:
- 选一个小职责。用“同一职责、同一结果、同一验收”划边界,不从全自动工作流开始。
- 整理 Profile。写清它是谁、服务谁、唯一交付物、不能做什么、什么时候必须停下来问人。
- 沉淀 Skill。把 SOP、输出格式、异常处理和反馈更新规则写成可反复读取的文件。
- 在 Hermes 建 Profile。配置主模型,把 Profile 与 Skill 放入对应目录,并在本地完成一次真实任务。
- 连接飞书。在飞书开放平台创建机器人,配置所需权限与事件,通过 Hermes pairing 批准使用者。
- 用失败更新规则。模型特有限制放到模型适配器,通用经验才进入主规则;每次修改后重新跑真实样例。
复现的最低验收:一个陌生人只看说明书,就知道要提交什么、小文先输出什么、何时需要确认、怎样继续到下一镜,以及哪些结果不能直接相信。
注意事项
- 它做不了:不改写已确认的核心观点;不替人实际生图、生视频、配音、剪辑或发布;不搜索文案中标记的网络梗图。
- 必须人工介入:确认整体方向、审核并锁定每个镜头、选择参考图、判断抽卡结果和最终审美;登录、付费、发布和重要写入必须再次确认。
- 已知问题:不同视频模型的时长、声音、文字和参考图能力不同,不能把 Vidu 或可灵某一版本的经验写死为通用规律。
- 视觉能力:当前主模型为 DeepSeek。没有成功调用视觉工具时,小文必须标记“未视觉检查”,水印保险提示词也不等于技术保证。
- 后续改进:接入独立视觉模型;继续积累可灵、Vidu 等模型适配器;用更多真实任务测量人工审核与总耗时。