director

SkillMedia

Directs and produces multiple types of videos, carrying projects from idea, research, script, visual development, character and sound design, storyboarding, and generation prompts all the way through asset generation, task tracking, and delivery. Applies to Storytime Animation, Animated Explainer, a

Available today. Use it from your connected AI after setup.

Connect ahel once, and every AI you use reads what you have installed.

Then ask your AI: use the director skill

What this skill tells your AI

The instructions your AI receives, as published by s1dashu/director in SKILL.md and read by ahel’s review.

director 是视频创作与制作的顶层导演 skill,不以动画、旁白或任何单一题材定义自身。它负责先判断作品类型和创作目标,再把任务路由到经过验证的 Mode、style、共享资产与执行工具。

核心架构

把每支视频拆成三层选择:

  1. Mode 决定内容目标、叙事方式、素材结构、声音角色、写作重点和制作流程。
  2. Mode 专属 style 与共享资产 决定视觉语言,并在需要时提供可跨 Mode 复用的人物参考与音色。
  3. Tool 决定如何在用户选定的 CLI 平台上查询模型、上传素材、生成、跟踪、下载和拼接。

三者不互相替代。先选择 Mode,再从该 Mode 的 styles/ 中选择 style 并确认共享资产,最后选择执行 CLI。

Mode 选择与路由

用户已指定 Mode 时直接使用。未指定时,根据视频的核心驱动力推荐;无法判断时再询问作品主要由个人经历、知识解释、现实证据,还是人物行动与戏剧冲突驱动。不要因为当前已实现的 Mode 以旁白驱动为主,就把所有视频默认解释成动画解说。

  • Storytime Animationstorytime-animation):由第一人称讲述者与个人经历驱动,用动画重现自己、身边人或明确改编的故事。已完成首支五片段作品的生成与质量验证。
  • Animated Explaineranimated-explainer):使用旁白和动画,在一支短片中讲清楚一个概念、理论、人物思想、历史事件或知识主题。这就是重构前已经完成多期实作验证的原有工作流。
  • Cinematic Dramacinematic-drama,剧情影像):把已确认的世界观、人物设定、剧本和指定情节制作成由人物行动、对白与戏剧冲突驱动的 AI 电影、AI 漫剧、短剧或微电影。已完成端到端作品验证。 选定 Mode 后,在任何采集、研究、写作、分镜或素材规划之前完整读取对应 workflow.md 及其指定的专属文档。不把 Animated Explainer 的旁白结构、字数、分镜、封面或纯动画切片流程默认套用到其他 Mode。

当前能力与扩展边界

当前只有上方列出的三个 Mode 属于已进入实现的制作能力,三者均已完成实际作品验证。音乐视频及其他尚未建立 Mode 的类型属于 director 的计划扩展范围,但只有建立独立 Mode、完成真实作品验证并得到用户确认后,才能标记为已验证。

用户要求尚未建立专属 Mode 的视频类型时,明确说明当前缺少该类型的专属工作流;可以与用户共同定义目标、输入、叙事结构、素材策略、质量门槛和验证作品,但不得静默套用 Animated Explainer 或 Storytime Animation。新增 Mode 应放入 modes/<mode>/,把类型专属流程、style 和 Prompt 方法留在该 Mode 内;只有真正跨类型复用的能力才提升到 references/

声音是各 Mode 的创作选择,不是 director 的身份边界。未来 Mode 可以由对白、同期声、音乐、纯画面或多种声音结构驱动;只有当前 Mode 明确要求统一旁白或声音身份时,才进入音色锚点流程。

Mode 专属 style 与共享参考资产

每个 style 默认只属于一个 Mode,并与该 Mode 的内容目标、素材结构和 Prompt 方法一起验证。不向用户展示其他 Mode 的 style,也不在未验证时默认跨 Mode 混用。只有一个 style 已经通过多个 Mode 的实际作品验证并得到用户确认后,才将它提升为明确的跨 Mode 共享 style。

Storytime Animation

Animated Explainer

Cinematic Drama

用户未指定 style 时,只展示当前 Mode 的内置或候选选项并等待选择,不设置静默默认值;自定义文字 style 与该 Mode 的内置 style 具有同等优先级。style 只定义跨作品稳定的媒介、材质、线条、造型、色彩和运动语言,不是固定 Prompt、场景或镜头模板。候选 style 必须明确验证状态,样片经用户确认后才可标记为已验证。

共享 references 只维护跨 Mode 能复用的能力:

当 Mode 需要人物参考时,只为必须稳定识别的人物生成参考图,不为一次性群演生成。人物参考承担身份、相貌、比例、服装与材质职责。Animated Explainer 与 Storytime Animation 不生成或连接统一场景图、画风参考图或风格参考图;Cinematic Drama 将人物分为主角、配角和路人,主角与跨片段配角必须有人物和音色参考,路人不固定。三视图按角色重要性与制作速度选择:主角默认建议制作,重要配角按需制作,次要配角可使用单张参考。style 始终使用纯文字规则锁定,不使用抽象的统一画风参考图替代 style。

内置音色的唯一正式媒体源为顶级目录 voices/,权威清单为内置音色库。宿主项目可以额外登记私有人物与音色,但不得扫描历史作品冒充正式资产库。repository-assets/ 只保存 README 封面、效果示例和 style 预览等仓库展示素材,不属于 skill 执行资产,也不得被工作流当作生成输入。

执行工具路由

Mode 和执行工具相互独立:Mode 决定制作什么,工具文档决定如何在用户选定的平台上生成、管理和下载媒体。任意 Mode 都可在平台能力足够时选择任意已适配 CLI。

  1. 用户已指定 CLI 时,完整读取对应工具文档并使用该路径。
  2. 用户未指定时,先检查宿主项目已配置的媒体 CLI;有可用工具时向用户说明选择。
  3. 没有任何可用 CLI 时,优先建议安装 LibTV CLI,但不未经用户同意自动安装。
  4. 当前工具缺少必要能力、登录或最新文档时停止,不猜测命令,不静默切换其他平台。

当前工具文档:

  • LibTV CLI:当前正式维护且验证最充分的执行路径。
  • 即梦 CLI:已完成 OAuth、session、生成模式、Seedance 2.0 全能参考、异步查询与 CLI 下载的文档适配,尚未完成付费生成和完整作品的端到端实作验证。

工具专属命令、模型别名、输入模式、参数映射、任务跟踪和下载规则只在对应 tools/ 文档中维护,不在 Mode、style 或共享 references 中复制。

全 Mode 共享的片段规则

  • 同一支作品中,相同时长片段的旁白长度应尽可能接近。模型可能按文本量动态改变语速;如果相邻片段文字量差异过大,即使视频时长相同,也会造成一段明显赶读、下一段突然放慢的节奏波动。需要容纳更多信息时,优先改稿或重新拆分片段,不依赖模型大幅加速朗读。
  • 使用 15 秒口播片段时,在语义自然和画面有足够阅读时间的前提下,尽量向约 60 个中文汉字或 30 个实际朗读英文单词靠拢,并让全片各段落在相近范围内。Animated Explainer 中文旁白仍优先落在 59–61 个汉字,只有为了语义自然完整时才放宽到 58–62 个汉字;英文 Storytime 通常保持 28–32 个单词且超过 32 个必须先缩短确认,Animated Explainer 以约 32 个英文单词作为可调整目标。
  • 任何 Mode 编写多镜头视频 Prompt 时,相邻镜头默认直接硬切,不写擦除、形变、融化或其他装饰性转场。只有连续性本身是创作重点的特殊长镜头,尤其长时间动作、追逐或打斗编排,才设计不中断的连续调度。
  • Cinematic Drama 的正式片段固定使用 Seedance 2.0 Pro、720p;不主动试用 Seedance 2.5 Pro,不主动升级 1080p。常见快节奏片段以 5 镜为起点,需要长表演、复杂动作或情绪停顿时使用 4 镜或 3 镜。

旁白驱动动画的共享生产流程

以下流程当前适用于 Animated Explainer 和 Storytime Animation。各 Mode 的采集、研究、结构、写作、视觉职责和质量门槛以对应 Mode 文件为准。

  1. 按 Mode 完成讲稿。 完整执行对应 Mode 的前期与写作流程,并遵循上方共享片段规则。将讲稿和拆分结果交给用户审阅;确认后立即保存为作品文档目录中的独立 旁白.md
  2. 规划必要人物参考。 完整读取人物指南,允许 Animated Explainer 没有关键人物;Storytime Animation 的讲述者默认是关键人物。按实际需要生成、确认并记录人物映射。
  3. 逐片段编写并保存 Prompt。 完整读取当前 Mode 的专属 Prompt 指南(如果已有)、所选 style、共享视频 Prompt 指南和目标模型官方指南。每完成一个片段,立即保存为作品文档目录中的独立 Markdown 文件。
  4. 选择音色路线并只生成片段 1。 正式生成前,读取内置音色库,明确询问用户使用已有音色还是通过片段 1 新建音色。已有音色从片段 1 起连接;新建音色的片段 1 不连接音频参考。两条路线都只先生成片段 1,交给用户确认。
  5. 锁定统一音色锚点。 已有音色路线继续复用同一份标准化音频;新建音色路线按音色指南从已确认片段 1 建立独立音频素材。
  6. 并行生成后续片段。 从片段 2 开始全部使用已锁定的同一音色锚点;当前片段的准确旁白仍只由当前 Prompt 决定。
  7. 确认返回并交付剪辑。 使用选定工具文档完成任务跟踪。每个视频任务只要返回成功终态和可用资源 URL,就必须立即下载到当前作品的 video/ 目录,不得只报告节点或任务 ID。下载后向用户返回可访问的本地文件路径;宿主支持媒体渲染时,在最终回复中直接展示可播放视频。默认只确认成功终态、可追溯 ID、资源完整性和下载成功,不主动抽帧或听写;用户明确要求或返回异常时才做针对性内容检查。任务失败或平台未返回资源 URL 时,明确说明不存在可下载文件,不伪造交付。全部片段生成后,提示用户在剪辑工具中手动拼接并轻量修剪局部废帧、片尾画面或声音毛刺。只有用户明确要求时,才由 Agent 执行自动拼接。

需要封面时读取当前 Mode 的封面指南。目前只有 Animated Explainer 封面指南 已建立专属流程;不将它默认套用到其他 Mode。

任务路由

任务必须完整读取
选择 Mode,或开始采集、研究、写作、分镜与制作当前选定的 Mode 文件
编写、改写或拆分 Animated Explainer 旁白Animated Explainer 流程旁白讲稿写作指南
采集、改编或编写第一人称故事Storytime Animation 流程
制作 AI 电影、AI 漫剧、短剧或微电影Cinematic Drama 流程视觉与声音参考资产指南和当前 style
编写、改写或排查 Cinematic Drama 视频 PromptCinematic Drama 流程专属视频 Prompt 指南、当前 style、共享视频生成 Prompt 指南和目标模型官方指南
规划或生成人物参考人物参考图指南、当前 Mode 和所选 style;Storytime 另读人物形象库,Cinematic Drama 另读视觉与声音参考资产指南
编写、改写或排查视频生成 Prompt当前 Mode、共享视频生成 Prompt 指南和目标模型官方指南
选择、建立、转换或更换音色内置音色库音色参考与音频转换指南
生成、比较、修改或质检 Animated Explainer 封面Animated Explainer 封面指南
安装、选择或执行媒体 CLI选定的 Tool 文件

Seedance 官方指南较长,定向排查时优先搜索:基础公式多模态参考编辑视频延长视频定义主体使用分镜时序动作描述要求运镜写法特殊字符规范音色参考不准人物 ID 漂移风格漂移视频延长 vs 分段拼接视频结尾有噪音中文发音不准

共享质量门槛与失败条件

进入生成前,先通过当前 Mode 的专属质量门槛和共享视频 Prompt 检查。以下任一情况存在时,不得进入后续批量生成或最终交付:

  • 当前 Mode 尚未选定,或未完整读取对应工作流。
  • 用户要求的 Mode 尚未建立必要执行能力,但仍试图用另一 Mode 的流程伪装完成。
  • 任一必须稳定识别的人物缺少已确认人物参考,或参考素材职责、编号与实际连接顺序不一致。
  • Cinematic Drama 中任一主角或跨片段配角缺少人物参考或独立音色,计划要求的三视图未完成,换装卡未使用已确认人物参考走图生图,连续性关键场景缺少参考图,反复出现或承担关键动作的武魂/召唤物/生物/关键道具缺少参考图,当前片段遗漏实际出现的连续性资产,或正式节点不是 Seedance 2.0 Pro、720p。
  • 当前 Mode 需要统一音色,但片段 1 的音色尚未确认,或后续片段没有实际使用已锁定音色锚点。
  • 选定 CLI 缺少登录、最新能力信息、必要模型能力或可追溯任务信息。
  • 任一媒体任务未返回成功终态,或任务 ID、节点/项目 ID、资源 URL 等目标平台应提供的关键追踪信息缺失。

失败时保留 Mode、style、工具、模型、参数、素材映射、任务 ID、终态和 stderr 或等价日志。修正真实原因后重新执行,不静默换 Mode、style、模型或平台。

交付原则与信息优先级

默认使用用户当前使用的语言回复;用户明确指定其他输出语言时,遵循用户指定的语言。

创作草稿默认先在对话中使用普通 Markdown 段落展示,不放入 textplaintext 或其他代码块。讲稿经用户确认后保存为独立 旁白.md;每个视频 Prompt 片段也分别保存为独立 Markdown 文件。这些文件与人物、素材等生产文档平铺在当前作品的同一文档目录,并向用户返回文件路径。

信息冲突时:内容与叙事方法以当前 Mode 为准;视觉语言以用户选择的 style 和已确认人物参考为准;模型提示能力以最新官方指南为准;平台命令、模型名、输入能力与参数以当前 CLI 和实时 schema 为准。

Signals

GitHub stars
756
Forks
102
Last commit
Aug 2026
Advanced
Catalog kind
skill
Gateway key
director-s1dashu
Source
github.com/s1dashu/director