灵雀 Alauda 是一款本地 AI 短剧与漫剧创作工具:项目、剧本与生成素材保存在你的电脑上,自行接入通义、火山 Seedance / 即梦、可灵、Agnes、Gemini 等 API,从故事梗概做到可导出的剧集视频。操作步骤见创作流程,能力矩阵见支持的 AI 服务。
功能全景一览
| 模块 | 核心能力 |
|---|---|
| 项目管理 | 新建 / 导入导出 ZIP / 内置示例 / 剧集管理 / 亮暗主题 |
| 剧本创作 | 梗概生多集剧本 / 小说 TXT 分章导入 / 故事线多 Agent / 剧本库互导 |
| 角色·场景·道具 | AI 提取 / 批量生图 / 四视图 / 多阶段造型 / 全景扩展 / 全局素材库 |
| 分镜与视频 | 经典分镜 / 全能模式 / 宫格生图 / 首尾帧 / 尾帧衔接 / 历史版本 |
| 音频与导出 | 解说旁白 / 对白·解说 TTS / SRT 导出 / 分镜表 HTML·Excel / 整集合成 |
| 画布工作流 | 节点流水线 / 框选重跑 / 批量生图·视频 / 参考图上传自选 / 虚拟渲染 |
| 自动化 | 一键全流程 / 一键故事线串联 / 智能跳过 / 失败重试 / 任务恢复 |
| 辅助工具 | 自由创作 / 媒体库 / 仿真沙盘 / 合规扫描 / 创作偏好调优 |
| AI 与会员 | 三类模型独立配置 / 多厂商预设 / ModelArk / 官网登录·激活·自动更新 |
上表为速览;下表各能力均有独立说明,可按模块跳转阅读。
核心能力详解
一、项目管理
新建项目
在首页点击「新建项目」,填写剧名、梗概,并选择画幅(16:9 横屏、9:16 竖屏、1:1 方图)与画面风格(写实、动漫、国风等)。创建后即可进入「AI 视频生成」页开始写剧本、做分镜。每个项目对应一部短剧或漫剧,数据独立存储,互不影响。
导入 / 导出 ZIP
项目列表支持将整个工程打包为 ZIP 文件导出,里面包含剧本、分镜、角色场景道具配置以及已生成的图片和视频路径。换电脑、备份或发给协作者时,用「导入 ZIP」即可完整恢复工程。适合长期存档,也适合在不同机器之间迁移创作环境。
内置示例
首次安装后,客户端自带「灵雀入门示例」工程。你不用先配置 API、也不用从零搭结构,打开示例就能浏览一个完整项目长什么样:分集怎么组织、分镜怎么排列、角色场景如何关联。适合快速熟悉界面和流程。
剧集管理
进入某个项目后,可在「剧集管理」页查看所有分集、各集完成进度,以及整部剧的角色、场景、道具总览。这里适合统筹多集结构——比如哪几集剧本已写好、哪几集分镜还没出图,而不必逐集点进制作页翻找。
亮 / 暗主题
列表页、制作页、画布模式均支持浅色与深色界面切换。长时间盯屏写剧本或调分镜时,可按个人习惯选择更护眼的主题,不影响任何功能与数据。
二、剧本创作
梗概生多集剧本
在「AI 视频生成」页输入故事梗概和风格描述,AI 会扩展成多集剧本(一次可生成 1–6 集连续内容)。生成后每一集的标题和正文都可以自由修改、增删。适合从一句话创意快速拉出可拍摄的剧本文本,再人工精修台词和节奏。
小说 TXT 分章导入
如果你已有小说或长文,可粘贴或上传 TXT / MD 文件。系统会按章节自动拆分,预览每章对应哪一集,确认后批量写入各集剧本。适合把网文、手稿改编成短剧分集,省去手动复制粘贴的工夫。
故事线多 Agent
除了直接生剧本,还可以走「故事师 → 大纲师 → 导演」三步流水线:先由 AI 写出完整故事线,再按故事线生成各集剧本,最后由「导演」审核故事与各集是否一致,并给出修订建议。支持分步执行,也支持一键串联跑完全程;还可选择「自动应用修订」,让导演直接改稿。同一项目不会并行跑多套剧本任务,避免各集内容互相覆盖。
剧本库互导
你可以从本机的其他项目中,只导入「梗概 + 各集剧本文本」到当前工程,而不会带入那边的角色、分镜、图片或视频。适合同一世界观开新剧、或把旧项目的剧本骨架复用到新项目,同时避免素材互相污染。
三、角色 · 场景 · 道具
AI 提取
写好某一集剧本后,可让 AI 自动从正文里识别出场角色、场景和道具,生成清单。你可以在清单上增补、删改,再批量或逐个生成参考图。若剧本为空,系统会提示先填写各集剧本;提取失败时会展示具体原因,方便排查。
批量生图
角色、场景、道具列表支持勾选多条后一次性提交生图任务。系统会排队调用你配置的图像模型,底部任务面板可查看进度。适合刚提取完清单、需要快速铺满参考图的阶段。
四视图
场景和道具可选择「四视图」模式:一次生成前、侧、后、顶四个角度的参考图(纯色无缝背景),方便模型理解物体的空间结构。能减少「只有一个角度、换机位就穿帮」的问题。
多阶段造型
同一角色可维护多套形象,例如「少年期」「成年期」「战损版」。做分镜时按剧情阶段选用对应造型,避免整部剧一张脸走到底,也避免不同章节造型混乱。还可配合 Seedance 2.0 角色认证与音色上传,提升视频里的人物一致性。
全景扩展
场景在已有主参考图的基础上,可再扩展一张 2:1 超宽全景图,用于表现大环境、远景或横移镜头。全景不会覆盖原来的主图,画布场景面板里可一键触发,并预览缩略图。
全局素材库
角色、场景、道具可以存入跨项目复用的素材库。新项目里遇到同名或相似资产,可直接从库中选用,不必重复生图。某一集里还可以把库中场景、道具「加入本集」,快速完成搭景。
四、分镜与视频
经典分镜
经典模式是「文本分镜 → 静帧图片 → 视频片段」的传统链路。每一镜可编辑景别、运镜、灯光、景深、对白和画面提示词;首尾帧项目还可分别生成首帧、尾帧再图生视频。适合通义、豆包等常规图生视频模型,也适合需要精细控制单镜画面的创作者。
全能模式
全能模式面向 Seedance 2.0、可灵 Omni 等多图参考视频模型。你在片段描述里用 @图片1、@图片2 指明参考哪张角色图、场景图,一次提交即可生成含复杂运镜的视频。支持流式「生成 / 润色全能提示词」,把结构化分镜信息转成模型更好理解的段落式描述。
宫格生图
首尾帧项目可选用双联、四联、九联宫格:一次 AI 生图产出 2 / 4 / 9 个连续画面,系统自动拆分并绑定到各镜的首帧、尾帧。比一镜一镜单独生图更连贯,也适合批量铺镜头的阶段。画布顶栏和列表模式均可切换宫格模式。
首尾帧
在首尾帧工作流下,每一镜可独立维护「首帧」「尾帧」两张关键静帧,再交给视频模型做区间过渡。系统会为首尾帧生成专用专业提示词(frame-prompt),比通用分镜提示词更贴合图生视频模型的输入习惯。
尾帧衔接
上一镜视频播放结束后,可一键提取其最后一帧,自动设为下一镜的首帧参考。这样相邻镜头在画面上更连贯,减少「硬切」带来的跳跃感。批量生视频时还可选用「连贯帧模式」,按顺序自动衔接。
历史版本
同一分镜的图片和视频会保留多次生成记录。若最新一次效果不满意,可回看、切换历史版本作为主图或主视频,用于合成或继续编辑,而不必覆盖丢失之前的尝试。
五、音频与导出
解说旁白
生成分镜时可勾选「生成解说旁白」:AI 会为每一镜写出与角色对白分离的画外音文案(纪录片式、第三人称叙述等)。解说单独保存在分镜字段里,便于后期配音或导出字幕,不会和对白混在一起。
对白 · 解说 TTS
分镜视频区提供「对白配音」和「解说配音」按钮,调用你配置的语音合成服务,把台词和解说转成音频文件,并支持试听。合成整集视频时,还可选择把各镜对白 TTS 按时间轴混入成片音轨。
SRT 导出
按分镜顺序与各镜时长,自动累计时间轴,将非空解说文案导出为标准 SRT 字幕文件。可交给剪辑软件叠加字幕,或作为配音脚本的参考。
分镜表 HTML · Excel
一键导出当前集分镜表:HTML 版适合浏览器审阅、打印或发给导演/制片;Excel 版适合在表格里批注、排序、分工。导出内容包含镜号、景别、运镜、场景角色道具、对白、解说、提示词、全能片段等字段。
整集合成
当各镜视频就绪后,可将本分镜按顺序拼接为一条完整剧集视频文件。合成前会做「导出就绪检查」,提示哪些镜还缺图或缺视频。本地 ffmpeg 负责拼接与音轨混合,无需上传云端。
六、画布工作流
节点流水线
画布模式把一集制作可视化成竖排节点:剧本 → 分镜 → 静帧(首帧/尾帧/主图)→ 视频。与列表模式读写同一份数据,但更适合纵览整集进度、按流水线批量推进。详见画布工作流。
框选重跑
在画布空白处拖拽框选多个节点,可将其作为一个「工作流组」整组重新生成(例如某一组分镜全部重跑生图)。适合局部推翻重来,而不必整集从头生成。
批量生图 · 视频
画布顶栏提供「本集生成」:可 AI 批量生成分镜脚本、批量生成分镜图、批量生成分镜视频。批量生图时可选择单张、双联、四联、九联宫格模式,与列表模式能力对齐。
参考图上传自选
在画布分镜操作面板,可上传首帧、尾帧或主图;生图前还能从本项目角色、场景、道具中手动勾选参考图,精确控制 AI 参考哪些资产。规则过滤之外,还支持 AI 自动挑选最相关的参考图,减少无关图片干扰。
虚拟渲染
当一集节点数量超过约 120 个时,画布自动启用视口虚拟渲染——只绘制当前屏幕可见区域的节点,避免大项目卡顿。配合小地图和 fitView,长流水线也能流畅浏览。
七、自动化
一键全流程
制作页的「一键生成」或「补全并生成」会按固定顺序自动执行:角色图 → 场景 → 道具 → 分镜 → 分镜图 → 分镜视频 → 整集合成。「补全并生成」只跑还缺的步骤,已有结果会跳过。适合想少点按钮、快速出初版的场景。
一键故事线串联
在剧本区可选择「一键 · 故事线→大纲→审核」或「一键 · 自动应用修订」,自动跑完故事师、大纲师、导演三步,无需手动点三次。任务在后台异步执行,面板显示当前 Agent 进度。
智能跳过
一键流水线或批量任务遇到「这一步已经有结果了」(例如角色图已存在、分镜视频已生成),会自动跳过该步,不重复消耗 API 额度与时间。你可以放心多次点「补全」,只补空洞。
失败重试
一键全流程中,某一步若因网络或 API 报错失败,系统最多自动重试 3 次。仍失败则停在当前步并给出错误信息,方便你改配置或改提示词后手动继续。
任务恢复
生图、生视频、故事线串联、批量润色等任务均在后台异步运行。刷新页面或暂时关闭软件后,再次打开可恢复进行中的任务状态;失败任务会展示具体原因(如 Key 无效、剧本为空),而不是笼统的「生成失败」。
八、辅助工具
自由创作
首页「自由创作」入口不绑定任何剧集,可单独做文生图、文生视频实验,并支持 AI 助写提示词。生成结果保存在本地历史中。适合在正式开项目前,先摸清某个模型、某种画风是否合适。
媒体库
集中浏览本机已生成的图片、视频素材,支持上传本地文件(单文件 ≤200MB)。素材可跨项目查看与管理,避免在多个工程文件夹里翻找文件。
仿真沙盘
项目内可进入「仿真沙盘」,用 AI 模拟不同受众视角下的留存、完播与热度,并给出故事修订建议。可导出 JSON 或 HTML 报告。适合在投入大量生图生视频之前,先判断故事方向是否吸引人。
合规扫描
剧本生成后,可对文本做合规检测,提前发现可能触及红线的表述。与仿真沙盘并列入口,属于「剧本写完后的检查」环节,帮助降低后期返工风险。
创作偏好调优
在项目设置中可配置创作偏好与合规红线(如语气、禁忌词、叙事风格)。这些偏好会在角色提取、分镜生成等环节自动注入 AI 上下文,让全链路输出更符合你的个人或团队规范,而不必每次手动改提示词。九类系统提示词也支持在设置中自定义覆盖。
九、AI 与会员
三类模型独立配置
文本(剧本、分镜脚本)、图片(角色场景分镜图)、视频(分镜片段)三类任务可分别配置不同服务商和模型。例如文本用通义、图片用即梦、视频用 Seedance,互不捆绑。在「AI 配置」页分别设置并测试连接即可。
多厂商预设
内置通义、火山、Agnes AI 等一键配置模板;也支持导入社区中转站 JSON 预设(见配置示例下载)。图床地址、超时与重试次数可在 config.yaml 中配置;缓存 URL 失效会自动重传。ComfyUI 接入见ComfyUI 配置。
ModelArk
若使用火山 Seedance 2.0 的多图参考与角色一致性能力,可对接火山方舟 ModelArk 私有资产库,管理角色认证素材。支持 AK/SK 与 Bearer 鉴权;未配置时系统会回退到其他可用链路。详见支持的 AI 服务。
官网登录 · 激活 · 自动更新
官网版客户端支持账号登录、1 天试用与卡密激活;也可从网页一键登录后自动唤起软件。软件内可检查更新并下载新版本安装包。安装版支持自定义目录,也有便携版可直接运行。详见会员与登录。
本地优先,数据不出本机
灵雀的所有工程数据保存在你的电脑上:SQLite 数据库存元信息,图片与视频按项目目录存放,默认路径为 %APPDATA%\alauda\。首次启动会自动迁移旧版数据。安装包内置 ffmpeg,首次运行自动解压,用于视频合成与尾帧提取等本地媒体处理——剧本与素材默认不上传云端,只有你配置的 AI API 请求会发往对应服务商。
稳定性与体验(v1.3.31)
- 首页列表:单条坏数据不再导致整页 500
- 后端未启动时给出明确提示;并行请求错误 toast 去重
- 剧本/故事线任务互斥,防止多任务覆盖各集内容
- 一键串联在任务超时或取消时正确停止
- 任务失败展示具体原因,便于排查 API 或配置问题