让每一个镜头,自然抵达成片。
临时下载地址:https://t3.znas.cn/D9VkX3chzw2
软件著作权申请中(本软件免费开源使用,发现将该软件进行商业售卖必究!)
官方邮箱:xiaorannote@gamil.com
技术微信:XiaoRan-Note(BUG反馈文章留言或微信)
这不是又一个 AI 生图界面
拾帧 SHIFRAME,是一个面向 AI 漫剧、AI 短剧、动态漫画和 AI 视频创作者 的本地生产工作台。
它试图解决的,不是「再做一个生图工具」,而是一个更实际的问题:
当你真正开始做一集 AI 漫剧以后,如何管理几十个镜头、多个角色、提示词、首尾帧、ComfyUI 工作流,以及最终视频?
传统流程,往往长这样
text复制
剧本
↓
手工拆分镜
↓
写提示词
↓
整理角色参考图
↓
打开生图工具
↓
生成首帧
↓
生成尾帧
↓
打开视频模型
↓
生成视频
↓
手工整理文件
↓
发现角色不一致
↓
重新找图、改 Prompt、重新生成……镜头只有三五个时,这套方法还能工作。
可当一集出现 20、50 甚至 100 个镜头 以后,真正消耗时间的往往已经不是 AI 生成本身,而是:
资产管理
角色一致性
提示词管理
镜头状态
文件命名
生成队列
不同 AI 工具之间的反复切换
拾帧想做的,就是把这些零散步骤,重新组织成一条完整生产线。

一句话理解拾帧
你负责故事和审美。
拾帧负责把它组织成一条可以执行的 AI 视频生产流程。
生产线全景
text复制
拾帧 SHIFRAME
剧本
│
▼
AI 分镜拆解
│
┌──────────┼──────────┐
▼ ▼ ▼
角色资产 镜头语言 提示词
│ │ │
└──────────┼──────────┘
▼
首帧生成
│
▼
尾帧生成
│
▼
视频生成
│
▼
生成队列
│
▼
成片最应该反复强调的一点
拾帧不是模型,而是连接模型的生产工作台。
模型可以换。
ComfyUI Workflow 可以换。
API 可以换。
视频模型也可以换。
但是项目、角色、分镜和生产流程,留在拾帧里面。
这比「支持某某模型」更有长期价值。
功能模块
01|项目总览
拾帧首先把「一部作品」当成一个完整项目,而不是一堆散落在硬盘里的图片。
打开软件,你可以直观看到:
12 个镜头 / 4 个首帧 / 3 个尾帧 / 1 个视频
同时提供本集镜头导航。
创作者打开软件以后,马上就能知道:
我这一集做到哪里了?
而不是去 Windows 文件夹里翻:
text复制
001.png
001_new.png
001_new2.png
001_final.png
001_final_final.png
这是一个特别值得宣传的功能。
02|AI 分镜脚本
这是整个系统真正的起点。
用户可以直接输入一集剧情或者剧本。
例如:
白天,许映夏抱着课本穿过教学楼外廊。
教室靠窗座位上,周屿川把一张旧照片压进课本下……
拾帧会把剧情进一步拆解成:
每个镜头拥有独立的:
景别
时长
镜头描述
首帧提示词
尾帧提示词
视频提示词
角色信息
这意味着创作者编辑的,不再是一整坨 Prompt,而是一组真正可以管理的 Shot。
这也符合 AI 漫剧生产越来越明显的方向:实际工作流并不是「一句话直接生成完整影片」,而是要经过故事结构、角色连续性、分镜、关键帧、声音和审核等环节。

03|提示词工坊
这是产品里很容易单独拿出来宣传的功能。
很多普通用户最大的问题不是不会使用 AI,而是:
脑子里知道自己想要什么,但不知道怎么写 Prompt。
拾帧允许用户输入自然语言。
例如:
22 岁东亚女生,清秀,浅色针织衫,在摄影棚拍角色定妆照。
然后由 AI 自动补充:
构图
景别
摄影机
光线
人物姿态
服装细节
材质
一致性要求
Negative Prompt
最终生成可以直接交给图像模型的专业提示词。
我们不是:
❌ AI Prompt Generator
这种东西太多了。
我们可以叫:
导演级提示词扩写
一句想法,自动补全成可以生产的镜头语言。

04|角色资产系统
这个功能非常重要。
因为 AI 漫剧目前最大的实际问题之一,仍然是:
人物一致性
同一个角色到了不同镜头:
脸变了。
衣服变了。
发型变了。
甚至年龄都变了。
拾帧实际上已经在建立一套 Character Bible / 角色圣经:
text复制
01_角色设定/
许映夏/
01_定妆照/
02_六视图/
03_单独面部身份图/
04_服装细节/
周屿川/
01_定妆照/
02_六视图/
03_单独面部身份图/
04_服装细节/【配图建议:角色资产树状目录截图,或角色定妆照 + 六视图拼图。】
这个设计非常值得保留。
因为它意味着:
角色不再只是 Prompt 里的一个名字,而是整个项目可以重复引用的资产。
这正是 AI 长镜头/多镜头生产比单张生图复杂得多的地方。当前不少同类系统,也在重点解决 character continuity、reference assets 和跨镜头视觉一致性问题。
以后还可以继续扩展:
text复制
角色
├── 身份参考
├── 正脸
├── 侧脸
├── 全身
├── 六视图
├── 发型
├── 表情
└── 服装
├── X01 校服
├── X02 私服
└── X03 正装这会成为拾帧非常核心的资产层。
05|三阶段 AI 生产流水线
这是整个产品 最适合做 Demo 视频 的部分。
STEP 1
统一生成首帧
↓
STEP 2
统一生成尾帧
↓
STEP 3
统一生成视频
而且不是只能批量跑。
每个 SH 镜头仍然可以独立:
生成
重新生成
修改角色
修改服装
修改 Prompt
修改首帧
修改尾帧
重新生成视频

这种设计非常符合真正创作过程。
因为 AI 内容生产,不可能永远「一键成功」。
真正需要的是:
批量生产 + 局部返工
这个概念,建议直接成为宣传文案之一。
效果展示


06|ComfyUI 不再需要反复手动操作
ComfyUI 很强,但真正批量生产的时候,创作者经常需要:
text复制
打开 Workflow
↓
换图片
↓
换 Prompt
↓
Queue
↓
等待
↓
保存
↓
重命名
↓
下一个镜头几十个镜头以后,非常痛苦。
拾帧的定位可以直接说:
让 ComfyUI 从「操作界面」变成「AI 渲染后端」
用户在设置中绑定自己的 Workflow。
拾帧负责:
text复制
镜头
↓
Prompt
↓
角色参考
↓
首帧
↓
尾帧
↓
调用 ComfyUI
↓
等待任务
↓
获取结果
↓
归档
这句话很重要:
你仍然拥有 ComfyUI 的自由,但不再需要每天住在节点图里。
目前公开的 Storyboard / ComfyUI 工具,也在采用「导入 Workflow、识别参数、使用参考图生成」的思路。说明把 ComfyUI 作为可编排生成后端的模式,已经有明确需求。
07|生成队列
这部分看起来不起眼,但实际上很「生产工具」。
界面里已经有:
running / done / cancelled
当前耗时
超时
停止任务
查看结果
清理完成任务

这会让拾帧和普通「AI 玩具」拉开差距。
因为一个真正的 Production Tool,必须回答:
现在到底生成到哪里了?
宣传可以写成:
几十个镜头交给队列,创作者不用守着 AI。
08|本地优先
这个点建议重点强化。
拾帧应该明确告诉用户:
项目资产,属于创作者自己
角色图、镜头、生成结果、Workflow 和项目数据,都应该尽可能保留在本地。
用户可以:
自己选择模型。
自己选择 API。
自己选择 ComfyUI Workflow。
自己管理生成资产。
我们不是:
❌ 又一个 AI 平台。
我们是:
属于创作者自己的 AI 生产工作台
为什么要开源?
拾帧为什么免费开源?
因为我们不希望 AI 创作最终变成:
每增加一个镜头,就多付一次平台税。
AI 模型会更新。
工作流会变化。
今天使用模型 A,明天可能就是模型 B。
所以拾帧选择把自己放在模型之上。
不绑定某一家模型。
不绑定某一家云服务。
不锁死用户的项目。
你可以使用自己的:
ComfyUI
Workflow
模型
API
GPU
角色资产
视频模型
拾帧只负责一件事情:
让它们真正组成一条生产线

产品定位
如果重新给这个项目下一句话定义:
拾帧 SHIFRAME 是一个开源、本地优先、面向 AI 漫剧与 AI 视频创作者的生产工作台,通过结构化分镜、角色资产、AI 提示词、ComfyUI 工作流和批量生成队列,把「剧本 → 分镜 → 首尾帧 → 视频」的零散 AI 工具组织成完整生产线。
英文版本:
SHIFRAME is an open-source, local-first AI production studio for comic drama and AI video — turning scripts, storyboards, character assets, prompts, ComfyUI workflows and video generation into one coherent pipeline.
模型会过时,工作流会更换,
但你的项目、角色和镜头,应该一直属于你。
拾帧 SHIFRAME
开源 · 本地优先 · AI 漫剧生产工作台
