目 录CONTENT

文章目录

推荐一个AI 短剧生成开源项目

ByteNews
2026-07-30 / 0 评论 / 0 点赞 / 5596 阅读 / 0 字 / 正在检测是否收录...

推荐一个AI 短剧生成开源项目

一、项目简介

推荐一个AI 短剧生成开源项目,它把大语言模型(剧本创作)、AI 绘图(角色/场景形象)、文生视频/图生视频(分镜动效)、FFmpeg(合成剪辑) 整合进一条可视化工作流中——用户只需输入一段故事创意或小说文本,系统就能自动走完「剧本改写 → 角色设计 → 场景提取 → 分镜拆解 → 图片/视频生成 → 拼接导出」全流程,让独立创作者不需要专业影视团队、不需要演员场地,几小时就能产出一部完整短剧

项目是由 chatfire-AI 团队开源的一个基于 AI 的短剧自动化生产全栈平台,核心口号是「一句话生成完整短剧,从剧本到成片全自动化」。


二、核心价值

价值点 说明
AI 驱动 用大模型解析剧本、提取角色/场景/分镜,4 个 AI Agent 分工协作
智能创作 AI 自动生成角色形象与场景背景,支持多种视觉风格(3D/写实等)
📹 视频生成 接入多家文生/图生视频模型(火山 Seedance、阿里 Wan、MiniMax),自动产出分镜视频
全流程工作流 从创意到成片一站式完成,左侧进度栏引导每一步,人机协作模式
私有化部署 所有素材本地存储,支持桌面版/Docker/服务器部署,数据不离开你的机器

三、核心功能

1. 角色管理

  • AI 生成角色形象:根据剧本中的人物描述自动生成符合设定的肖像图
  • 批量角色生成:一次性处理剧里所有角色
  • 角色图片上传与管理:支持上传自有图片,统一素材库管理
  • 角色一致性:生成的角色图会作为后续视频生成的参考素材,保证同一人物画风统一

2. 视频任务与分镜制作

  • AI 自动拆分分镜:将整集剧本按镜头节奏切分为 8-15 秒的分镜序列
  • 场景描述 & 视频提示词生成:每个分镜自动生成景别、运镜、动作、画面描述、视频提示词
  • 按任务批量生成视频:支持批量发起、一键重试失败任务
  • 分辨率/时长档位选择:顶栏可切换视频模型、分辨率(480p/720p/1080p/2K)、时长

3. 视频生成与合成

  • 文生视频 / 图生视频:支持以角色图作为参考图驱动视频生成
  • FFmpeg 单镜头合成 & 字幕处理:项目内置 FFmpeg 二进制,开箱即用
  • 整集拼接导出:勾选镜头后自动合成为 MP4 成片,支持在线播放与下载
  • 封面/缩略图优化:自动生成 400px WebP 缩略图与视频海报帧,加快列表加载

4. 资源管理

  • 素材库统一管理:角色/场景/道具/分镜/视频分类归档
  • 本地存储:所有生成文件存放于本地 data/static/ 目录
  • 任务进度追踪:工作台展示流水线各环节状态、任务列表抽屉
  • 资源导入导出:支持素材复用、历史剧集续作

5. 四大内置 AI Agent

基于 Mastra AI Agents 框架,职责清晰分工:

Agent 职责
script_rewriter 小说/创意 → 格式化剧本改写(按集拆分、标注场景与角色)
extractor 角色 / 场景 / 道具智能提取与去重
storyboard_breaker 剧本 → 分镜序列拆解(镜头节奏、时长控制)
prompt_generator 角色/场景/道具图片提示词 + 分镜视频提示词生成

Agent 的技能文件以 SKILL.md 形式存放在 backend/workspace/skills/,支持在设置页在线编辑提示词,可自定义创作风格。

6. 多语言界面 & 多厂商适配

  • UI 四语言:中文 / English / 日本語 / 한국어,可全局设置 AI 生成内容的语言
  • 多模型厂商接入:
类型 支持厂商
文本 OpenAI(兼容接口)、Gemini
图片 OpenAI、Gemini、火山引擎
视频 火山引擎 Seedance 2.0(标准 / Fast / Mini)、MiniMax H3、阿里云百炼 Wan 3.0(Prime / 标准)
  • 火宝快捷配置:一个 Huobao API Key 即可一键写入文本/图片/视频三套推荐配置,开箱即用

四、使用指南

从小说到成片的完整制作流程。左侧进度栏始终标示当前所处阶段,跟着走即可。

第 1 步 · 创建项目

首页点「新建项目」,填写剧名并选择画面比例(横屏 16:9 / 竖屏 9:16,创建后不可改)与画面风格(3D / 真实感等,影响全局生图提示词)。

项目卡片即项目列表,随时点入续作:

第 2 步 · 配置 AI 服务(首次)

设置页「火宝快捷配置」粘贴 API Key 一键写入三条推荐配置;或用「手动模板」按厂商自选模型(顶栏可随时切换当前模型,见第 5 步)。

第 3 步 · 剧本阶段

进入剧集工作台,先粘贴原始内容(小说文本),再点「AI 改写」生成拍摄剧本——按集拆分、标注场景与角色,改写时可换文本模型、调语气。满意后「保存并进入制作」。

第 4 步 · 资产制作

对剧本执行提取,自动获得角色 / 场景 / 道具清单;逐个点「生成形象」产出一致性参考图(也可批量)。生成的资产图会在后续生视频时作为参考素材注入。

第 5 步 · 分镜与视频

「视频制作」页先拆分分镜(AI 按镜头节奏切分并生成视频提示词),然后:

  • 顶栏选择本次使用的视频模型(Seedance / Wan 3.0 / MiniMax…),分辨率与时长档位随之联动
  • 右侧检查 / 微调每个分镜的提示词(@角色名 自动映射参考图)
  • 点「批量生成视频」发起任务,失败任务可一键「重试失败」

第 6 步 · 拼接导出

勾选镜头(悬停可预览单个镜头视频),点「开始拼接」,FFmpeg 自动合成为完整剧集成片,支持在线播放与下载。完成后点「标记完成」,左侧进度栏点亮。

剧集列表随时展示各集制作状态,点「进入制作」继续未完成的集:


五、技术栈

项目是一套纯 TypeScript 全栈应用,代码结构清晰:

后端(backend/

  • 运行时:Node.js 20+
  • Web 框架:Hono(轻量高性能)
  • ORM:Drizzle ORM + better-sqlite3(WAL 模式,单文件 SQLite)
  • AI Agent:Mastra + AI SDK(OpenAI 兼容接口)
  • 视频处理:fluent-ffmpeg + ffmpeg-static/ffprobe-static(内置二进制,无需系统安装)
  • 图片处理:Sharp(缩略图、海报帧自动生成)

前端(frontend/

  • 框架:Nuxt 3(SPA 模式)+ Vue 3 + TypeScript
  • 路由:文件路由(Vue Router 4)
  • 样式:纯 CSS + CSS Variables(无 UI 框架,高度定制化)
  • 图标:Lucide Vue
  • 国际化:vue-i18n(中/英/日/韩)

桌面端(desktop/

  • 壳:Electron 37.x(utilityProcess 承载后端,BrowserWindow 同源加载)
  • 打包:esbuild(后端单文件 bundle)+ electron-builder
  • 输出:macOS dmg(arm64 + Intel 双架构)、Windows NSIS 安装器(win-x64,支持 macOS 交叉打包)
  • 更新:内置应用内更新器(sha256 校验,国内 CDN 源优先)

部署/基础设施

  • 数据库:SQLite(单文件,零安装;从 v4.0.0 起 MySQL 已迁移到 SQLite,提供自动迁移脚本)

  • 容器化:Docker 多架构镜像(linux/amd64 + linux/arm64),支持 Watchtower 自动更新

  • 目录结构:

    frontend/   — Nuxt 3 + Vue 3 + TypeScript
    backend/    — Hono + Drizzle ORM + Mastra Agents + better-sqlite3
    desktop/    — Electron 桌面端
    docker/     — Docker 配置
    configs/    — 配置文件
    data/       — 生成资源与 SQLite 数据库
    

六、本地快速部署启动

火宝短剧在本地开发几乎零配置即可启动——数据库和 FFmpeg 都内置了,无需额外安装服务。

环境要求

软件 版本要求 说明
Node.js 20+ 前后端运行环境
npm 9+ 包管理工具

✅ 数据库零安装:内置 SQLite 单文件,首次启动自动建表 ✅ FFmpeg 零安装:通过 ffmpeg-static npm 包内置二进制

方式一:开发者模式(推荐,支持热重载)

1. 克隆项目
git clone https://github.com/chatfire-AI/huobao-drama.git
cd huobao-drama

2. 安装后端依赖
cd backend && npm install

3. 安装前端依赖
cd ../frontend && npm install

4. 终端 1:启动后端
cd backend
npm run dev

5. 终端 2:启动前端
cd frontend
npm run dev
启动后访问:

方式二:单服务模式(后端同时托管前端)

1. 构建前端
cd frontend && npm run generate
cp -r .output/public dist

2. 启动后端(同时提供 API 和静态页面)
cd ../backend && npm start

访问:http://localhost:5679

方式三:桌面客户端(最简单,下载即用)

最推荐普通用户使用,无需 Node.js、无需命令行:

平台 下载文件
macOS(Apple Silicon M 系列) HuobaoDrama-4.0.0-arm64.dmg
macOS(Intel) HuobaoDrama-4.0.0.dmg
Windows HuobaoDrama.Setup.4.0.0.exe

下载地址:

双击安装即可,数据存放在 ~/Library/Application Support/HuobaoDrama/,卸载不丢数据。

方式四:🐳 Docker 一键部署(服务器推荐)

拉取官方多架构镜像(免构建)
docker pull huobao/huobao-drama:4.0.0

运行
docker run -d \
  --name huobao-drama \
  -p 5679:5679 \
  -v huobao-data:/app/data \
  --restart unless-stopped \
  huobao/huobao-drama:4.0.0

访问:http://localhost:5679,数据持久化在 huobao-data 命名卷。

或者用 docker compose(含 Watchtower 自动更新):

cp .env.example .env   修改 WATCHTOWER_TOKEN
HUOBAO_VERSION=4.0.0 docker compose up -d --build
首次使用必做:配置 AI 服务

启动后页面顶部会有横幅提示「尚未配置模型」:

  1. 打开「设置」页
  2. 获取 Huobao API Key(https://api.firemux.com),在「火宝快捷配置」粘贴后一键写入文本/图片/视频三套推荐配置
  3. 或使用「手动模板」按 OpenAI/Gemini/火山/阿里等厂商逐个添加,支持连通性测试
  4. 三类配置(文本/图片/视频)全部启用后,横幅自动消失,即可开始创作!

七、完整创作流程(6 步走)

  1. 创建项目:填写剧名,选择画面比例(横屏 16:9 / 竖屏 9:16)与视觉风格(3D/写实等)
  2. 配置 AI 服务(首次使用):粘贴 API Key 一键配置模型
  3. 剧本阶段:粘贴原始小说/创意文本,点「AI 改写」生成格式化拍摄剧本
  4. 资产制作:一键提取角色/场景/道具,逐个「生成形象」产出参考图
  5. 分镜与视频:AI 拆分分镜 → 选择视频模型 → 微调提示词 → 批量生成视频
  6. 拼接导出:勾选镜头 → FFmpeg 自动合成整集成片 → 在线播放/下载

八、项目亮点总结

  1. 真正的全流程自动化:不是某个单点工具,而是把"剧本→角色→分镜→视频→合成"整条链路串起来,AI Agent 接力完成
  2. 工程质量扎实:TypeScript 全栈、DDD 架构清晰、从 MySQL 平滑迁移到 SQLite、桌面/服务器/Docker 三种形态齐全
  3. 开箱即用体验:内置 SQLite 和 FFmpeg 二进制、一键 Key 配置、零配置即可本地启动
  4. 国际化 & 多模型支持:四语言 UI、文本/图片/视频三大类多家厂商接入,不绑定单一服务商
  5. 桌面端体验好:Electron 打包、应用内自更新、用户数据隔离,普通用户不用懂技术就能用
  6. 可扩展性强:Agent Skill 使用 SKILL.md 定义,可在线编辑提示词自定义创作风格;Drizzle ORM 让数据库切换无痛
  7. 支持主流视频大模型:火山 Seedance 2.0、阿里万相 Wan 3.0、MiniMax H3 等一线视频生成模型,紧跟技术前沿

如果你是独立创作者、短剧爱好者、AI 视频探索者,或者想学习TypeScript 全栈 + AI Agent 工程化的最佳实践,这个项目都非常值得一试!

九、项目代码仓库地址

项目代码仓库地址: https://github.com/chatfire-AI/huobao-drama


0
广告 广告

评论区