写故事 → 拆镜头 → AI 生成 → 配音 → 发布,全自动一人公司视频工厂
| Painterly 3D Noir 风格 (E01) | Painterly 3D Noir 风格 (E03) |
|---|---|
![]() |
![]() |
| E01 · 00:33 · 1280×720 |
🎥 5 集完整漫剧已产出 — 《我变成僵尸后全校跪求我别死》全 5 集,每集 6 个分镜,总计 4 分 24 秒 完整视频内容。 风格: Painterly 3D Noir + Hybrid Comic Pop 双风格轮换 色板:
#1A1A2E#16213E#E94560#0F3460#FFD700/#FF6B35#004E64#F2C14E#5C4D7D#00A5CF视频品质: 1080p/30fps (HQ) | 720p/24fps (标准) 产出路径:state/releases/·state/produced_videos/
AIComics 是一个全本地运行的 AI 漫剧创作系统。你只需要有一个故事想法,系统会帮你:
| 环节 | 说明 | 技术 |
|---|---|---|
| 📝 写剧本 | 设定世界观、角色、剧情,自动生成分镜脚本 | 大语言模型 |
| 🎨 出画面 | 每个分镜生成动漫风格的关键帧图片 | ComfyUI / OpenAI DALL·E |
| 🔊 配配音 | 每个分镜生成中文语音旁白 | Piper TTS / OpenAI TTS |
| 🎬 做视频 | 图片+配音合成完整剧集,支持 AI 动态帧 / 视频生成 | FFmpeg / AnimateDiff / Seedance / Kling |
| 📡 发平台 | 一键发布到小红书/B站/抖音 | social-auto-upload |
| 🔄 自动循环 | vf_master_loop 后台守护,自动补充资产+风格轮换 | Python 后台进程 |
| 🎨 多 Provider | 云端+本地混合架构,故障自动降级 | OpenAI / Seedance / Kling / ComfyUI |
当前成品示例: 《我变成僵尸后全校跪求我别死》E01-E05(30 张关键帧 + 30 段配音 + 5 集完整视频)
graph TB
subgraph User["🎭 用户层"]
CLI["CLI 命令行"]
WEB["Web 创作台<br/>(React SPA)"]
API["REST API<br/>(FastAPI)"]
end
subgraph Core["⚙️ 核心引擎 src/aicomic/"]
direction TB
CLI_CORE["cli/<br/>入口 & 命令"]
CORE_BP["core/<br/>业务逻辑<br/>项目/剧集/分镜/版本"]
PROV["providers/<br/>Provider 抽象层<br/>ComfyUI / Piper /<br/>OpenAI / Seedance"]
CHAR["characters/<br/>角色系统<br/>一致性/提示词注入"]
VIDEO_SYNTH["video_synthesis/<br/>视频合成管线<br/>图片→场景→字幕→配音→合成"]
UTILS["utils/<br/>工具函数"]
CLI_CORE --> CORE_BP
CORE_BP --> PROV
CORE_BP --> CHAR
CORE_BP --> VIDEO_SYNTH
end
subgraph Providers["🔌 Provider 插件"]
COMFY["ComfyUI<br/>✨ 图片/视频生成"]
PIPER["Piper TTS<br/>🔊 中文配音"]
OPENAI["OpenAI/DALL·E<br/>🎨 云端备选生图"]
SEEDANCE["Seedance<br/>🎬 云视频合成"]
KLING["Kling (可灵)<br/>🎬 AI 视频生成"]
MANUAL["手动模式<br/>📁 本地资产导入"]
end
subgraph Output["📦 产出层"]
IMAGES["关键帧图片"]
AUDIO["语音旁白"]
VIDEO["合成视频 MP4<br/>state/releases/"]
PUBLISH["发布包<br/>小红书/B站/抖音"]
end
subgraph Automation["🔄 自动循环"]
VF_LOOP["vf_master_loop<br/>自动生产循环<br/>30分钟/轮"]
MONEY_LOOP["money_loop<br/>自动变现循环"]
STYLE_ROTATION["风格轮换<br/>自动切换色板/风格"]
end
User --> Core
PROV --> Providers
Providers --> Output
Output --> PUBLISH
VF_LOOP --> Core
MONEY_LOOP --> Output
STYLE_ROTATION --> VF_LOOP
flowchart LR
A["📖 故事蓝图"] --> B["episode_manifest.json"]
B --> C["build-season-jobs"]
C --> D["build-provider-requests"]
D --> E["execute-provider-requests"]
E --> F["🎨 图片"]
E --> G["🔊 配音"]
F --> H["🎬 视频合成<br/>FFmpeg"]
G --> H
H --> I["📦 发布包<br/>state/releases/"]
sequenceDiagram
participant U as 用户
participant W as Web/CLI
participant C as Core 引擎
participant P as Provider
participant F as FFmpeg
participant O as 产出
U->>W: 设定故事/角色
W->>C: 生成分镜脚本
C->>P: 请求图片生成(ComfyUI)
P-->>C: 返回关键帧
C->>P: 请求配音(Piper TTS)
P-->>C: 返回音频
C->>F: 合成视频
F-->>C: MP4 文件
C-->>O: 发布到平台
| 依赖 | 版本 | 用途 |
|---|---|---|
| Python | 3.12+ | 运行时 |
| ComfyUI | v0.26.0+ | AI 图片生成(SDXL 模型) |
| Piper TTS | latest | 中文语音合成 |
| FFmpeg | 4.4+ | 视频合成 |
| Node.js | 18+ | Web 前端构建 |
# 1. 克隆仓库
git clone https://github.com/chfr19820610-cell/AIComics.git
cd AIComics
# 2. 创建 Python 虚拟环境
python3.12 -m venv .venv
# 3. 激活环境 & 安装依赖
source .venv/bin/activate
pip install --upgrade pip
pip install -r requirements-lock.txt
# 4. 配置 ComfyUI 路径
# 编辑 config/aicomic_comfyui_paths.yaml,指向你的 ComfyUI models 目录
# 示例:
# comfyui:
# base_path: /path/to/ComfyUI
# models_dir: /path/to/ComfyUI/models
# 5. 初始化演示数据库
PYTHONPATH="src" .venv/bin/python -m aicomic.cli.main init-demo-db
# 6. 启动系统
bash scripts/start.sh# 启动核心服务
docker compose up -d
# 启动 ComfyUI sidecar(含 SDXL 模型)
docker compose -f docker-compose.local-providers.yml up -d
# 查看日志
docker compose logs -f| 服务 | 地址 | 说明 |
|---|---|---|
| 创作台 | http://localhost:8000/login | Web SPA 前端 |
| API | http://localhost:7860/api/health | FastAPI 健康检查 |
| ComfyUI | http://localhost:8188 | ComfyUI Web UI |
默认账号:creator / your-password-here
| 指标 | 值 |
|---|---|
| 测试通过率 | 640/640 (100%) |
| 验证脚本 | 39/39 (100%) |
| API 端点 | 52 个 |
| 视频产出 | 5 集完整漫剧(4 分 24 秒)+ 双风格轮换 |
| 资产完整度 | 60/60(30 图 + 30 配音) |
| 视频品质 | 1080p/30fps (HQ 重制版) + 720p/24fps (标准版) |
| 视频 Provider | 7 个 (ComfyUI / OpenAI / Seedance / Kling / Piper / OpenAI TTS / 手动) |
| 风格主题 | 2 种 (Painterly 3D Noir + Hybrid Comic Pop) |
| 最新版本 | v0.3.0 |
| Python 版本 | 3.12 |
| 许可证 | Apache 2.0 |
# 运行全部 640 个测试
PYTHONPATH="src" .venv/bin/python -m pytest tests/ -v
# 快速模式(跳过耗时测试)
PYTHONPATH="src" .venv/bin/python -m pytest tests/ -q --skip-slow
# 运行特定模块测试
PYTHONPATH="src" .venv/bin/python -m pytest tests/test_providers/ -v
PYTHONPATH="src" .venv/bin/python -m pytest tests/test_characters/ -v系统自带轻量后台循环引擎,自动监控生产状态并补充资产:
# 启动生产 + 赚钱循环
PYTHONPATH="src" .venv/bin/python scripts/vf_master_loop.py &
# 查看循环日志
tail -f logs/vf_loop.log定时任务会被自动发现和补充,无需手动干预。系统支持:
- 风格轮换 — 每轮自动切换色板/视觉风格(Painterly 3D Noir → Hybrid Comic Pop → Cinematic Liquid Glass)
- 资产补充 — 自动检测缺失的图片/音频并排队补充
- 自动发布 — 合成完成后自动打包发布包
| 功能 | 说明 |
|---|---|
| 🧩 供应商抽象层 | 统一的 Provider 接口,支持 ComfyUI / OpenAI / Seedance / Kling / 手动等多种图片/视频生成后端,云端+本地混合架构,故障自动降级 |
| 👤 角色系统 | 角色定义、一致性检测、提示词注入、参考图管理,让同一角色在不同分镜中保持外形统一 |
| 📋 分镜版本管理 | 分镜可创建多个版本,对比选择最佳效果,支持回滚 |
| 🎬 视频合成管线 | 端到端视频合成:图片→场景→字幕→配音→合成,支持批量处理 |
| ✅ 640 测试覆盖 | 从 314 提升至 640 测试,新增 Provider 抽象层、角色系统、分镜版本管理等专项测试,验证脚本 39/39 全通过 |
| 🎨 风格轮换引擎 | 自动轮换视觉风格和色板,每条漫剧可拥有不同艺术风格 |
| 🔄 无限自循环 | vf_master_loop 后台守护,自动生产+补充+发布,无需人工干预 |
graph LR
subgraph Root["AIComics/"]
SRC["src/aicomic/"]
WEB["web/"]
CFG["config/"]
SCR["scripts/"]
TST["tests/"]
ST["state/"]
end
SRC --> CLI["cli/"]
SRC --> CORE["core/"]
SRC --> PROV2["providers/"]
SRC --> CHAR2["characters/"]
SRC --> VS["video_synthesis/"]
SRC --> UTL["utils/"]
WEB --> BE["backend/ (FastAPI)"]
WEB --> FE["frontend/ (React SPA)"]
TST --> T640["640 个测试用例"]
ST --> REL["releases/ (视频产出)"]
ST --> PV["produced_videos/"]
ST --> DA["demo_assets/"]
ST --> GP["generated_projects/"]
| 目录 | 说明 |
|---|---|
src/aicomic/ |
核心引擎 — CLI / 业务逻辑 / Provider 抽象层 / 角色系统 / 视频合成 |
web/backend/ |
FastAPI 后端(52 个 API 端点) |
web/frontend/ |
React SPA 创作台 |
config/ |
配置文件(ComfyUI 路径、Provider 配置) |
scripts/ |
运维脚本(vf_master_loop、启动脚本) |
tests/ |
640 个测试用例 |
state/releases/ |
已合成的 MP4 视频产出 |
state/produced_videos/ |
视频工厂产出目录 |
| 功能 | 说明 |
|---|---|
| 🎬 1080p/30fps 高清输出 | 视频品质从 720p 升级至全高清,添加 LUT 色彩校正,修复 CRF 不一致 |
| 🎨 双风格轮换 | Painterly 3D Noir + Hybrid Comic Pop 自动切换,每轮自动生成不同风格视频 |
| 🔌 Kling (快手可灵) Provider | text2video + image2video + JWT 认证,快手 SOTA 视频生成 |
| ⚡ ComfyUI 加速模式 | local_comfyui_video_fast 新 workflow,预览速度提升 2-2.5x |
| 🔒 安全审计 | strix + pentest 全量扫描,9 项安全检视,修复 .gitignore / CORS / 认证问题 |
| 📋 20+ Agent 产出整合 | 视频导演审查 / 品质 Prompt 模板 / 视频工作流指南 / Blender 可行性 / 竞品分析 / UX 审计等 |
| 🌐 社区基础设施 | CI/CD 自动化 + Issue/PR 模板 + 每日升级检测 |
| 🎬 AIComics demo_reel | 精选演示短片 MP4,展示系统能力 |
- 基础漫剧管线 (故事→分镜→图片→配音)
- CLI + Web API + SPA 三端入口
- 640 测试全通过
- 供应商抽象层 (ComfyUI/Piper/OpenAI/Seedance/Kling)
- 角色系统 (定义/一致性/提示词注入/参考图)
- 分镜版本管理
- 自动风格轮换引擎 + 无限自循环
- 1080p/30fps 高清视频输出
- 云端+本地混合 Provider 架构
- 安全审计 + 基础设施 (CI/CD + 模板)
- 漫剧专用模板系统
- 小说→漫剧一站式管道
- 多语言配音 & 字幕
- 发布平台自动集成(小红书/B站/抖音一键发布)
- 云端轻量模式
- 社区模板市场
- Blender 三渲二 Provider
项目附带独立命令行工具 aicomics,无需启动 Web 服务即可调用 ComfyUI:
# 安装 CLI
cd ai-comics-cli && pip install -e .
# 单张漫画图生成
aicomics render "一个动漫少女站在樱花树下,日系风格"
# 批量生成(从文本文件读取提示词)
aicomics batch prompts.txt
# 合成短视频
aicomics video
# 查看帮助
aicomics --helpAIComics 完全开源免费,如果你觉得这个项目有用,欢迎通过以下方式支持:
| 方式 | 地址 / 链接 |
|---|---|
| ⭐ GitHub Star | 点右上角 ⭐,帮助项目被更多人发现 |
| 🔗 分享推荐 | 转发给做 AI / 视频 / 漫画的朋友 |
| 🐦 X (Twitter) | @chfr19820610 关注获取更新 |
| ₿ BTC 捐赠 | 1JDmYgWRJipA5ZHDmoVPfpfW8n3Gtbb92c |
BTC: 1JDmYgWRJipA5ZHDmoVPfpfW8n3Gtbb92c
每一份支持都能让我花更多时间打磨这个项目 ❤️
AI漫剧(AI Comic / AI Donghua)是一种全新的内容形态:用 AI 模型代替传统动画工作室,从故事脚本到画面生成到配音合成,全流程自动化完成。每一集都是一组连贯的分镜画面配上语音旁白,最终合成 MP4 视频。
与传统动画的区别:
- 速度: 数小时 vs 数月
- 成本: 仅需 GPU 算力 vs 数十万制作费
- 人数: 一人即可操作 vs 20+ 人团队
- 风格: AI 模型可以生成无限多风格,不像工作室受限于特定美术
AIComics 是这类工具中唯一全本地运行、完全开源的端到端系统。不同于在线 AI 视频工具(如 Runway/Pika)需要上传素材到云端,AIComics 的一切处理都在你自己的电脑上完成。
Q: AIComics 免费吗?有付费墙吗?
完全免费。Apache 2.0 许可证,无任何付费功能。代码就在这,你可以自己跑,也可以 fork 修改。
Q: 和 Runway / Pika / Sora 有什么区别?
| 维度 | AIComics | Runway / Pika / Sora |
|---|---|---|
| 运行方式 | 本地运行 | 云端 SaaS |
| 素材隐私 | 不离开你的电脑 | 上传到厂商服务器 |
| 成本 | 免费(仅电费+GPU) | 订阅/按次收费 |
| 定制性 | 完全可改(开源) | 只能用官方功能 |
| 目标形态 | 漫剧/动画连续剧 | 短视频片段 |
AIComics 是做 完整剧集 的工厂,不是 5 秒短视频生成器。
Q: 需要什么硬件?
- 最低: 任何能跑 Python 3.12 + FFmpeg 的机器
- 图片生成: 推荐 NVIDIA GPU(6GB+ VRAM)用于 ComfyUI + SDXL
- 视频合成: CPU 即可,FFmpeg 处理
- Mac M4 实测完全可用(我们就是在 M4 Mac 上开发的)
Q: 支持哪些语言配音?
当前 5 集成品均为中文配音。系统支持 Piper TTS 的所有语言(中文/英文/日文/韩文等)。OpenAI TTS provider 可提供更多语言和更自然的语音。
Q: 如何发布到抖音/B站/小红书?
系统内置 social-auto-upload 集成,合成完成后可一键发布。需要先在目标平台登录授权。
Q: 能用于商业用途吗?
可以。Apache 2.0 许可证允许商业使用,无 copyleft 限制。你用自己的 AIComics 生成的视频内容版权归你所有。
Apache 2.0 © 2026 Eric Chen
Issues 和 PR 都欢迎!提交前请确保测试通过。
# 运行测试确认
PYTHONPATH="src" .venv/bin/python -m pytest tests/ -q
