Docs · Operations
使用手册
覆盖当前版本(5.0)主要界面与组件:工程与模型配置、AI 对话与 MCP 接入、一键工作流、短剧分镜 Agent 流水线、宿主资产、节点图与任务队列、漫画页与广告变体矩阵、3D 模型生成与导演台、场与剧集、成片时间线、资产包。 文案以应用内中文界面为准;视频演示见 B 站教程。
1. 概述与准备
AIArtEngine 是面向短剧、广告与成片制作的专业 AI 创作工具。工程与素材保存在你指定的本机目录;文本 / 图片 / 视频 / 声音生成通过你配置的模型提供商完成(OpenRouter、OpenAI、DeepSeek、智谱、Kimi、xAI、Google、vLLM、Ollama、LM Studio、火山方舟、可灵、MiniMax、通义千问、魔塔、ComfyUI、MagicRouter 等), 3D 模型生成支持 Meshy、Tripo、Rodin(Hyper3D)、Luma AI 与 Lux3D。 可用一键工作流从模板或自然语言快速生成可复用宿主资产,再拖入画布继续编排。
首次使用建议
- 从 官网下载页 或 GitHub Releases 安装对应平台安装包。
- 启动后先打开设置,添加模型提供商并填入密钥,拉取并勾选要用的模型。
- (可选)在对象存储中配置火山引擎 TOS / 阿里云 OSS / 腾讯云 COS(同时仅可启用一个),便于参考视频等大文件外链。
- 回到首页新建工程,进入工作区;可先试顶栏「一键工作流」,或按传统流程新建剧本 / 场。
2. 核心概念
先花两分钟认识下面这些词,后面所有界面都能看懂。本软件的数据组织是 工程 → 场 / 剧集 → 节点图 → 资产:工程是容器,节点图是生产车间,资产是产出物。
工程 Project
一部作品的全部数据,保存在你自己指定的本机目录下,根目录是
project.json。素材不出本机,换机器时把整个目录拷走即可。
资产 Asset
工程里的一切产出与素材的统称:剧本、节拍表、分镜图、锚点图、视频、音频、3D 模型,以及宿主资产。统一在资产库中浏览与拖用。
宿主资产 Host Asset
一键工作流生成的可复用组件。外层只暴露边界输入 / 输出,双击可 Dive 进入内部完整节点图微调。一次创建,多个工程反复使用。
节点图 Graph
用节点和连线描述「输入 → 生成 → 输出」的画布,是剧本、场、画布、导演台、宿主资产共同的底座。
端口 Port
节点的出入口,严格区分单数与复数:image / images、video /
videos、text / texts。类型不同连不上,单数不能进复数。
圆形口一般是单条 out,方形口是列表 out-all。
剧集 / 场 / 节拍
剧集(Episode)由多个场(Scene)组成;剧本先拆成节拍拆解表,再落到具体的场。
对应专用端口类型 world / worldEntities / beat,不可与普通 text 混连。
锚点图 Anchor Image
从 9 宫格 / 4 宫格拼图里按格拆出的单张参考图,用来锁住角色长相、服装与场景, 保证后续所有分镜保持一致——这是短剧不"变脸"的关键。
世界元素 World Element
可复用的设定条目:角色、场景、道具。挂在剧集上被各场共用,避免每个镜头重新描述一遍, 也是保持一致性的手段之一。
导演台 Director Stage
3D 舞台:摆放模型、布光、调机位,然后截取站位图或录制动作视频,
分别从 out-shots / out-actions 两个方形口输出。
成片时间线 Timeline
多轨道剪辑面板:把节点输出或导入素材拖进轨道,编排顺序、对齐音频,预览并导出成片。
资产包 .aipackage
把资产连同依赖关系打包导出的格式,用于迁移到另一台机器或分享给协作者,导入后可原样还原。
2.1 一条短剧是怎么跑出来的
理解了上面的概念,就能看懂短剧流水线的完整数据流:
- 剧本 → 文本模型拆解为节拍拆解表(beat)。
- 节拍 → 9 宫格分镜表:一个节点生成 3×3 拼图,再按格拆出 9 张锚点图并高清放大。
- 锚点图 → 4 宫格动态分镜表:每组 2×2 拼图,拆出 36 个动态格并放大。
- 动态格 → 动态提示词表(36 条)→ 36 条动态视频。
- 全程穿插 review1~review4 四个导演审核节点,不达标可打回重做。
- 视频 → 成片时间线编排 → 导出成片。
3. 首页与工程
新建工程
- 点击「新建工程」。
- 填写「工程名称」。
- 点击「浏览」选择「存储目录」。
- 点击「创建」后进入工作区。
打开工程
- 点击「打开工程」,选择工程目录中的
project.json。 - 或在「最近工程」列表中点击对应路径。
最近工程
- 列表展示近期打开过的工程路径。
- 右侧 × 表示「从最近列表移除」——不会删除磁盘上的工程文件。
4. 设置
在首页或工作区顶栏进入「设置」。修改会自动保存。
4.1 通用
- 主题:暗色 / 亮色。
- 语言:中文 / English。
- 自动保存:可启用,并设置间隔(秒)。
- 关于与更新:查看版本、检查更新(见下文)。
4.2 模型
-
点击「添加模型提供商」,可选:
- OpenRouter:文本 / 图片 / 视频(聚合目录,单 API Key)。
-
OpenAI:文本(GPT 系列)/ 图片(gpt-image-1 / gpt-image-2);需可访问
api.openai.com 的网络与境外账号,文生图走
/images/generations,参考图编辑走/images/edits(最多 1 张)。 - DeepSeek:仅文本(deepseek-chat / deepseek-reasoner,OpenAI 兼容)。
-
智谱:GLM 文本(
/chat/completions)+ CogView 文生图 (glm-image / cogview-4 / cogview-3-flash,/images/generations)。 -
Kimi(月之暗面):文本(kimi-k2 系列 / moonshot-v1 系列,OpenAI
兼容,默认 Base URL
https://api.moonshot.cn/v1)。 -
xAI(Grok):文本(grok-* 对话,OpenAI 兼容,默认 Base URL
https://api.x.ai/v1)+ Grok Imagine 文生图(/images/generations,JSON body,支持 aspect_ratio)+ Grok Imagine Video 异步视频(/videos/generations提交后轮询GET /videos/{request_id},支持 480p / 720p、5–15 秒与首帧图生视频)。 -
Google(Gemini):文本(gemini-* 对话)+ Nano Banana 系列文生图 /
图生图(
/images/generations,JSON body,支持 aspect_ratio / resolution / n / response_format 与 image 参考图字段)+ Veo 3.1 异步视频(/videos提交后轮询GET /videos/{id},支持 720p–4K、4–8 秒与首帧图生视频),均走官方 OpenAI 兼容层 (默认 Base URLhttps://generativelanguage.googleapis.com/v1beta/openai)。 -
vLLM:本地 OpenAI 兼容服务(默认
http://localhost:8000/v1),无需 API Key; 部署 vLLM-Omni 扩散模型(如 Wan2.2 T2V / I2V)后支持视频生成(异步任务走/v1/videos,可带首帧图生视频)。 -
Ollama:本地 OpenAI 兼容端点(默认
http://localhost:11434/v1),无需 API Key。 -
LM Studio:本地 OpenAI 兼容端点(默认
http://localhost:1234/v1),无需 API Key。 -
火山方舟:文本 / Seedream 图 / Seedance 视频用方舟 API Key;声音设计走豆包语音
openspeech(语音控制台 API Key,可与方舟 Key 不同)+ 手填
speaker_id。 视频模型含 Seedance 2.5(doubao-seedance-2-5-260628:单次最长 30s、50 个全模态参考、 时间戳级片段编辑)与 Seedance 2.0 / 2.0 Fast 等。 - 可灵:图片 / 视频(API Key)。
-
MiniMax:文本 / 图片 / 视频 / 音色设计(同一 API Key;默认 Base URL
https://api.minimaxi.com)。 - 通义千问:文本(兼容模式)/ 万相图 / 万相视频(含 HappyHorse、Wan 3.0-Video 等,百炼 API Key)。Wan 3.0-Video 支持单次 30s、10 图 + 5 视频 + 5 音频参考,公测 / 邀测中, Model ID 以百炼控制台为准。
- 魔塔:文本 / 文生图(ModelScope 访问令牌,如
ms-…)。 -
ComfyUI:图片 / 视频 / 声音,走 API 2(
POST /api/v2/jobs)。 模型 id = userdata 里的 API 格式 workflow 名(不是 checkpoint),模型列表由服务动态拉取。 视频 workflow 支持多模态参考(r2v)、视频 / 音频参考注入与首尾帧(first_frame/last_frame)注入,视频时长上限 15s。 本机默认 Base URLhttp://127.0.0.1:8189(需先装 comfy-api-proxy,不要直连 8188); 云端填https://cloud.comfy.org并填 Key。本机可空 Key。 完整步骤见 ComfyUI 接入教程。 -
MagicRouter:多供应商聚合网关(OpenAI 兼容),文本 / 图片 / 视频;
需
mr-开头 API Key,默认 Base URLhttps://api.magicrouter.ai/v1,模型目录由/models/live拉取,视频为异步提交 / 轮询。 -
Meshy:文生 3D / 图生 3D(含多图生 3D,API Key,默认 Base URL
https://api.meshy.ai)。 -
Tripo:文生 3D / 图生 3D(API Key,默认 Base URL
https://api.tripo3d.ai)。 -
Rodin(Hyper3D):文生 3D / 图生 3D(API Key,默认 Base URL
https://api.hyper3d.com/api/v2)。 -
Luma AI:文生 3D / 图生 3D(API Key,默认 Base URL
https://api.lumalabs.ai/dream-machine/v1)。 -
Lux3D:文生 3D / 图生 3D / 多图生 3D(API Key,G1 / G1-Turbo,
默认 Base URL
https://api.aholo3d.cn)。
-
选择或展开提供商后,设置页会显示对应密钥申请页链接(也可直接打开):
- OpenRouter: https://openrouter.ai/keys
- OpenAI API Key: https://platform.openai.com/api-keys
- DeepSeek API Key: https://platform.deepseek.com/api_keys
- 智谱 API Key: https://open.bigmodel.cn/usercenter/apikeys
- Kimi(月之暗面)API Key: https://platform.moonshot.cn/console/api-keys
- xAI API Key: https://console.x.ai/
- Google AI Studio API Key: https://aistudio.google.com/apikey
- vLLM 文档(本地服务无需密钥): https://docs.vllm.ai
- Ollama 官网(本地服务无需密钥): https://ollama.com
- LM Studio 官网(本地服务无需密钥): https://lmstudio.ai
- 火山方舟 API Key(文本 / 图片 / 视频): https://console.volcengine.com/ark/region:ark-cn-beijing/apiKey
- 豆包语音控制台(声音设计 API Key / speaker_id): https://console.volcengine.com/speech/app
- 可灵开放平台(API Key): https://app.klingai.com/cn/dev
- MiniMax 接口密钥: https://platform.minimaxi.com/user-center/basic-information/interface-key
- 通义千问 / 百炼 API Key: https://bailian.console.aliyun.com/?tab=model#/api-key
- 魔塔访问令牌: https://modelscope.cn/my/myaccesstoken
- ComfyUI:本机可空 Key;云端 API Key 见 Comfy 开发者文档 ;本机安装 proxy 与 workflow 见 ComfyUI 接入教程。
- Meshy API Key: https://www.meshy.ai/
- Tripo API Key: https://platform.tripo3d.ai/
- Rodin(Hyper3D)API Key: https://hyper3d.ai/
- Luma AI API Key: https://lumalabs.ai/
- Lux3D API Key: https://labs.aholo3d.cn/
-
MagicRouter API Key(
mr-开头): https://www.magicrouter.ai/docs/api
- 填写显示名称、Base URL、密钥(可显示/隐藏)。
- 启用该提供商后,点击「拉取可用模型」(可灵 / MiniMax 部分模态 / 百炼图视频 / OpenAI 与智谱图片等为本地静态目录;vLLM / Ollama / LM Studio / ComfyUI 等本地服务无需密钥,直接拉取)。
- 用筛选、全选/清空勾选需要的模型;也可手动添加模型 ID。
-
按模态配置:文本 / 图片 / 视频 / 声音 / 3D 模型(方舟声音页签会提示语音控制台链接,并手填
speaker_id;可灵仅图片与视频页签;MiniMax 支持文本 / 图片 / 视频 / 音色设计;OpenAI 支持文本与图片; DeepSeek 仅文本;Kimi(月之暗面)仅文本;xAI(Grok)支持文本 / 图片 / 视频(视频为异步轮询);Google(Gemini)支持文本 / Nano Banana 图片 / Veo 3.1 视频(异步轮询);智谱支持 GLM 文本与 CogView 图片;vLLM 支持文本与视频(Wan T2V / I2V);Ollama / LM Studio 仅文本(多模态理解可在文本节点传图); 魔塔仅文本与图片,文生图为异步任务;ComfyUI 支持图片 / 视频 / 声音,无文本页签;MagicRouter 支持文本 / 图片 / 视频;Meshy / Tripo / Rodin(Hyper3D) / Luma AI / Lux3D 仅 3D 模型页签)。 - 设置默认生成模型与默认声音(如需要)。提供商卡片可折叠以节省空间。
%APPDATA%\AIArtEngine\aiartengine-settings.json),不会上传到应用官方服务器。
4.3 对象存储
用于将本地参考视频等上传为可公网访问的 URL(私有桶时使用签名链接)。
-
「添加对象存储」→ 选择其一:
- 火山引擎 TOS:AccessKey / SecretKey、Region、Endpoint、Bucket。
- 阿里云 OSS:AccessKey / SecretKey、Region、Endpoint、Bucket。
- 腾讯云 COS:SecretId / SecretKey、Region、Bucket(通常为
BucketName-APPID)。
- 密钥申请页(设置中亦有外链):
- 公网访问域名(CDN / 自定义域名)可选;未填时使用签名 URL(约 24 小时有效)。
- 同时只能启用一个对象存储;勾选启用会自动关闭其它项。卡片支持折叠。
4.4 扩展
应用内部扩展走 Cordis(ctx.editor.*),可贡献节点、卡片、检查器、Skill 与执行器覆盖等;开发说明见仓库
GRAPH_PLUGINS.md。
设置页只读列出用户数据目录
plugins 下的声明式扩展。当前不会执行外部任意脚本,仅展示已声明的扩展信息。
正式安装包默认不加载「图插件示例」演示。
4.5 MCP 工具服务
应用内置 MCP 工具服务,供 Claude Code / Codex 等外部 AI Agent(以及内置 AI 对话面板)调用——规划并落盘工作流、运行生成、读写资产与节点图。 详细接入步骤见 MCP 接入教程。
-
启动 / 重启:设置页显示运行状态与端口;端口默认
43110,被占用时依次尝试 43110–43119。修改端口或点击「重启」后应用工具服务会以新端口拉起。 - Token:可显示 / 复制 / 编辑;跨重启保持不变,配置一次即可长期使用。 怀疑泄露时点「重置 Token」——重置后旧 token 立即失效,客户端需用新 token 重新注册。
-
接入命令:一键复制
claude mcp add --transport http …命令, 在终端执行即可把应用注册为 Claude Code 的 MCP server(HTTP 直连,无需 Node.js)。
127.0.0.1 本机回环,全部请求需带 Bearer token;文件读写限制在工程根目录内;
所有工具调用写入审计日志 <userData>/logs/mcp-audit.jsonl(5MB 滚动)。
5. 工作区
打开工程后进入工作区(应用内导航名称为「工作区」)。界面为可拖拽停靠的多面板布局。
5.1 顶栏
- 未保存时标题旁显示
*;用 Ctrl+S 保存。 - ↶ / ↷:撤销 / 重做(亦可用快捷键)。
- 一键工作流:用预设或 AI 规划生成可复用宿主资产(见 §7)。
- 剧集流水线:打开短剧分镜 Agent 流程窗口,集中完成 9宫格、4宫格、导演审核与视频生成(见 §7.5)。
- 任务列表、执行日志:后台队列与模型调用日志。
-
布局:切换默认布局、保存当前布局、导出/导入布局
.json、删除自定义布局。
提示:拖动标签可停靠到不同区域;标签右键可浮动、分离到新窗口或关闭相关标签。节点执行中不可关闭关键面板。
5.2 四栏面板
| 面板 | 作用 |
|---|---|
| 工具 | 左侧窄栏,快捷新建各类资产草稿。 |
| AI 对话 | 左侧窄栏底部「◈」按钮打开;应用内 AI 助手,可在对话中调用 MCP 工具(见 §5.5)。 |
| 工作区 | 中心编辑器;空态显示推荐流程与最近资产,打开资产后为标签页。 |
| 资产 | 工程资产库浏览与管理。 |
| 参数 | 当前选中项的 Inspector 参数面板。 |
5.3 左侧工具栏:新建资产
点击图标创建草稿资产,编辑后用 Ctrl+S 落盘。可新建:
- 自由画布 · 宿主资产 · 剧本 · 世界元素 · 场 · 导演台 · 图片 · 视频 · 声音
空工作区推荐流程:剧本 → 场 → 节点生成;也可快捷新建剧本、场、导演台,或双击最近资产打开。
5.4 右侧竖栏:资产 / 参数
工作区最右侧为 Rider 式竖栏,可分别展开或收起资产与参数面板(收起后不占中间布局宽度)。
- 点击竖栏按钮切换对应侧栏显示。
- 可将「资产」拖到「参数」上方或下方叠放;拖放预览仅在上下半区出现(半屏 left/right 预览已禁用,避免灰框残留)。
- 布局菜单保存的是展开几何;侧栏收起偏好单独记忆,不会把收起态写成零宽灰洞。
5.5 AI 对话面板
左侧窄栏底部的 ◈ AI 对话 打开应用内 AI 助手。它运行 DeepSeek Harness(dsh) agent 运行时,能像外部 Agent 一样调用应用自带的 MCP 工具服务—— 相当于在聊天窗口里直接驱动生成与工程操作。
- @ 引用资产:输入
@弹出资产选择器,可把工程内图片 / 视频 / 声音 / 3D 模型 内联引用进指令(输入区会显示缩略图预览)。dsh 直接解析文本里的@路径。 - 调用生成工具:让助手「把 @bg.png 生成一张标题图存进工程」——它会调用
generate_image等 MCP 工具,工具执行过程以卡片形式实时显示(生成中 / 完成 / 失败)。 - 模型选择:面板底部可选用任一已配置密钥的文本模型(不限于 DeepSeek 官方);选择会记住,下次打开沿用。
- 多会话:输入框上方工具栏可新建 / 切换 / 删除会话,历史消息本地持久化。
- 取消与状态:执行中可停止;dsh 的状态行与工具活动实时回显在面板中。
5.6 技能(Skills)
AI 对话的 Agent 携带一套创作技能(来自应用内置的分镜 / 导演台能力,对话时自动注入); 你也可以在 设置 → 自定义技能 中添加自己的技能,让助手具备专属的工作方法。
- 内置技能:分镜 / 动画(9 宫格分镜表、节拍拆解表、动态提示词表、4 宫格动态分镜表等)、 导演审核(分镜 / 节拍 / 动态提示词)、系统创作(剧本、图生提示词、图片 / 视频生成、声音、情绪、灯光、 多角度、扩图、重绘、抠图、高清放大、界面图、界面拆分、世界提取、节拍拆分、节拍单元生成、策划案、 肖像贴图、提示词优化、擦除)。程序自动管理,请勿手动修改。
- 自定义技能:在 设置 → 自定义技能 中「打开目录」,把符合
dsh SKILL.md 格式(frontmatter
name/description+ Markdown 正文)的.md文件放进技能目录(文件名用小写字母 + 连字符,如my-skill.md), 下次对话自动生效;可点击「生成示例模板」快速获得一份可用的写法参考。 - 技能如何生效:技能清单以
<available_skills>注入对话上下文, Agent 判断任务匹配时按需加载技能文件作为指令——技能告诉它流程与规范(怎么做), MCP 工具负责真正动手(生成图片、跑工作流),两者配合才能「说到做到」。 - 节点图节点使用同一套技能定义节点行为;API 调用日志中会标注节点所用的技能。
6. 资产库
浏览与筛选
- 标题「资产」旁可刷新;支持搜索与类型筛选。
- 底部滑条在列表视图与图标视图间切换。
- 面包屑显示路径,如 Assets > …
- 支持框选多选;可从系统拖入图片 / 视频 / 声音 / 模型 /
.aipackage。
空白或目录右键
- 新建各类资产、新建目录。
- 导入资产包 / 导出资产包。
- 目录另有:重新导入、重命名、删除目录(内容上移)、删除目录及内容。
资产右键
- 打开编辑器 · 在文件管理器中显示 · 复制原始文件。
- 重新导入 · 导出资产包 · 重命名 · 查找引用 · 删除。
资产库焦点下快捷键
- Delete / Backspace:删除选中。
- Ctrl+A:全选。
- Ctrl+C:与复制原始文件相关操作。
7. 一键工作流
「一键工作流」用预设模板或AI 规划快速生成一张可复用的宿主资产(内含完整节点图与边界 I/O)。创建后可拖入任意画布,像组件一样灌入输入、取走输出。
7.1 打开入口
- 打开任意工程进入工作区。
- 顶栏点击一键工作流。
7.2 预设与描述
- 预设模板(按行业覆盖主要能力节点):游戏买量、游戏UI界面、角色设定、分镜出片、产品广告、 电商带货、游戏3D资产、漫画出版、知识口播、 3D白模预演、短剧分镜、自定义等。带固化拓扑的预设可直接「预览模板」。其中「游戏UI界面」会创建 策划案生成 → UI 界面拆分 → UI 界面生成 的完整链路,UI 界面生成可 dive 进内图逐屏出图,配合全局风格参考统一界面风格。
- 行业模板与能力节点:「电商带货」串联 广告变体矩阵 → 媒体返工 → 媒体质检 与图层分离;「游戏3D资产」串联 3D 模型生成 → 导演台 → 站位图 → 展示视频;「漫画出版」串联 分镜图 ×3 → 漫画页(分格 / 气泡 / 透明底导出); 「知识口播」串联 讲稿 → 配音 + 口播视频 → 口型同步;「3D白模预演」串联 全景参考 → 导演台 AI 白模 → 站位图 → 预演成片。每个模板的备注节点写有逐步用法。
- 工作流描述:用自然语言说明目标(例如「剧本 → 分镜图 → 竖屏短视频」);可先选预设再改描述。
- 模型:文本模型用于 AI 规划;图片 / 视频默认模型会写入生成节点的初始参数。
7.3 预览 → 创建
- 点击预览模板(固化预设)或AI 生成预览(需文本模型;快捷键 Ctrl+Enter / ⌘+Enter)。
- 在预览区查看节点与连线拓扑;可打开执行日志查看模型规划过程。
- 确认后点击创建工作流,选择保存目录与名称。
- 资产库中出现新的宿主资产;拖入画布即可使用。
7.4 创建后怎么用
- 从资产库拖到画布 → 连上上游文本 / 图片等到宿主输入口。
- 双击或 Dive 进入内图,微调节点、模型与指令。
- 选中边界输出或宿主节点,用「加入任务」跑整条内链;可与其它链并行(见 §8.3)。
7.5 剧集流水线:Agent 流程窗口
通过一键工作流的「短剧分镜(Agent 流水线)」模板创建宿主资产后,可点击顶部工具栏的 「剧集流水线」打开独立流程窗口,集中完成分镜、拼图、审核与视频生成。 完整操作流程见 短视频制作教程。
- 三栏布局:节拍拆解(左)、9宫格分镜表(中)、4宫格详情(右);拖动分隔条可调整各栏宽度。
- 9宫格拼图:点击网格图标一次性生成整张 3×3 拼图并拆出全部 9 格锚点图;支持重新生成与导演审核。
- 4宫格:点击 2×2 网格图标生成当前组拼图;右侧可查看动态提示词,并生成 / 预览当前格动态视频。
- 导演审核:对应阶段「重新生成」成功写回后审核按钮才会点亮;审核默认偏 PASS, 仅阻断性问题才 FAIL,FAIL 原因会自动回写并附加到该阶段重跑。
- 级联失效:阶段重新生成后,其下游拼图 / 提取 / 放大 / 视频会自动失效并显示「未生成」; 再次点击生成会从最新文本一致补跑整条链,避免「新文本配旧图」。
- 节点 Inspector:选中「宫格选择 / 动态格选择」节点后,右侧可编辑宫格(1~9)或组 × 格 (1~9 × 1~4)参数。
8. 节点图
节点图是核心生成编排界面。在剧本、场、画布、导演台、宿主资产等场景中,通过节点连线组织「输入 → 生成 → 输出」链路。
8.1 添加与连线
- 在画布空白处右键,或按 Space,选择「添加节点」。
- 从端口拖出连线,松开后可「选择节点并连接」。
- 改接:按住已有连线拖动(靠近哪一端就改哪一端),或从已连线的输入口拖出,接到其他兼容端口;松在空白处则断开。 框选或多选连线(Shift / Ctrl 点选)后拖其中一条,可一次改接多条;从输入口拖出时会带走该口全部入边。
- 从资产库拖入资产到画布,可快速建立引用。
- 选中节点或边后按 Delete / Backspace 删除。
图片 / 视频 / 声音 / 剧本等图库生成节点有两个输出口:
out(当前选中的单条,默认自动连线)与
out-all(全部历史,方形端口)。每次执行成功会自动选中最新一条;在右侧 Inspector
中单击历史项可改设当前 out。
导演台编辑节点使用两个方形输出口:
out-shots(站位图,images)与
out-actions(动作视频,videos)。旧连线
out / out-all 会在加载时迁移到 out-shots。
结构化目录类端口使用专用类型 world / worldEntities /
beat(界面显示为世界元素 / 世界元素实体 / 场),勿与普通 text 混连。
端口类型必须相同:单数与复数不互通。
image 不能进 images,video / voice /
text 同理。
选取图片 / 视频 / 声音 / 文本只收列表口:请从上游的
out-all(或导演台 out-shots / out-actions)连入;默认圆形
out 连不上。剧本节点的 text 也不能直接进「选取文本」。
生成类节点支持锁定:开启后跳过模型调用,直接复用图库或上次输出(节点卡锁图标与 Inspector 可切换)。
8.2 工具条与画布交互
- 选择 / 平移 · 适配视图 · 网格与吸附 · 对齐 / 分布 · 自动布局。
- 连线样式:曲线 / 直角 / 不显示(偏好会记住)。
- 小地图:左下角概览与视口框;布局条收起时也可开关显示。
- 滚轮缩放范围约 1%–1000%;点击缩放百分比可复位相关视图习惯。
- 执行 / 停止 / 加入任务。
-
工程全局参数:节点图空白处右键打开「全局参数」——工程名称、画面风格(最多 4 张风格参考图,可从默认风格库选择或上传,含「UI 风格」等分类)、全局随机种子(图片 / 视频生成节点默认跟随,可在节点上单独关闭,便于同参数复现)与生成缓存根目录(结果默认写入
Cache/Images、Cache/Videos等,不自动登记资产库)。 - 指令编辑器引用预览:悬停引入节点缩略图时弹出预览——图片限尺寸显示,文本显示正文前段 (剧本等旁挂 txt / md 内容会自动读取)。
节点卡与 Inspector 中的图片预览按比例完整显示(letterbox),不会因画幅不同被裁切。
8.3 执行方式与任务队列
| 方式 | 说明 |
|---|---|
| 工具条「执行」 | 有选中时执行选中节点及其上游;无选中时确认后「执行所有节点」。 |
| 按住 C | 打开执行环:执行当前 / 重跑 / 跳过上游 / 强制上游 / 加入任务 / 停止。 |
| 节点右键 | 执行当前 · 重新执行 · 停止。 |
| 任务列表 | 后台工作流队列。选中输出终端再「加入任务」只跑该汇点上游;未选输出则跑图内全部输出链的并集。 |
done 的共同节点。汇点本身仍会各自执行。若要强制重跑某共同节点,请先清除其运行态或关闭锁定后再入队。
分组:Ctrl+Shift+G;取消分组:Ctrl+Shift+U。
8.4 任务容错模式
单节点调试保持严格模式:节点失败立即中断并回报错误,便于定位问题。而
整图运行 / 加入任务 / Agent 流水线等长链场景会自动启用容错模式:
节点失败时优先用缓存或图库产物兜底,标记为 degraded(降级)后继续执行下游,
不整链中断——批跑长链路不会因单个节点抖动而全部重来。
- 降级节点在运行日志、流水线总览与节点状态中同步标出(
degraded+ 失败原因)。 - 适合:批量生成 / 质检返工等「部分失败可接受」的场景;排错时请用单节点执行保持失败即停。
8.5 节点类型一览
生成 / 资产类
- 图片生成 · 视频生成 · 声音生成 · 剧本生成 · 场生成 · 世界元素提取 · 策划案生成 · 导演台编辑 · 画布编辑 · 3D 模型生成 · 2D 帧动画 · 模型(引用)· 宿主资产
- 3D 模型生成:文本 / 上游参考图 → 3D 模型资产(Meshy、Tripo、Rodin(Hyper3D)、Luma AI、Lux3D,文生 3D / 图生 3D,部分支持多图生 3D); 异步提交 → 轮询 → 下载,结果可接入导演台或下游继续加工,支持回写绑定持久化与取消。
- 宿主资产:把已有资产(图片 / 视频 / 声音 / 剧本 / 场 / 导演台等)作为节点引入当前画布, 输出口类型即该资产端口类型;双击宿主资产节点可 dive 进入其内部工作流(详见 7.6 宿主资产与 Dive)。
输出类
- 图片 / 视频 / 声音 / 剧本输出 · 导演台输出 · 场输出 · 世界元素输出 · 成片时间线
工具类
- 备注 · 文本 · 选取图片 / 视频 / 声音 / 文本 · 宫格选择 · 动态格选择 · 提示词优化 · 图片反推提示词 · UI 界面拆分 / UI 界面生成 · 生成帧动画序列图 · 漫画页 · 广告变体矩阵 · 媒体质检 · 媒体返工 · 束结
- 束结:把上游多路输出(图片 / 视频 / 声音等)收束为一组,便于整体接入输出或下游节点; 也可作为临时整理工具使用。
动效(动效分组下)
- 生成帧动画序列图:双击打开指令面板(角色 / 特效 / 武功预设,默认指令与系统提示词), 行列参数拼入提示词后用图片模型产出序列图;输出预览支持删除与选择输出图。
- 2D 帧动画:输入序列图,Inspector 设置行列参数,节点卡自动逐帧播放预览; Cook 时清除上一次输出,不累积。
漫画与广告
- 漫画页:网格分镜格 + 台词气泡编辑器。从资产库拖图入格 / 本地导入 / 上游图片一键填入, 逐格可清除图片路径;分格大小用右缘 / 下缘 / 右下角手柄按单格跨数调整(连续跟手预览、松手吸附网格), 气泡可拖动移动、角部手柄等比缩放(0.5~4 倍);点击空白处设置页面级与分格背景颜色。 导出 PNG 默认透明底;Cook 按阅读顺序回填上游图片并合成 PNG 进图库。
- 广告变体矩阵:设置产品描述与画幅比例后,双击进入变体维度配置与对比预览, 一次产出同主题多版本广告图。
质检与返工(Agent 流水线)
- 媒体质检:连接上游图片(或视频,按首帧审核),用视觉模型给出导演 PASS / FAIL 质检结论;可补充审核要点,留空用内置质检包。
- 媒体返工:生成 → 质检 → 未通过时自动注入 FAIL 原因重生成,直到 PASS 或达尝试上限; 顶栏「Agent 流水线总览」可集中查看质检 / 返工运行状态。
图片编辑(图片分组下)
- 多角度编辑 · 打光效果 · 人像质感调节 · 情绪调节 · 高清放大 · 扩图 · 重绘 · 擦除 · 抠图 · 裁剪 · 宫格切分 · 图层分离
-
图层分离(Seedream 5.0 Pro
layer_decomposition):把图片拆成底图 + 最多 16 张透明 PNG,在 dive 编辑器中调整层级后本地重组;支持滚轮缩放与空格平移查看, 导出 PSD(保留层级、位置、尺寸、透明通道、名称与嵌套分组)或按分组建子目录的 PNG。 -
精修 / 图片编辑在 Dive 中操作;选项与提示词会实时写回节点
params,Inspector 同步可见。预览走弹窗,不占用 Dive 工具位。
视频编辑(视频分组下)
- 对口型 · 逐帧拉片 · 片段重拍;逐帧拉片与片段重拍双击节点进入子窗口操作(拉片台 / 重拍台), 与图片编辑同为「双击进子窗口」交互。
- 逐帧拉片:连接上游视频后双击打开拉片台,逐帧浏览并在关键帧上取图、批注,供分镜 / 提示词引用。
-
片段重拍:连接源视频后双击打开重拍台,标记要修改的起止时间并填写修改要求;
运行后仅重拍该区间(Seedance 2.5 时间戳级编辑),其余片段保持不变。指令框支持
@引用端口素材,右侧可选视频模型。
场 / 世界
- 场拆解 / 场表格 / 场生成 / 场参考 · 选择场 · 世界元素提取 / 世界元素审核 / 世界元素生成 / 世界元素实体输出
- 选择场:从上游多个场中挑取一个(或按条件匹配)作为当前输出, 常用于多分支场流程中决定后续接哪一场。
其它
- 图插件示例(仅本地调试可加载,正式安装包默认不出现)
8.6 典型节点工作流
- 剧本:新建剧本 → 右侧选文本模型 → 填「生成指令」→ 执行生成节点 → 接到「剧本输出」。
- 场:剧本 →「场拆解」→「场表格」(运行导入 JSON)→「场生成」/ 视频生成 →「场输出」;批量叙事可走一键工作流的「短剧分镜(Agent 流水线)」。
-
图片 / 视频:上游参考连入生成口 → 提示词中用
@引用 → 执行 → 输出节点导出结果。自由画布上从零搭视频与参考视频,见 专题指南。 - 成片:场 / 视频节点输出 → 打开剧本资产的成片时间线 → 拖入轨道拼装与导出。
- 一键工作流:顶栏创建宿主 → 拖入画布接线 → Dive 微调 → 加入任务。
8.6 宿主资产与 Dive
宿主资产(含一键工作流产物、选区封装等)在外层只暴露边界输入 / 边界输出;双击或 Dive 进入内图编辑完整拓扑。
- 边界输出按汇点一一对应:多路同类型结果(如多张立绘)会各建一个出口,而不是合并成单口。
- 备注类文本节点默认不暴露为宿主出口。
- 内图整链可入队任务列表;宿主节点也可作为画布上的黑盒参与更大流程。
- 精修 / 图片编辑等工具在 Dive 中操作,选项写回节点参数;大图预览走弹窗。
9. 剧本与场
9.1 剧本资产
通过节点图生成与编辑剧本内容。将结果连到「剧本输出」,并在参数面板选择合适的文本模型与指令。 可将剧本资产拖入其他图中作为上游。
9.2 场资产
- 场(beat)是旧版分镜的替代:以「场」为单元组织叙事,再拆分 / 生成为可生成镜头。
- 场拆解(分镜师·节拍拆解表):从剧本按节拍拆出时间 / 空间 / 角色 / 动作 / 冲突 / 氛围等列。
- 场表格:批量查看 / 编辑拆解结果;支持新建与删除行,双击节点可打开表格窗口。
- 场生成 / 场参考:按场批量生成内容,或引用指定场继续加工;结合「剧集流水线」的 9宫格 / 4宫格分镜表与动态视频生成完成整条短剧链路。
9.3 分镜思维与指令预设
旧版的独立「分镜资产 / 镜头调度」已移除,分镜能力并入场与剧集流水线:由节拍拆解表负责拆场, 9宫格 / 4宫格分镜表负责把场落到可生成的镜头,画面与视频由生成节点完成。
- 镜头语言:英雄 / 神秘出场、双人中景、过肩反打、俯视、背面、荷兰角等。
- 身体朝向:全正面、45° 正面、纯侧面、45° 背面和严格背面。
- 人物表演:把愤怒、失神、疯癫、释然、焦虑、悲伤、自信与惊讶拆成面部、呼吸、肩颈、手指和重心动作。
- 打光:顶光、正侧光、伦勃朗光、体积光、逆光和画面内有动机光源。
- 广告运镜与转场:冲击硬切、闪白、运动匹配、短叠化、匹配剪辑、前景遮挡、虚焦揭示、跳切和产品英雄揭示。
视频与图片生成节点的指令预设(分镜师·节拍拆解表 / 9宫格分镜表 / 4宫格动态分镜表等)会把上面这些 镜头语言直接写入提示词;逐帧拉片节点可先从参考视频取关键帧,再用片段重拍做局部修改,详见 节点图章节。
10. 成片时间线
成片时间线用于把场 / 视频节点输出与导入素材拼成一条可预览、可导出的时间轴,通常挂在剧本资产上打开。
10.1 打开与布局
- 在剧本相关流程中打开成片时间线编辑器(左:素材库 · 中:预览 · 下:多轨时间线)。
- 轨道类型:视频 · 画中画 · 配音 · 字幕 · 音乐。
- 素材库顶部可刷新输入、自动上轨(按顺序把素材自动铺到轨道),并可调整素材显示大小。
10.2 左侧素材
- 节点输入:从上游节点收集的视频 / 声音,不可从列表删除(删轨道片段不影响列表)。
- 导入素材:从资产库或系统文件拖入时间线后出现在此;可删除,并同步清掉轨道上对应片段。
- 在导入区右键可新建分组,分组支持重命名与删除(删除后组内素材回到未分组);将导入项拖入分组或拖回「未分组」。分组会随时间线文档保存。
- 视频素材图标使用首帧缩略图;声音素材显示通用声音图标。
10.3 上轨与编排
- 从列表拖到轨道放置;声音误拖到视频轨时会智能落到配音轨。也可用「自动上轨」一键铺开。
- 轨道上的片段可用指针左右拖动改时间,也可拖到其他轨道;双击片段可预览 / 定位。
- 片段操作:在播放头处分割、复制 / 粘贴(粘贴到播放头)、移除片段; 属性面板可精调开始时间 / 片段时长 / 音量,声音类片段支持淡入 / 淡出。
- 轨道管理:隐藏 / 显示、锁定 / 解锁、折叠 / 展开,拖动轨道边缘可调轨道高度; 「总时长」可设定时间线长度(不得短于素材内容)。时间线内有独立的撤销 / 重做。
- 字幕轨:可添加字幕并编辑文案。
10.4 播放
- 中间预览区播放:只播放当前选中的视频或声音片段(未选中媒体片段时按钮禁用)。
- 下方时间线工具栏播放:按整条时间线联播(视频序列 + 声音轨),支持回到起点、暂停、循环与速度设置。
10.5 画中画与转场
- 画中画叠加:将视频拖到预览叠加层可叠加为画中画;属性面板可调横向 / 纵向位置、宽度 / 高度、 不透明度 / 音量(可一键重置),预览框比例可按原始视频或导出比例显示,导出成片时同步合成。
- 转场:视频轨上两个片段重叠处出现蓝色手柄,拖动可调整重叠 / 转场时长; 入场 / 出场转场效果可选:叠化、淡入淡出、A 淡出 / B 淡入、闪白、左 / 右 / 上 / 下滑动、 左 / 右 / 上 / 下擦除、圆形打开 / 圆形关闭,导出时一并合成。
10.6 字幕
- 点击选中字幕片段,在属性面板编辑文案、字号、高度(纵向位置)、颜色与样式;选中后滚轮也可调整字号。
- 字幕与成片一并导出,也可单独导出字幕 SRT。
10.7 导出
时间线工具栏提供导出成片:可设分辨率(预设或自定义宽高)、帧率与码率,优先用本机 ffmpeg 合成 MP4,未安装时回退为 WebM 录制;导出进度与结果路径会提示在界面中。时间线缩放可用「适应宽度」。
11. 画布与世界元素
11.1 画布资产
- 自由画布:空白节点画布;右键添加节点,或从资产库拖入资产。多次新建会得到「自由画布 2」等名称。在画布上搭视频生成与参考视频,见 自由画布:视频生成与参考视频。
11.2 世界元素 / 场
- 表格视图:世界元素为角色 / 场景 / 道具 / 武器;场表为时间 / 空间 / 角色 / 动作 / 冲突 / 氛围等列;支持新建与删除行。
- 双击对应节点:打开提取 / 拆解指令、表格或编辑窗口。
12. 导演台
导演台用于 3D 场景摆姿、机位、动画预览与录制。节点链路一般为「导演台编辑 →(可选)选取 / 下游生成」。编辑节点提供两个方形输出口(站位图与动作视频),并提供两类输入端口: 3D 模型输入端口——连入 3D 模型生成结果后,dive 进入舞台会自动实例化到场景; 全景图输入端口——连入全景图后,dive 时自动设为舞台背景。
12.1 从节点打开
- 在节点图中双击「导演台编辑」节点,打开舞台窗口。
-
关闭舞台或同步后,结果写入节点:
out-shots(站位截图,images)与out-actions(动作录制,videos)。 - 在节点 Inspector 中可预览站位缩略图与动作视频(双击进入媒体预览)。
12.2 舞台视口操作
- 左键选择 · 中键平移 · 按住右键进入飞行浏览:W/A/S/D 移动,Q/E 降 / 升,Shift 加速,移动鼠标转向。
- Q / R / S:移动 / 旋转 / 缩放工具。
- 视口底部工具栏:全景模式 / 动画模式切换、比例(Auto 跟随视口尺寸,或固定 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16,影响预览与截屏画幅)、选中包围盒开关、 截屏与重置视角。
12.3 侧栏与对象
- 左侧场景列表:层级、搜索、创建相机 / 空物体 / 基础几何体(Cube、Sphere、圆柱、尖拱、圆环、平面等 20 余种);拖动右缘可调整列表宽度(会记住本地设置)。
- AI 白模:提供透视 / 360 全景参考图(最多 3 张)与指令,由文本模型按基础几何体自动搭建场景白模, 适合快速落地透视与空间布局。
- 对象:删除、隐藏、显示名称、锁定;支持拖拽改父子关系,层级列表支持多选批量删除与多选拖拽改父级(整组移动并保留世界变换);机位组可整组删除(连同预设相机,可撤销)。
- 属性 · 姿势(FK / IK、AI 姿势——自然语言生成骨骼旋转、常用姿势预设)· 材质贴图覆盖:可为物体替换基础贴图 / 法线贴图,支持移除、隐藏贴图槽或一键还原模型自带贴图。
12.4 站位和动作
标题栏「站位和动作」打开面板,内含两个分类:
- 站位:视口截屏历史。用工具栏相机按钮截取;双击缩略图可预览。
-
动作:动画模式录制的视频历史。录制成功后自动写入工程
Cache/Videos/(无需另选目录),并打开动作分类。
12.5 视图与全景
- 导演视角 / 机位切换;六向视图;重置。
- 着色模式:标题栏右侧着色模式菜单,可选 着色 / 线框 / 着色线框(实体叠加线框),便于检查模型布线与穿插遮挡; 选择会记住本地设置,默认着色。
- Gizmos 显示:标题栏右侧 Gizmos 菜单可调 Gizmos 大小,并开关场景文字、相机 Gizmos、网格、选中包围盒;「截屏 / 视频包含场景文字 / 相机名称」决定站位截图与动作录制是否叠加这些标注。
- 移动到视图:Ctrl+Alt+F;与视图对齐:Ctrl+Shift+F。
- 全景:拖入背景图,调节缩放 / 平移 / 旋转、地面与天空色。
- 也可把全景图连到导演台节点的全景输入端口(单图),dive 进入舞台时自动设为背景,无需手动拖入。
12.6 动画模式与录制
- 在全景模式 / 动画模式间切换。
- 轨迹与关键帧:K 添加关键帧;Delete 删除关键帧;Space 播放 / 暂停。
- 动画面板红色圆点按钮为录制动作:按当前动画内容录成 WebM,自动保存到缓存目录并进入「动作」列表。
13. 资产包 .aipackage
格式标识为 com.aiartengine.asset-package,用于在工程间迁移素材与相关依赖。
导出
- 选中资产,或进入目标文件夹。
- 右键选择「导出资产包」。
- 在对话框中勾选目录 / 资产;可选「包含依赖」→「导出」。
导入
- 在资产库空白或根目录右键「导入资产包」,或直接拖入
.aipackage文件。 - 勾选要导入的条目(一次处理一个包)→「导入」。
- 支持条目复用与重映射;脚本类资产可携带场 / 生成结果数据。
14. 快捷键
| 范围 | 快捷键 | 作用 |
|---|---|---|
| 全局编辑 | Ctrl+S | 保存(草稿会先弹出「保存资产」) |
| 全局 | Ctrl+Z / Ctrl+Shift+Z(或 Ctrl+Y) | 撤销 / 重做 |
| 节点图 | 按住 C | 执行环 |
| 节点图 | Space | 打开菜单 / 按住可平移(依上下文) |
| 节点图 | Delete / Backspace | 删除节点或连线 |
| 节点图 | Ctrl+Shift+G / U | 分组 / 取消分组 |
| 资产库 | Delete · Ctrl+A · Ctrl+C | 删除 · 全选 · 复制相关 |
| 节点图 | Ctrl+C / V / A | 复制 / 粘贴 / 全选节点 |
| 导演台 | Q / R / S | 移动 / 旋转 / 缩放 |
| 导演台 | Ctrl+Z / Ctrl+Shift+Z(或 Ctrl+Y)· Ctrl+C / V | 舞台撤销 / 重做 · 复制 / 粘贴选中对象 |
| 导演台 | Ctrl+Alt+F · Ctrl+Shift+F | 移到视图 · 与视图对齐 |
| 导演台飞行 | W/A/S/D · Q/E · Shift | 按住右键时:移动 · 降 / 升 · 加速 |
| 成片时间线 | Space · Delete · Ctrl+A / Z / Y / C / V | 播放 / 暂停 · 删除片段 · 全选 / 撤销 / 重做 / 复制 / 粘贴 |
| 导演台动画 | K · Delete · Space | 关键帧 · 删关键帧 · 播放/暂停 |
| 对话框 | Esc | 关闭常见浮窗 |
15. 故障排查
按现象对号入座,下面按出现频率排序——绝大多数问题都能在前三条里解决。 仍未解决可到 QQ 群 647306826、邮箱 284139554@qq.com 或 GitHub Issues 反馈(附上执行日志会更快定位)。
提示「余额不足」,或一执行就失败
生成调用的是你自己配置的模型提供商,费用由提供商侧结算。本软件不代收任何费用, 因此这类报错几乎都出在提供商账户上。
排查顺序:
- 登录对应提供商控制台,确认余额或剩余额度充足(免费额度用尽也会直接失败)。
- 设置 → 模型:确认密钥填写正确、未过期、未被吊销。
- 确认所需模型已勾选启用,并分别设好了默认的文本 / 图片 / 视频模型。
- 换一个模型试跑同一节点,用于区分是「账户问题」还是「单个模型问题」。
提示密钥无效、401 / 403,或模型列表拉不到
- 检查密钥前后是否混入空格或换行;重新复制粘贴一次通常能解决。
- 确认该密钥在提供商侧已开通对应模型的权限,部分模型需要单独申请。
- 若使用代理或中转服务,确认中转地址填写完整(含
/v1等路径)。 - 网络受限时可在设置中配置代理后重试;公司网络常见的 HTTPS 拦截也会导致拉取失败。
连线连不上,提示端口类型不匹配
端口严格区分单数与复数,类型不同连不上,且单数不能进复数:
image 进不了 images,video / voice /
text 同理。
常见处理方式:
-
需要列表输入时(如「选取图片 / 视频 / 声音 / 文本」),请从上游的
方形口(
out-all,导演台为out-shots/out-actions)连线,默认圆形out连不上。 -
结构化目录类端口使用
world/worldEntities/beat(世界元素 / 世界元素实体 / 场),不能与普通text混连。 - 剧本节点的
text也不能直接接进「选取文本」,需要走对应的列表口。
详见 §8 节点图。
节点执行完没有输出,或任务一直排队
- 打开节点的执行日志,查看具体报错(多数是模型返回错误或参数不合法)。
- 确认上游节点已成功执行:上游没跑完,下游不会有输入。
- 检查任务队列是否被其他长任务占满;可暂停或取消排队中的任务。
-
图库生成节点有
out(当前选中)与out-all(全部历史)两个出口, 若接的是out,请在右侧 Inspector 中确认已选中期望的那条。
角色「变脸」、分镜之间不一致
图片模糊、分辨率不够
- 在生成链末端接入高清放大节点;短剧模板已内置该步骤。
- 确认生成节点参数中的分辨率设置,部分模型需显式指定尺寸。
- 避免过度压缩:导出时留意缩放比例与导出格式。
视频不动、时长不对,或参考视频没生效
- 确认动态提示词已正确填写;静态描述会生成近乎静止的画面。
- 确认所选视频模型支持目标时长与分辨率。
- 参考视频需要可访问的外链:请配置对象存储(TOS / OSS / COS, 同时仅可启用一个);纯本地预览可先不配置,但参考视频功能会受限。
- 详见 视频生成指南。
对象存储配置失败,或视频外链打不开
- 同一时间只能启用一个对象存储(火山 TOS / 阿里云 OSS / 腾讯云 COS), 启用新的前请先关闭旧的。
- 检查 Bucket 权限是否为公共读,私有桶生成的链接外部无法访问。
- 核对 AccessKey 是否具备该 Bucket 的读写权限,以及地域(Region)是否填对。
- 确认已填写可访问的公共域名(CDN 域名需完成备案)。
ComfyUI 连不上 / 报 workflow 格式错误
- 确认本机 comfy-api-proxy 已启动,且端口与软件中填写的一致。
- 确认 ComfyUI 本体已启动并可正常访问。
-
必须使用 API 格式的 workflow(在 ComfyUI 中开启 Dev Mode 后「Save (API
Format)」导出),界面格式(含
nodes/links数组)不可用。 - 详见 ComfyUI 教程。
启动异常、白屏,或更新失败
- 确认安装包与系统架构匹配(macOS 需区分 Intel / Apple 芯片)。
- 首次启动若被系统安全策略拦截,需在系统设置中允许该应用运行。
- 更新失败时可在设置 → 通用 → 关于与更新 中重新检查,或从 Releases 手动下载覆盖安装。
- 仍异常时,先备份工程目录,再重置配置后重试;记得反馈时附上日志与系统版本。
如何让 Claude Code 等 AI 助手操作应用?(安装 MCP)
应用内置 MCP 工具服务,接入后 Claude Code 等 AI Agent 可直接对话 规划工作流、编辑节点图、运行生成、查询任务。前提是应用处于运行状态, 两种方式任选其一:
-
stdio 桥(推荐,需 Node.js 18+):执行
claude mcp add aiartengine -- node <安装目录>/resources/mcp-bridge.mjs。 -
HTTP 直连(无需 Node.js):打开 设置 → MCP,复制「Claude Code 接入命令」后执行;
或手动执行
claude mcp add --transport http aiartengine <接入地址> --header "Authorization: Bearer <token>"(接入地址与 token 见应用侧 mcp.json,跨重启持久复用)。
注册后需重启 Agent 会话才会出现工具;应用侧 mcp.json
(%APPDATA%/aiartengine/mcp.json)由应用自动维护,不要手改。
注册命令报错(如 Script not found)多为本机 Claude Code 安装异常,重装后再试。
详细步骤与工具清单见 MCP 接入教程。
AI 对话面板报错 / 模型不可用 / 一直转圈
- 模型不可用(HTTP_404 等):对话面板的模型走「模型」下拉中选中的文本模型, 模型 ID 以所选提供商实际存在的名称为准;改用已在提供商后台开通的模型, 或换一家已配好 Key 的提供商。
- 未选模型 / 无可用模型:先在 设置 → 模型 中启用至少一个文本模型并填好密钥。
- 一直转圈不执行:确认本机 Node.js ≥ 22.19(安装包已内置运行体);查看面板状态行与日志。
- 工具执行失败:检查工具卡片的错误信息,常见为工程未打开或 API Key 额度不足。
16. 关于与更新
路径:设置 → 通用 → 关于与更新。
- 当前版本:显示为
v{version}(预发布如4.1.0-beta.1会标为 prerelease)。 - 检查更新:查询 GitHub Releases;开发模式下会提示不检查更新。
- 状态包括:正在检查、发现新版本并下载、已是最新、下载进度、失败提示。
- 下载完成后可点击重启并安装。
- 更新日志:完整版本历史见 CHANGELOG。