如何开始使用 NOVAI

NOVAI 是一款面向创作者的无限画布 AI 创作平台。你可以在无限画布上自由缩放、拖拽、连线,组合各种 AI 能力——文生图、图生图、AI 视频生成、GPT 多模态对话——所有操作在一个界面中无缝衔接。

三步上手

  1. 下载安装:根据你的操作系统下载对应安装包,双击安装启动。
  2. 配置 API:首次启动后进入「API 设置」页面。内置 ModelScope 免费 API 可直接使用,也可添加自己的 API Key。
  3. 开始创作:打开「无限画布」,拖入节点、输入提示词即可生成图片或视频。
提示:NOVAI 内置 ModelScope 免费 API,无需注册即可体验生图和对话功能。视频生成等高级功能需要配置对应平台的 API Key。

安装与运行

推荐:下载安装包

无需安装 Python、无需配置环境,下载安装包双击即用。

Windows:下载 NOVAI-Setup.exe,双击安装,桌面自动创建快捷方式。

macOS:下载 NOVAI.dmg,拖入 Applications 文件夹即可。首次启动若提示"无法验证开发者",请前往 系统设置 → 隐私与安全性 中点击"仍要打开"。

注意:macOS 版本需要 macOS 12.0 及以上系统;Windows 版本需要 Windows 10 及以上。

从源码运行

如需从源码运行或参与开发:

git clone https://github.com/invaders-2/NOVAI-Infinite-Canvas.git
cd NOVAI
pip install -r requirements.txt
python main.py

产品概览

启动 NOVAI 后,你会看到如下主界面:

NOVAI 主界面

图 1:NOVAI 主界面,包含无限画布、节点面板和工具栏。

NOVAI 的核心区域包括:

功能介绍

核心能力

功能说明
文生图通过提示词生成高质量图像,支持 SDXL、Flux、Midjourney 风格
图生图上传参考图进行风格迁移、变体生成、局部重绘
图生视频静态图生成动态视频,支持运镜控制和帧率设置
文生视频通过文字描述直接生成短视频片段
GPT 多模态对话支持文本、图片输入的多模态对话能力,可串联到工作流节点
工作流自动化拖拽节点连线,构建自动化 AI 创作流水线
批量处理一键批量生成,支持参数模板
历史记录自动保存生成历史,支持回看和再编辑

创建画布

点击左侧面板的「新建画布」按钮,或使用快捷键 Ctrl+N(macOS: Cmd+N)创建新的无限画布。

NOVAI 画布操作

图 2:在无限画布上拖入节点并连线构建工作流。

画布操作

创建节点

节点是 NOVAI 工作流的最小执行单元。每个节点代表一个 AI 能力或处理步骤。

添加节点

  1. 从左侧节点面板拖拽任意节点到画布上
  2. 或双击画布空白区域,在弹出的搜索框中输入节点名称快速添加

节点类型

类别节点说明
图像生成SDXL / Flux / DALL-E文生图和图生图模型
视频生成Stable Video / Runway Gen图生视频和文生视频
语言模型GPT-4o / Claude / Gemini多模态对话和文本生成
图像处理Upscale / RemoveBG / Inpaint图像后处理和编辑
输入/输出Text Input / Image Load / File Save数据输入和结果保存
逻辑控制If / Loop / Batch条件判断和循环控制

连线规则

节点左侧为输入端口,右侧为输出端口。从输出端口拖拽到另一个节点的输入端口即可建立连接。数据类型不匹配时连线会显示为红色虚线,运行时自动跳过该连接。

生成图片

NOVAI 支持多种图片生成模式,通过不同的节点组合实现灵活的图像创作流程。

文生图

  1. 从左侧面板拖入「Text Input」节点,输入提示词
  2. 拖入「SDXL」或「Flux」节点
  3. 从 Text Input 的输出端连线到模型节点的输入端
  4. 右键点击模型节点选择「运行此节点」,或按 Ctrl+Enter 运行整个工作流
NOVAI 图片生成

图 3:文生图工作流示例,提示词 → SDXL → 图片输出。

提示词技巧

注意:生成高分辨率图片时建议先以较低分辨率快速生成预览,确认效果后再提升分辨率。大尺寸生成可能消耗较多 API 配额。

生成视频

视频生成需要先有一张参考图(可从前置节点传入),或直接使用文本描述生成。

图生视频步骤

  1. 确保画布上已有一个图像输出节点(如 SDXL 生成的图片)
  2. 拖入「Stable Video」节点
  3. 将图像节点的输出端连线到视频节点的输入端
  4. 在视频节点参数面板中设置:帧数(默认 25 帧)、运动强度(1-10)、帧率(默认 24fps)
  5. 运行节点,生成的 MP4 会自动保存到输出目录
提示:视频生成耗时较长(通常 30 秒~3 分钟),建议先调低帧数和分辨率做快速测试,确认效果后再提升参数。

GPT 聊天

NOVAI 内置 GPT 多模态对话节点,支持文本输入和图片输入,可用于创意构思、提示词优化、代码生成等场景。

NOVAI GPT 聊天

图 4:GPT 对话节点支持多轮对话和图片输入。

使用方式

  1. 拖入「GPT Chat」节点到画布
  2. 双击节点打开对话面板,直接输入消息并发送
  3. 支持上传图片作为对话上下文(点击输入框左侧的图片图标)
  4. 对话历史保存在节点内部,可导出为 Markdown 或 JSON

在工作流中使用

GPT Chat 节点支持与其他节点连线:

AI 协议配置

NOVAI 支持 8 种 AI 服务协议,覆盖国内外主流 AI 平台。你可以在「设置 → API 配置」页面管理所有 API Key。

NOVAI API 设置

图 5:API 配置页面,支持多种协议接入。

支持的协议

协议代表平台适用模型
OpenAI CompatibleOpenAI / 智谱 / DeepSeekGPT-4o, GPT-4, GLM
AnthropicClaudeClaude 3.5 Sonnet, Opus
GeminiGoogle AIGemini 2.0 Flash, Pro
ModelScope阿里 ModelScopeSDXL, Qwen
Volcano Engine火山引擎Doubao, Seedream
ReplicateReplicate.comFlux, SDXL
ComfyUI本地 ComfyUI自定义工作流
Custom HTTP自建服务任意兼容 OpenAI API 的服务

内置免费 API

NOVAI 内置了 ModelScope 的免费 API,无需任何配置即可使用基础的文生图和 GPT 对话功能。免费 API 有以下限制:

如需解除限制,请在设置中添加自己的 API Key。

安全提醒:API Key 仅存储在本地电脑上,不会上传到任何服务器。切换设备时需要重新配置。

内置模型列表

以下是 NOVAI 当前版本预设的模型节点清单,随版本更新会持续扩充:

节点名称类型来源
SDXL 1.0图像生成ModelScope / Replicate
Flux.1 Dev图像生成Replicate
DALL-E 3图像生成OpenAI
Stable Video视频生成Replicate
Runway Gen-3视频生成Runway
GPT-4o多模态对话OpenAI / 智谱 / DeepSeek
Claude 3.5 Sonnet文本对话Anthropic
Gemini 2.0 Flash多模态对话Google AI
Upscale 4x图像处理内置
Remove Background图像处理内置
Inpaint图像处理内置

人脸合规与换脸

NOVAI 的视频编辑基于火山引擎 Seedance 2.0。平台对未经授权的真人肖像有严格的内容安全审核——企业认证只是前提,参考素材必须走以下三条合规通道之一:

三条合规通道

通道适用场景操作
A · 已授权真人素材 换特定真人(艺人 / 模特 / 本人) 方舟体验中心 → 我的 → 真人人像 → 建资产组 → 真人本人扫码认证上传 → 你接收拿 Asset ID → API 用 asset://asset-xxx 当参考 URL
B · 信任模型产物(推荐) AI 脸 + AI 视频(30 天内) Seedance 2.0 生成的视频 / Seedream 5.0 lite 生成的图,同一账号 30 天内可直接作参考,零门槛不拦截。注意:必须是模型原始产物,不可剪辑 / 压缩 / 转码
C · 预置虚拟人像库 不需要指定真人 平台免费虚拟人像,零合规风险,开箱即用
哪些素材会被拦截? 网上下载的含人脸视频 / 自己拍摄的真人素材 / 其他平台生成的 AI 人脸——平台无法确认肖像权,全部拦截。想换脸必须:目标脸用 Seedream 生成(或授权入库),参考视频里的人脸先模糊 / 遮挡 / 裁掉(只留动作骨架)。

换脸提示词模板

严格编辑 视频1:将 视频1 中人物的面部替换为 图片1 中的人脸,
面部细节参考 图片2(特写)。动作、走位、场景、运镜、光线
全部保持不变,只修改面部。新脸与原脸型、光影自然融合,
表情跟随原动作。保持无字幕,不要生成水印。
效果预期:① 视频人脸被模糊后,表情 / 嘴型无法与动作同步(脸是重新生成的);② 视频背景的路人脸也要处理;③ 换脸后表情僵硬时,提示词强调「表情跟随原动作」可改善;④ 想换特定真人只能走通道 A 授权流程。

NOVAI 实操指南

以「网上视频换脸」为例,完整走一遍 NOVAI 画布操作。全程在智能画布内完成,无需命令行。

第 1 步:把素材放进画布

  1. 从文件夹把视频拖进画布,自动生成视频节点
  2. 把参考图拖进画布,自动生成图片节点
  3. 点击节点 → 上方浮出工具栏(预览 / 裁剪 / 扩图 / 遮罩 / 画笔 / 宫格 / 人脸模糊 / 下载)
  4. 视频节点工具栏点「人脸模糊」→ 自动检测全部人脸并模糊 → 结果自动加入节点(原视频保留)
为什么先处理人脸? 网上下载的视频含真人脸会被火山拦截。NOVAI 的「人脸模糊」用 YuNet 神经网络逐帧检测 + 高斯模糊(自动扩大 30% 覆盖发际线),一键规避拦截。自己拍的真人素材不能靠模糊解决(看不清动作参考),要走上面的通道 A 授权。

第 2 步:@ 引用素材

  1. 点击画布顶部输入框
  2. 输入 @ → 弹出素材浮层(节点 + 资产库双 Tab)
  3. 点选视频节点 → 自动插入 @视频1;点选图片节点 → 自动插入 @图片1
  4. 浮层自动关闭,标签可直接删除;多个素材继续 @(编号按引用顺序)

也可以从右上角「画布对话助手」弹窗输入框里 @——同样支持素材引用。

第 3 步:选模型 → 写提示词 → 运行

  1. 顶部选择:平台 = 火山引擎 · 类型 = 视频 · 模型 = doubao-seedance-2-0-260128
  2. 输入框粘贴换脸提示词(上一节模板),@视频1 @图片1 自动携带为参考素材
  3. 点「运行」→ 生成完成后:结果自动落画布(新视频节点)· 底部弹出建议条(换衣服 / 换场景 / 加运镜…一键继续)· 参考视频自动截取 / 静音 / 公网化

常用提示词模板(可直接复制)

任务模板
换鞋子严格编辑 视频1:将视频1中的鞋子替换为图片1中的白色运动鞋,动作、场景、运镜、光线保持不变,只修改鞋子
换衣服严格编辑 视频1:将视频1中人物的上衣替换为图片1中的红色连衣裙,动作、场景、运镜、光线保持不变,只修改服装
换场景严格编辑 视频1:将视频1中的场景替换为图片1中的海边沙滩,人物动作、运镜、光线保持不变,只修改场景
换人物严格编辑 视频1:将视频1中的人物替换为图片1中的人物,动作、走位、场景、运镜、光线保持不变,只修改人物

常见问题

Q: 为什么我的图片生成失败了?

常见原因:① API Key 无效或余额不足;② 网络连接问题;③ 提示词触发了内容安全过滤。请检查 API 设置中的连接测试结果,并尝试更换提示词。

Q: macOS 提示"无法验证开发者"怎么办?

前往 系统设置 → 隐私与安全性,在底部找到 NOVAI 的拦截记录,点击「仍要打开」。只需操作一次,后续启动不再提示。

Q: 如何分享我的工作流?

右键点击画布空白区域,选择「导出工作流」即可保存为 .novai 文件。将此文件发送给其他人,对方通过「导入工作流」即可复现完全相同的节点和连线。

Q: 视频生成为什么这么慢?

视频生成是计算密集型任务,耗时取决于帧数、分辨率和模型复杂度。建议先以较低参数测试,确认效果后再提升。

Q: 支持离线使用吗?

部分功能支持离线。如果你在本地部署了 ComfyUI 或 Ollama,可通过 Custom HTTP 协议连接到本地服务,实现完全离线运行。内置的图像处理节点(Upscale、RemoveBG)也可离线使用。

Q: 数据会传到云端吗?

不会。NOVAI 是纯本地桌面应用,你的提示词、图片和工作流数据仅存储在你的电脑上。只有当调用云端 API(如 OpenAI、ModelScope)时,对应的请求数据才会发送到对应平台。

Q: 换脸 / 人脸编辑提示「包含真人身份 / 隐私信息」怎么办?

这是火山引擎的内容安全策略,不是代码错误。解决方法:① 目标脸改用 Seedream 5.0 lite 生成(信任产物 30 天内可直接用);② 参考视频里的人脸先用 NOVAI 的「人脸模糊」处理;③ 网上下载的真人素材无法直接使用,需走真人授权流程(见上方「人脸合规与换脸」章节)。

Q: 人脸模糊在哪?

智能画布中选中视频节点 → 上方工具栏「人脸模糊」按钮(人像图标)。点击后自动检测视频中全部人脸并高斯模糊,处理结果自动加入节点,原视频保留。

更新日志

v1.0.106 (2026-08-11)

v1.0.89 (2025-07-20)

v1.0.88 (2025-07-13)

v1.0.87 (2025-07-06)

v1.0.86 (2025-06-29)

v1.0.85 及更早

初始版本发布,包含:无限画布、SDXL 图像生成、GPT 对话、基础节点系统、ModelScope 免费 API 内置。详见 GitHub Releases。