所有 AI 能力变成 HTTP 接口。每个工具都支持中英双语切换。失败的任务可以继续,不用从头再来。
AIGCPanel 是一款跨平台的 AI 数字人桌面应用,涵盖声音合成与克隆、口型同步数字人生成、25+ 音视频处理工具和智能直播。之前所有操作都在图形界面里完成,v2.3.0 给这套能力加了一层 HTTP 接口。就像给普通的桌面软件装了一套遥控器,别的程序也能调用它了。

🔌 把本地 AI 能力装进 API
这次加了一个完整的 API 服务设置面板。在设置页面开启 HTTP 服务开关、配置端口、可选开启公网访问,整套流程都在一个页面里完成。
公网访问开启前会弹出二次确认提醒,同时建议设置 Token。认证体系分两层:内部 Token 始终有效,公网 Token 仅在公网开启后生效。相当于给 API 装了两把锁——一个随身带,一个留给远程调用。
配套落地了三个核心接口:
POST /api/upload— 上传文件,支持 multipart/form-data 和 JSON Base64 两种格式,单文件上限 2GBPOST /api/model/info— 查询模型详情,返回功能列表、参数定义、硬件要求等完整信息POST /api/model/call(已有接口重构)— 调用模型功能
文件上传考虑了两种场景:前端上传用 multipart 效率最高,服务端或脚本调用用 JSON Base64 更省事。一种能力两种用法,比单纯加个端点更考验设计。

🌐 所有工具都能说英语了
v2.0.0 引入了多语言框架,当时只覆盖了核心功能。v2.3.0 把多语言铺到了全部工具和首页——文生图、文生视频、图生图、图生视频、视频处理、音频处理,还有工作流里的所有功能节点,全部支持中英双语切换。
API 设置页面单独配了 26 个 i18n key,从服务开关到端口配置到公网 Token,一个不漏。
语言切换后还有一个细节修复:左侧导航菜单、工具二级分组标题,这些之前切了语言还留着中文的地方,这次一并修了。双语不只是翻译,而是让用户感觉不到页面还有一半没翻过来。

🔄 失败了?重试就行。暂停了?继续就行
任务卡片多了两个新按钮。
失败的卡片新增了一个「重试」按钮。多步骤任务会保留已成功的步骤自动续跑,单步骤任务整体重新运行。暂停的卡片则多了一个「继续」按钮,点击后从停下的地方恢复。
实现上不算复杂:每个任务的状态机新增了 retry 和 continue 两条路径。但在日常场景中,这意味着跑了一小时的视频合成如果某一步超时失败,不用从头再来。

📜 文档渲染也做了优化
这次顺手做了一个通用 MarkdownDocViewer 组件。它自动解析 Markdown 二级标题生成左侧导航目录,内容滚动时导航高亮跟着走。
API 文档和 CLI 文档都已迁移成 Markdown 源文件渲染,不再跟前端组件绑在一起。文档页面支持 ?lang=en 参数和 Accept-Language 请求头,同一份 Markdown 源文件同时输出中英文。
近期版本回顾
AIGCPanel 近几个版本的演进脉络:
- v2.2.0 文生图生视频上线 — 输入文字自动生成视频,上传图片让图片动起来,AI 创作从图片延伸到视频
- v2.0.0 工作流引擎 + 工具 + CLI — 拖拽式工作流节点编排,25+ 音视频小工具聚合,CLI 命令行工具发布,多语言国际化为本次全覆盖埋下伏笔
其他更新
- 通用模型自定义参数增加「audio」类型,可直接选择音频文件并播放预览
- 自启动模型(如 ComfyUI)空闲退出后不再显示"已启动时间"读秒
- 设置页面「数据配置」英文环境下按钮溢出容器已修复
- 所有
/api/*接口统一为 POST 方法,GET 已全部移除
历史版本
- v2.2.0 — 文生图生视频上线,AI 创作全面升级
- v2.0.0 — 工作流引擎、20+ 小工具、CLI 全面上线
升级到最新版,打开 API 服务,把 AIGCPanel 的能力接进你的工作流试试。 你准备用 API 做什么?来评论区聊聊你的想法。