KrillinAI 是一个功能强大的 AI 视频翻译与配音工具
KrillinAI 是一个功能强大的 AI 视频翻译与配音工具,支持从下载、字幕翻译到 TTS 配音的全链路自动化。它的部署方式非常灵活,覆盖了从“开箱即用”到“开发者构建”的全场景。
下面为您梳理出四种主要的部署和使用路径,您可以根据自己的技术背景和需求选择。
📋 部署方式速览
| 方式 | 适用人群 | 特点 | 操作复杂度 |
|---|---|---|---|
| 1. 桌面版 (推荐) | 所有用户,特别是新手 | 图形界面,配置内置,下载即用 | ⭐ 极简 |
| 2. 非桌面版 (Web UI) | 喜欢网页操作或需远程访问的用户 | Web 界面,需手动编辑配置文件 | ⭐⭐ 简单 |
| 3. Docker 部署 | 熟悉容器化,追求环境一致性的用户 | 一键启动,隔离环境 | ⭐⭐ 中等 |
| 4. 源码与 CLI | 开发者、AI Agent 集成 | 完全控制,支持脚本化和自动化编排 | ⭐⭐⭐ 复杂 |
🚀 方式一:桌面版(最简单、最推荐)
这是官方为普通用户设计的图形界面版本,所有配置都可以在软件内完成,无需手动编辑配置文件。
下载安装包:
- 访问项目的 GitHub Releases 页面。
- 下载文件名中包含
desktop的最新版本,对应你的操作系统(如KrillinAI_1.0.0_desktop_Windows_x86_64.exe或KrillinAI_1.0.0_desktop_macOS_arm64)。
运行软件:
Windows: 双击
.exe文件即可运行。macOS: 由于应用未签名,双击可能无法直接打开。请按照以下步骤操作:
打开“终端”(Terminal)。
使用
cd命令进入你下载文件所在的目录。执行以下命令移除隔离属性并赋予执行权限(注意:将
KrillinAI_1.0.0_desktop_macOS_arm64替换为你下载的实际文件名):1
2sudo xattr -cr ./KrillinAI_1.0.0_desktop_macOS_arm64
sudo chmod +x ./KrillinAI_1.0.0_desktop_macOS_arm64现在可以双击运行,或继续在终端执行
./KrillinAI_1.0.0_desktop_macOS_arm64启动。
开始使用:
- 启动后,直接在图形界面中配置你的 API 密钥(如 OpenAI、阿里云等)和各项参数,然后导入视频即可开始处理。
🌐 方式二:非桌面版 (Web UI)
此版本提供一个 Web 界面,适合作为服务器端服务运行。需要手动编辑配置文件。
下载可执行文件:
- 在 Releases 页面 下载文件名 不包含
desktop的版本(如KrillinAI_1.0.0_Linux_x86_64或KrillinAI_1.0.0_macOS_arm64)。
- 在 Releases 页面 下载文件名 不包含
创建配置文件:
- 在可执行文件同级目录下,创建一个名为
config的文件夹。 - 在
config文件夹中,创建一个名为config.toml的文件。 - 从项目源码的
config目录中获取config-example.toml的内容,复制粘贴到你新建的config.toml文件中。 - 根据文件内的注释,必须填写必要的配置,特别是
[llm](大语言模型)和[transcribe](语音识别)部分的 API 密钥和参数。
- 在可执行文件同级目录下,创建一个名为
赋予执行权限并启动:
macOS/Linux:
1
2
3
4# 添加执行权限
chmod +x ./KrillinAI_1.0.0_macOS_arm64 # 替换为你的文件名
# 启动服务
./KrillinAI_1.0.0_macOS_arm64Windows: 在命令行中直接运行
.exe文件。
访问 Web 界面:
- 服务启动后,在浏览器中访问
http://127.0.0.1:8888(端口号可在配置文件中修改)即可开始使用。
- 服务启动后,在浏览器中访问
🐳 方式三:Docker 部署
适合喜欢容器化部署的用户,可参考项目中的 Docker 部署说明。
核心步骤通常是:
- 准备配置文件:同样需要准备
config.toml文件(参考方式二)。 - 运行容器:使用 Docker 命令或
docker-compose.yml启动容器,并将配置文件和数据目录挂载到容器内。
🛠️ 方式四:从源码与命令行 (CLI)
适合开发者或需要将 KrillinAI 集成到自动化流程(如 AI Agent)中的用户。
环境准备:安装 Go 语言环境(版本需支持项目中
go.mod的要求)。克隆与编译:
1
2
3git clone https://github.com/krillinai/KrillinAI.git
cd KrillinAI
go build -o build/krillinai-cli ./cmd/cli使用 CLI 分阶段处理:编译后,你可以使用
./build/krillinai-cli命令,通过不同的子命令(如subtitle,tts,render-horizontal)来执行视频处理流水线的不同阶段。具体参数请参考项目README.md中的 CLI 使用说明。
🔧 配置核心要点(所有方式通用)
无论使用哪种方式,理解以下核心配置有助于你顺利运行:
- 语音识别 (Transcribe):在
[transcribe]部分选择provider.name。openai(云端,需 API Key):速度快,效果好。fasterwhisper(本地,推荐model="large-v2"):免费,模型会自动下载。
- 大语言模型 (LLM):在
[llm]部分配置,用于翻译。兼容 OpenAI API 格式的服务(如 DeepSeek、Gemini、本地部署的模型等)。 - TTS 配音 (可选):在
[tts]部分配置。支持阿里云、OpenAI TTS 等。如使用语音克隆,需选择阿里云。
💡 常见问题
- macOS 无法打开:请参照方式一中的步骤,使用终端命令移除隔离属性。
- 配置文件不生效:确保文件名是
config.toml,且位于正确的config文件夹内,并检查文件格式(TOML)是否正确。 - 本地模型下载慢:首次使用 FasterWhisper 等本地模型时,会自动下载模型文件,请耐心等待。

