设置总览、AI 与模型、API Key
点击左下角齿轮打开设置,默认进入概览。设置在主窗口内全屏打开,点“返回应用”或按 Esc 回到原来的页面。左上角搜索框可以直接搜设置项,比如“Key”“帧率”“缓存”。
9 个分类
| 分类 | 管什么 |
|---|---|
| 概览 | 汇总当前状态,需要处理的事排在最前 |
| 账户与授权 | 冰爪账号、授权、关联登录方式 |
| 通用与外观 | 开机启动、保持唤醒、主题、字号、语言 |
| 权限与设备 | 屏幕录制、麦克风、摄像头、语音识别、辅助功能、Safari 自动化、通知 |
| 录制与拍摄 | 帧率、倒计时、画中画样式、录制时隐藏 Dock 等 |
| 发布 | 平台开关与登录、全局测试模式、自动发布、登录维护 |
| AI 与模型 | 默认转写引擎、云端服务 Key、本地模型 |
| Agent 与接入 | 连接 AI 助手、使用指引、终端命令、远程接入 |
| 存储与维护 | 工作目录、存储占用、NAS、运行环境、诊断包、卸载 |
通用与外观
- 启动:开机时自动启动冰爪;冰爪运行时保持电脑唤醒(防止长时间发布或渲染时电脑睡眠)。
- 主题:外观跟随系统、浅色或深色;六种主题色。
- 文字与密度:UI 文字大小(紧凑 / 标准 / 大号)、内容文字大小(文稿和长文本)、界面密度(舒适 / 紧凑)。
- 语言:跟随系统、简体中文或 English。
App 外观和公众号文章的排版主题是两回事,改 App 主题不会改文章排版。
录制与拍摄
- 录屏与画质:默认帧率 30 / 60 fps;录制时隐藏 Dock 栏、隐藏桌面图标,让画面更干净;是否录进冰爪主窗口(默认不录)。
- 开拍流程与倒计时:倒计时 3 / 5 / 10 秒,倒计时提示音。
- 讲解者摄像头与画中画:默认形状、边框风格、前置摄像头镜像。
- 音频:默认是否录制电脑系统声音。
想让录屏画面最干净:打开“隐藏 Dock 栏”和“隐藏桌面图标”,并用副屏录制(见录制与导出视频)。
AI 与模型
这一页分上下两部分:上面是默认语音转写,下面是云端服务和本地模型两个标签。
默认语音转写
| 选项 | 影响什么 | 可选 |
|---|---|---|
| 实时听写 | 提词器语音跟随、各处的语音输入 | 苹果端侧原生、Gemini 实时听写 |
| 音视频转写 | AI 工具转写、新视频工程的字幕 | Qwen3 本地(离线)、Gemini 3.5 云端、苹果系统自带 |
| 字幕默认语言 | 只影响新建的视频工程 | 自动识别或指定语言 |
已有视频工程保留自己的设置,不会跟着这里改。
云端服务
Key 保存在 macOS 钥匙串。每个服务一行,右侧显示“已配置”或“未配置”,点开填写。
Google Gemini(推荐)
- 在 Google AI Studio 创建 API Key。
- 点开 Google Gemini API,把 Key 粘贴到“通用 Key 池”。可以填多个 Key(换行或逗号分隔),冰爪会自动轮流使用。
- 需要把转写的额度和其它用途分开时,勾选“为转写单独配置 Key”并填写。
- 输入后自动保存。点击测试个人 Key 连接确认可用。
一个 Gemini Key 可用于:音视频转写、实时听写、AI 生图、文字配音和生成背景音乐。生图和音乐不在免费额度内,需要在 Google AI Studio 开通付费。免费额度当天用完时,冰爪会提示“今天的额度用完了”。
其它服务(可选)
| 服务 | 填什么 | 用在哪 |
|---|---|---|
| 生图接口 | Base URL 和 API Key(OpenAI 兼容格式),刷新后搜索选择模型 | AI 生图;填好后优先于 Gemini |
| OpenAI 兼容 TTS | 服务地址,需要时填 Key;可以是局域网里自己架的服务 | 文字配音 |
| ElevenLabs | API Key | 文字配音,可直接选账号里的音色 |
| Deepgram | API Key | 文字配音(Aura 模型) |
生图接口和 Gemini Key 输入后自动保存;三个配音服务需要点保存配置,会先校验地址格式。没有 Key 时,可以点右上角购买 Key 联系客服。
“已配置”只说明填好了,不代表额度、权限和网络一定正常,真正可用以生成结果为准。这里的 Key 只给冰爪用,不会替 Codex、Hermes 等配置它们自己的服务。
本地模型
本地模型在本机离线运行,按需下载;卸载后可以重新下载,不影响已有项目。
| 类别 | 模型 | 大小 | 用途 |
|---|---|---|---|
| 语音识别 | Qwen3-ASR | 680 MB | 本地转写 |
| 语音识别 | Qwen3-ForcedAligner | 430 MB | 词级时间对齐、模板视频逐字字幕 |
| 语音合成 | VoxCPM2 | 2.8 GB | 中文配音与声音克隆 |
| 语音合成 | Kokoro-82M | 82 MB | 英文等预置音色配音 |
| 修复增强 | DeepFilterNet3、Sidon、FlashSR | 2 MB~1.1 GB | 克隆声源净化、提取人声 |
| 音轨分离 | Open-Unmix | 135 MB | 转写或克隆前提取人声 |
| 说话人分离 | Sortformer | 1.4 GB | 多人转写区分说话人 |
一般只需要 Qwen3-ASR(转写)和 VoxCPM2(配音)。修复、分离类模型在你勾选“提取人声”“净化声源”或使用多人模式时才用到。工具底部也会在需要时直接提示下载。
配置好了仍失败
| 现象 | 下一步 |
|---|---|
| 401 或未授权 | 核对 Key 是否填在了对的服务里,账号是否有效。 |
| 模型列表为空 | 检查 Base URL 和 Key,确认服务支持模型列表后点“刷新列表”。 |
| 模型或音色不存在 | 在当前提供方下重新选择它实际支持的值。 |
| 今天的额度用完了 | Gemini 免费额度当天已用完,第二天再试或开通付费。 |
| 超时或网络错误 | 检查网络和服务状态;先看原任务结果再决定是否重试。 |
| 本地模型未就绪 | 等下载完成,检查磁盘空间。 |
反馈问题时提供错误文字和服务名称即可,截图里不要露出完整 Key。