- 声音克隆:上传/拖入一段参考人声(wav/mp3/m4a/flac),用那个声音读任意文本
- 纯文本合成:不给人声参考,直接出默认音色
- 文本四种给法:直接输入、粘贴、导入 txt 文件、拖入
- 参数微调(克隆 / 纯文本两个模式各自独立保存): 语言 · 温度 · top-k · top-p · min-p · seed · ctx-size · 最大帧数 · 线程
- 试听:参考音频可试听、生成结果可试听、历史条目可试听
- 下载 / 另存为:生成结果一键另存、在 Finder 中显示
- 路径设置:llama-tts 路径、模型 GGUF、mmproj、默认保存目录,均可点选
- 直达 Finder:每处路径旁都有「打开文件夹 / 在 Finder 中显示」
- 底部运行日志台:流式日志、帧进度、复制、收起/展开
- 历史记录:保留最近 30 条,可播放 / 打开 / 移除
项目地址:https://github.com/usbog232/Qwen3-TTS-Studio
macos可直接下载app:https://github.com/usbog232/Qwen3-TTS-Studio/releases/tag/v1.4.0
llama.cpp下载地址:https://github.com/ggml-org/llama.cpp/releases
ggml-org/Qwen3-TTS()下载地址:https://huggingface.co/ggml-org/Qwen3-TTS-12Hz-1.7B-Base-GGUF/tree/main
Qwen3-TTS-12Hz-1.7B-Base-Q4_K_M.gguf
Qwen3-TTS-12Hz-1.7B-Base-Q8_0.gguf
上方根据自己电脑扔选1个然后再下载下方模型
前置要求
| 项 | 说明 |
|---|---|
| macOS 13+ | Apple Silicon 或 Intel |
| llama.cpp | 2026-08-04 之后的构建(PR #26254 合入后才支持 Qwen3-TTS) |
| 模型 | ggml-org/Qwen3-TTS-12Hz-1.7B-Base-GGUF(主模型 + mmproj) |
阅读量 8





