qwen 3-tts 声音克隆目前测试中最强,开发了app直接用

  • 声音克隆:上传/拖入一段参考人声(wav/mp3/m4a/flac),用那个声音读任意文本
  • 纯文本合成:不给人声参考,直接出默认音色
  • 文本四种给法:直接输入、粘贴、导入 txt 文件、拖入
  • 参数微调(克隆 / 纯文本两个模式各自独立保存): 语言 · 温度 · top-k · top-p · min-p · seed · ctx-size · 最大帧数 · 线程
  • 试听:参考音频可试听、生成结果可试听、历史条目可试听
  • 下载 / 另存为:生成结果一键另存、在 Finder 中显示
  • 路径设置:llama-tts 路径、模型 GGUF、mmproj、默认保存目录,均可点选
  • 直达 Finder:每处路径旁都有「打开文件夹 / 在 Finder 中显示」
  • 底部运行日志台:流式日志、帧进度、复制、收起/展开
  • 历史记录:保留最近 30 条,可播放 / 打开 / 移除

项目地址:https://github.com/usbog232/Qwen3-TTS-Studio

macos可直接下载app:https://github.com/usbog232/Qwen3-TTS-Studio/releases/tag/v1.4.0

llama.cpp下载地址:https://github.com/ggml-org/llama.cpp/releases

ggml-org/Qwen3-TTS()下载地址:https://huggingface.co/ggml-org/Qwen3-TTS-12Hz-1.7B-Base-GGUF/tree/main

 
搭配llama.cpp 和qwen3tts模型使用。

前置要求

说明
macOS 13+Apple Silicon 或 Intel
llama.cpp2026-08-04 之后的构建(PR #26254 合入后才支持 Qwen3-TTS)
模型ggml-org/Qwen3-TTS-12Hz-1.7B-Base-GGUF(主模型 + mmproj)

发表评论

您的邮箱地址不会被公开。 必填项已用 * 标注

Scroll to Top