They have released the full family—VoiceDesign, CustomVoice, and Base—bringing high quality to the open community.
- 5 models (0.6B & 1.8B)
- Free-form voice design & cloning
- Support for 10 languages
They have released the full family—VoiceDesign, CustomVoice, and Base—bringing high quality to the open community.
- 5 models (0.6B & 1.8B)
- Free-form voice design & cloning
- Support for 10 languages
huggingface.co/collections/...
✨ VoiceDesign, CustomVoice & Base : from custom voices to rapid voice cloning 🎙️
✨ 0.6B & 1.7B - Apache2.0
✨ 10 language support
✨ SOTA 12 Hz speech tokenizer for high compression & high-fidelity audio
huggingface.co/collections/...
✨ VoiceDesign, CustomVoice & Base : from custom voices to rapid voice cloning 🎙️
✨ 0.6B & 1.7B - Apache2.0
✨ 10 language support
✨ SOTA 12 Hz speech tokenizer for high compression & high-fidelity audio
git clone github.com/QwenLM/Qwen3...
cd Qwen3-TTS
uv install
uv run qwen-tts-demo Qwen/Qwen3-TTS-12Hz-0.6B-CustomVoice --ip 0.0.0.0 --port 8000 --no-flash-attn --device cpu
Generated a test clip with a bundled voice saying "This is a test of the emergency broadcast system." in <60s.
git clone github.com/QwenLM/Qwen3...
cd Qwen3-TTS
uv install
uv run qwen-tts-demo Qwen/Qwen3-TTS-12Hz-0.6B-CustomVoice --ip 0.0.0.0 --port 8000 --no-flash-attn --device cpu
Generated a test clip with a bundled voice saying "This is a test of the emergency broadcast system." in <60s.
https://huggingface.co/Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
https://huggingface.co/Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Three new TTS engines (HumeAI TADA, Kokoro 82M, Qwen CustomVoice). Intel Arc XPU and NVIDIA Blackwell RTX 50-series GPU support. Split CUDA backend enables independent version updates. #cuda #ai
→ releaseport.com/r/jamiepine-voicebox/v0-4-0
Three new TTS engines (HumeAI TADA, Kokoro 82M, Qwen CustomVoice). Intel Arc XPU and NVIDIA Blackwell RTX 50-series GPU support. Split CUDA backend enables independent version updates. #cuda #ai
→ releaseport.com/r/jamiepine-voicebox/v0-4-0
Mini Max Audio just launched a powerful tool that lets you create custom voices.
Pick a style, preview, and generate get 10,000 free credits to try it out.
#voiceai #minimax #audiotools #texttospeech #reeltech #customvoice #speechtool
youtube.com/shorts/LkN67...
Mini Max Audio just launched a powerful tool that lets you create custom voices.
Pick a style, preview, and generate get 10,000 free credits to try it out.
#voiceai #minimax #audiotools #texttospeech #reeltech #customvoice #speechtool
youtube.com/shorts/LkN67...
I don’t moan.
I command — and you obey.
$30 for a personalized ritual voice clip.
One name. One demand. One sentence that stains your mind.
Send tribute. Then kneel.
#Findom #VoiceDomme #DommeVoice #Femdom #ObeyMe #PayToObey #CustomVoice #FacelessDom #WorshipHer #SovereignX
I don’t moan.
I command — and you obey.
$30 for a personalized ritual voice clip.
One name. One demand. One sentence that stains your mind.
Send tribute. Then kneel.
#Findom #VoiceDomme #DommeVoice #Femdom #ObeyMe #PayToObey #CustomVoice #FacelessDom #WorshipHer #SovereignX
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズ耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズ耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げモデルです。
多様な声質プロファイルや、指示に基づいた抑揚・話速・感情表現の制御が可能です。
音声設計、スタイル制御、高速ボイスクローンなどの機能を持つモデルが公開されており、様々な用途に利用できます。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げモデルです。
多様な声質プロファイルや、指示に基づいた抑揚・話速・感情表現の制御が可能です。
音声設計、スタイル制御、高速ボイスクローンなどの機能を持つモデルが公開されており、様々な用途に利用できます。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な声質プロファイル、文脈理解、ノイズへの耐性を特徴とし、音声設計、スタイル制御、高速ボイスクローンなどの機能を提供します。
モデルのダウンロード情報も含まれています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な音声プロファイル、文脈理解、ノイズへの耐性などが特徴で、音声設計、スタイル制御、高速ボイスクローン等の機能があります。
モデルのダウンロード情報も公開されています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な音声プロファイル、文脈理解、ノイズへの耐性などが特徴で、音声設計、スタイル制御、高速ボイスクローン等の機能があります。
モデルのダウンロード情報も公開されています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な音声プロファイル、文脈理解、ノイズへの耐性などが特徴で、音声設計、スタイル制御、高速ボイスクローン等の機能があります。
モデルのダウンロード情報も公開されています。
Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
Qwen3-TTSは、10言語に対応したテキスト読み上げ(TTS)モデルを提供するリポジトリです。
多様な音声プロファイル、文脈理解、ノイズへの耐性などが特徴で、音声設計、スタイル制御、高速ボイスクローン等の機能があります。
モデルのダウンロード情報も公開されています。