click any column header to sort

TTS Bench — Samples — 2026-06-03_1121

Rig: windows-5090 — AMD Ryzen 9 9950X3D 16-Core Processor (16C) · NVIDIA GeForce RTX 5090 32GB · 126 GB RAM · Windows 11
Label: default voice · melotts,parler
4 prompt(s) · one section per prompt · all models ranked by warm TTFA (fastest first) within each
Each prompt section shows every model's audio output, ordered by warm TTFA (fastest first). Click any audio player to hear that model's rendering.

Prompt 1

[en]"Open the browser and read my email."
Rank Model Device TTFA warm Audio
1 MeloTTS cuda 75ms
2 MeloTTS cpu 345ms
3 Parler-TTS Mini v1 cuda 2.58s
4 Parler-TTS Mini v1 cpu 16.48s

Prompt 2

[en]"I'll start a new git branch, push the changes, and open a pull request when the tests pass."
Rank Model Device TTFA warm Audio
1 MeloTTS cuda 107ms
2 MeloTTS cpu 656ms
3 Parler-TTS Mini v1 cuda 6.04s
4 Parler-TTS Mini v1 cpu 42.46s

Prompt 3

[en]"The Parakeet TDT zero point six billion parameter model achieves one point six nine percent word error rate on LibriSpeech test-clean, beating Whisper Large V3 at two point seven percent while running at over two thousand times realtime on a single GPU."
Rank Model Device TTFA warm Audio
1 MeloTTS cuda 153ms
2 MeloTTS cpu 1.76s
3 Parler-TTS Mini v1 cuda 18.07s
4 Parler-TTS Mini v1 cpu 140.05s

Prompt 4

[en]"Run pytest tests slash test underscore voice dot py with verbose flag and capture flag set to no."
Rank Model Device TTFA warm Audio
1 MeloTTS cuda 108ms
2 MeloTTS cpu 743ms
3 Parler-TTS Mini v1 cuda 5.87s
4 Parler-TTS Mini v1 cpu 52.09s