5 prompt(s) · one section per prompt · all models ranked by warm TTFA (fastest first) within each
Each prompt section shows every model's audio output, ordered by warm TTFA (fastest first). Click any audio player to hear that model's rendering.
Prompt 1
[en]"Open the browser and read my email."
Rank
Model
Device
TTFA warm
Audio
1
Vaniq-Edge
cuda
22ms
2
Inflect-Nano v2
cuda
24ms
3
Inflect-Micro v2
cuda
27ms
4
Kokoro
cuda
47ms
5
LFM2.5-Audio 1.5B
cuda
60ms
6
Piper
cpu
62ms
7
LFM2.5-Audio 1.5B
cpu
62ms
8
MeloTTS
cuda
78ms
9
Pocket-TTS
cpu
85ms
10
Sopro V2 Turbo (streaming)
cuda
85ms
11
Inflect-Nano v2
cpu
123ms
12
StyleTTS 2
cuda
142ms
13
StyleTTS 2
cpu
144ms
14
LuxTTS
cuda
194ms
15
Sopro V2 Turbo
cuda
199ms
16
Vaniq-Edge
cpu
214ms
17
Inflect-Micro v2
cpu
216ms
18
OpenVoice v2
cuda
248ms
19
NeuTTS Nano
cuda
315ms
20
Audio8 TTS 0.6B (compiled)
cuda
352ms
21
Orpheus-TTS 3B
cuda
361ms
22
Kokoro
cpu
361ms
23
NeuTTS Nano
cpu
392ms
24
Soprano 1.1 80M
cuda
397ms
25
MiraTTS
cuda
451ms
26
NeuTTS Air
cuda
486ms
27
Chatterbox Turbo
cuda
521ms
28
NeuTTS Air
cpu
546ms
29
Coqui XTTS-v2
cuda
557ms
30
Supertonic 3
cpu
596ms
31
MeloTTS
cpu
615ms
32
Soprano 1.1 80M
cpu
662ms
33
Qwen3-TTS 1.7B (CUDA-graph)
cuda
679ms
34
Scylla's Band
cpu
707ms
35
OmniVoice
cuda
713ms
36
KittenTTS Nano 0.1
cpu
736ms
37
Sopro V2 Turbo (streaming)
cpu
764ms
38
Higgs Audio v3 TTS
cuda
820ms
39
LongCat-AudioDiT 1B
cuda
856ms
40
CosyVoice 3 0.5B
cuda
1.04s
41
OpenVoice v2
cpu
1.04s
42
LongCat-AudioDiT 3.5B
cuda
1.05s
43
Chatterbox
cuda
1.06s
44
VibeVoice Realtime 0.5B
cuda
1.08s
45
LuxTTS
cpu
1.10s
46
F5-TTS v1
cuda
1.11s
47
Sopro V2 Turbo
cpu
1.19s
48
Magpie-TTS
cuda
1.42s
49
VibeVoice 1.5B
cuda
1.46s
50
MOSS-TTS-Nano
cuda
1.66s
51
Fish Speech 1.5
cuda
2.03s
52
Qwen3-TTS 1.7B Base
cuda
2.08s
53
Parler-TTS Mini v1
cuda
2.24s
54
MOSS-TTS v1.0
cuda
2.29s
55
Zonos v0.1
cuda
2.36s
56
VoxCPM2 2B
cuda
2.36s
57
MOSS-TTS v1.5
cuda
2.48s
58
MetaVoice-1B
cuda
2.52s
59
IndexTTS-2
cpu
2.65s
60
Audio8 TTS Preview 0.6B
cuda
2.80s
61
IndexTTS-2
cuda
2.88s
62
Step-Audio-EditX
cuda
2.92s
63
Audio8 TTS Preview 0.1B
cuda
3.03s
64
Coqui XTTS-v2
cpu
3.07s
65
Sesame CSM-1B
cuda
3.24s
66
MOSS-TTS-Nano
cpu
3.38s
67
Qwen3-TTS 0.6B CustomVoice
cuda
3.74s
68
dots.tts (soar)
cuda
3.77s
69
Chatterbox Turbo
cpu
3.79s
70
VibeVoice 7B
cuda
3.88s
71
Dia 1.6B-0626
cuda
4.12s
72
Maya1
cuda
4.28s
73
Echo-TTS
cuda
4.33s
74
VibeVoice Realtime 0.5B
cpu
5.46s
75
Miso TTS 8B
cuda
5.75s
76
DramaBox
cuda
5.78s
77
Chatterbox
cpu
6.02s
78
ZipVoice 123M
cpu
7.14s
79
OuteTTS 1.0 1B
cuda
7.24s
80
OmniVoice
cpu
7.73s
81
Audio8 TTS Preview 0.1B
cpu
7.85s
82
Magpie-TTS
cpu
8.50s
83
Parler-TTS Mini v1
cpu
11.20s
84
Fish Speech S2-Pro
cuda
11.36s
85
Qwen3-TTS 0.6B CustomVoice
cpu
11.85s
86
Audio8 TTS Preview 0.6B
cpu
12.27s
87
Qwen3-TTS 1.7B Base
cpu
13.70s
88
VoxCPM2 2B
cpu
13.71s
89
Sesame CSM-1B
cpu
14.84s
90
Zonos v0.1
cpu
18.49s
91
VibeVoice 1.5B
cpu
19.39s
92
Fish Speech 1.5
cpu
21.81s
93
Maya1
cpu
35.94s
94
Mars5-TTS
cpu
37.79s
95
Mars5-TTS
cuda
37.89s
96
F5-TTS v1
cpu
38.91s
97
OuteTTS 1.0 1B
cpu
64.24s
Prompt 2
[en]"I'll start a new git branch, push the changes, and open a pull request when the tests pass."
Rank
Model
Device
TTFA warm
Audio
1
Inflect-Nano v2
cuda
28ms
2
Vaniq-Edge
cuda
28ms
3
Inflect-Micro v2
cuda
36ms
4
LFM2.5-Audio 1.5B
cuda
59ms
5
LFM2.5-Audio 1.5B
cpu
60ms
6
Kokoro
cuda
63ms
7
Sopro V2 Turbo (streaming)
cuda
87ms
8
Pocket-TTS
cpu
110ms
9
MeloTTS
cuda
124ms
10
Piper
cpu
150ms
11
StyleTTS 2
cuda
203ms
12
LuxTTS
cuda
205ms
13
StyleTTS 2
cpu
212ms
14
Inflect-Nano v2
cpu
275ms
15
OpenVoice v2
cuda
287ms
16
NeuTTS Nano
cuda
315ms
17
Sopro V2 Turbo
cuda
342ms
18
Orpheus-TTS 3B
cuda
361ms
19
NeuTTS Nano
cpu
390ms
20
NeuTTS Air
cuda
462ms
21
Vaniq-Edge
cpu
485ms
22
Inflect-Micro v2
cpu
513ms
23
NeuTTS Air
cpu
547ms
24
Sopro V2 Turbo (streaming)
cpu
554ms
25
OmniVoice
cuda
678ms
26
Audio8 TTS 0.6B (compiled)
cuda
692ms
27
Scylla's Band
cpu
714ms
28
LongCat-AudioDiT 1B
cuda
787ms
29
MiraTTS
cuda
806ms
30
Kokoro
cpu
824ms
31
Supertonic 3
cpu
1.00s
32
Soprano 1.1 80M
cuda
1.01s
33
Chatterbox Turbo
cuda
1.12s
34
Coqui XTTS-v2
cuda
1.17s
35
MeloTTS
cpu
1.32s
36
F5-TTS v1
cuda
1.34s
37
LuxTTS
cpu
1.57s
38
Qwen3-TTS 1.7B (CUDA-graph)
cuda
1.59s
39
LongCat-AudioDiT 3.5B
cuda
1.66s
40
Higgs Audio v3 TTS
cuda
1.71s
41
Soprano 1.1 80M
cpu
1.75s
42
Chatterbox
cuda
1.90s
43
KittenTTS Nano 0.1
cpu
1.91s
44
OpenVoice v2
cpu
2.24s
45
VibeVoice Realtime 0.5B
cuda
2.24s
46
Sopro V2 Turbo
cpu
2.25s
47
VoxCPM2 2B
cuda
2.43s
48
VibeVoice 1.5B
cuda
2.51s
49
CosyVoice 3 0.5B
cuda
2.79s
50
MOSS-TTS-Nano
cuda
2.86s
51
MOSS-TTS v1.5
cuda
3.11s
52
Magpie-TTS
cuda
3.12s
53
MOSS-TTS v1.0
cuda
3.19s
54
IndexTTS-2
cpu
3.84s
55
Step-Audio-EditX
cuda
4.23s
56
IndexTTS-2
cuda
4.27s
57
Fish Speech 1.5
cuda
4.27s
58
Echo-TTS
cuda
4.30s
59
Parler-TTS Mini v1
cuda
5.17s
60
MOSS-TTS-Nano
cpu
5.18s
61
MetaVoice-1B
cuda
5.34s
62
dots.tts (soar)
cuda
5.39s
63
Qwen3-TTS 1.7B Base
cuda
5.54s
64
Zonos v0.1
cuda
5.72s
65
Sesame CSM-1B
cuda
6.62s
66
Chatterbox Turbo
cpu
6.65s
67
Audio8 TTS Preview 0.1B
cuda
6.96s
68
DramaBox
cuda
7.05s
69
Coqui XTTS-v2
cpu
7.15s
70
Audio8 TTS Preview 0.6B
cuda
7.29s
71
Qwen3-TTS 0.6B CustomVoice
cuda
7.65s
72
Maya1
cuda
8.17s
73
VibeVoice 7B
cuda
9.32s
74
VibeVoice Realtime 0.5B
cpu
11.00s
75
Chatterbox
cpu
12.08s
76
OmniVoice
cpu
12.82s
77
ZipVoice 123M
cpu
13.71s
78
OuteTTS 1.0 1B
cuda
15.09s
79
Miso TTS 8B
cuda
15.38s
80
Audio8 TTS Preview 0.1B
cpu
16.58s
81
Dia 1.6B-0626
cuda
21.78s
82
VoxCPM2 2B
cpu
21.93s
83
Magpie-TTS
cpu
23.70s
84
Qwen3-TTS 0.6B CustomVoice
cpu
25.49s
85
Qwen3-TTS 1.7B Base
cpu
26.55s
86
Fish Speech S2-Pro
cuda
26.67s
87
Audio8 TTS Preview 0.6B
cpu
28.09s
88
VibeVoice 1.5B
cpu
31.43s
89
Parler-TTS Mini v1
cpu
33.06s
90
Zonos v0.1
cpu
45.78s
91
Mars5-TTS
cuda
47.97s
92
Mars5-TTS
cpu
47.98s
93
F5-TTS v1
cpu
49.20s
94
Sesame CSM-1B
cpu
61.47s
95
Fish Speech 1.5
cpu
68.38s
96
Maya1
cpu
82.85s
97
OuteTTS 1.0 1B
cpu
122.25s
Prompt 3
[en]"The Parakeet TDT zero point six billion parameter model achieves one point six nine percent word error rate on LibriSpeech test-clean, beating Whisper Large V3 at two point seven percent while running at over two thousand times realtime on a single GPU."
Rank
Model
Device
TTFA warm
Audio
1
Inflect-Nano v2
cuda
41ms
2
Vaniq-Edge
cuda
50ms
3
LFM2.5-Audio 1.5B
cuda
59ms
4
LFM2.5-Audio 1.5B
cpu
60ms
5
Inflect-Micro v2
cuda
62ms
6
Sopro V2 Turbo (streaming)
cuda
88ms
7
Kokoro
cuda
133ms
8
Pocket-TTS
cpu
138ms
9
MeloTTS
cuda
187ms
10
LuxTTS
cuda
257ms
11
NeuTTS Nano
cuda
348ms
12
Orpheus-TTS 3B
cuda
360ms
13
StyleTTS 2
cuda
398ms
14
StyleTTS 2
cpu
403ms
15
NeuTTS Nano
cpu
419ms
16
Piper
cpu
428ms
17
NeuTTS Air
cuda
492ms
18
Sopro V2 Turbo (streaming)
cpu
522ms
19
OpenVoice v2
cuda
566ms
20
NeuTTS Air
cpu
568ms
21
Inflect-Nano v2
cpu
807ms
22
OmniVoice
cuda
1.05s
23
LongCat-AudioDiT 1B
cuda
1.08s
24
Sopro V2 Turbo
cuda
1.11s
25
Vaniq-Edge
cpu
1.35s
26
Inflect-Micro v2
cpu
1.50s
27
Scylla's Band
cpu
1.60s
28
F5-TTS v1
cuda
1.94s
29
Audio8 TTS 0.6B (compiled)
cuda
1.94s
30
MiraTTS
cuda
2.32s
31
Supertonic 3
cpu
2.67s
32
LongCat-AudioDiT 3.5B
cuda
2.98s
33
Soprano 1.1 80M
cuda
2.99s
34
Chatterbox Turbo
cuda
3.19s
35
Kokoro
cpu
3.30s
36
LuxTTS
cpu
3.33s
37
KittenTTS Nano 0.1
cpu
3.90s
38
Coqui XTTS-v2
cuda
4.15s
39
Echo-TTS
cuda
4.32s
40
Qwen3-TTS 1.7B (CUDA-graph)
cuda
4.32s
41
Chatterbox
cuda
4.60s
42
Soprano 1.1 80M
cpu
4.63s
43
MeloTTS
cpu
4.82s
44
CosyVoice 3 0.5B
cuda
5.26s
45
Higgs Audio v3 TTS
cuda
5.32s
46
VibeVoice Realtime 0.5B
cuda
6.56s
47
MOSS-TTS v1.0
cuda
6.89s
48
VoxCPM2 2B
cuda
7.01s
49
MOSS-TTS-Nano
cuda
7.14s
50
MOSS-TTS v1.5
cuda
7.42s
51
OpenVoice v2
cpu
7.48s
52
Step-Audio-EditX
cuda
9.44s
53
Magpie-TTS
cuda
9.82s
54
VibeVoice 1.5B
cuda
9.97s
55
Sopro V2 Turbo
cpu
10.56s
56
IndexTTS-2
cpu
10.97s
57
IndexTTS-2
cuda
11.19s
58
DramaBox
cuda
11.52s
59
MOSS-TTS-Nano
cpu
12.23s
60
Sesame CSM-1B
cuda
12.95s
61
Fish Speech 1.5
cuda
13.38s
62
MetaVoice-1B
cuda
14.56s
63
Qwen3-TTS 1.7B Base
cuda
14.99s
64
Parler-TTS Mini v1
cuda
15.57s
65
dots.tts (soar)
cuda
17.68s
66
Zonos v0.1
cuda
17.80s
67
Dia 1.6B-0626
cuda
18.82s
68
Audio8 TTS Preview 0.1B
cuda
20.36s
69
Audio8 TTS Preview 0.6B
cuda
20.71s
70
Chatterbox Turbo
cpu
22.73s
71
Qwen3-TTS 0.6B CustomVoice
cuda
25.07s
72
Maya1
cuda
25.34s
73
Coqui XTTS-v2
cpu
25.88s
74
VibeVoice 7B
cuda
25.90s
75
OmniVoice
cpu
31.64s
76
Chatterbox
cpu
31.83s
77
VibeVoice Realtime 0.5B
cpu
31.98s
78
OuteTTS 1.0 1B
cuda
39.77s
79
Miso TTS 8B
cuda
50.14s
80
Audio8 TTS Preview 0.1B
cpu
52.25s
81
VoxCPM2 2B
cpu
59.59s
82
Qwen3-TTS 1.7B Base
cpu
72.20s
83
Qwen3-TTS 0.6B CustomVoice
cpu
76.58s
84
Fish Speech S2-Pro
cuda
81.84s
85
F5-TTS v1
cpu
83.01s
86
Sesame CSM-1B
cpu
84.06s
87
VibeVoice 1.5B
cpu
95.89s
88
Mars5-TTS
cpu
96.12s
89
Mars5-TTS
cuda
97.23s
90
Audio8 TTS Preview 0.6B
cpu
105.34s
91
Magpie-TTS
cpu
106.38s
92
Parler-TTS Mini v1
cpu
108.98s
93
Fish Speech 1.5
cpu
141.83s
94
Zonos v0.1
cpu
164.47s
Prompt 4
[en]"Run pytest tests slash test underscore voice dot py with verbose flag and capture flag set to no."
Rank
Model
Device
TTFA warm
Audio
1
Inflect-Nano v2
cuda
28ms
2
Vaniq-Edge
cuda
29ms
3
Inflect-Micro v2
cuda
38ms
4
LFM2.5-Audio 1.5B
cuda
59ms
5
LFM2.5-Audio 1.5B
cpu
60ms
6
Kokoro
cuda
70ms
7
Sopro V2 Turbo (streaming)
cuda
86ms
8
Pocket-TTS
cpu
123ms
9
MeloTTS
cuda
128ms
10
Piper
cpu
152ms
11
LuxTTS
cuda
206ms
12
StyleTTS 2
cuda
269ms
13
StyleTTS 2
cpu
286ms
14
Inflect-Nano v2
cpu
308ms
15
NeuTTS Nano
cuda
323ms
16
Orpheus-TTS 3B
cuda
362ms
17
OpenVoice v2
cuda
367ms
18
NeuTTS Nano
cpu
406ms
19
NeuTTS Air
cuda
473ms
20
Sopro V2 Turbo
cuda
487ms
21
Sopro V2 Turbo (streaming)
cpu
511ms
22
Vaniq-Edge
cpu
521ms
23
NeuTTS Air
cpu
555ms
24
Inflect-Micro v2
cpu
581ms
25
OmniVoice
cuda
672ms
26
LongCat-AudioDiT 1B
cuda
794ms
27
Kokoro
cpu
959ms
28
Scylla's Band
cpu
963ms
29
Audio8 TTS 0.6B (compiled)
cuda
1.11s
30
Supertonic 3
cpu
1.12s
31
Soprano 1.1 80M
cuda
1.15s
32
Chatterbox Turbo
cuda
1.34s
33
F5-TTS v1
cuda
1.34s
34
MiraTTS
cuda
1.35s
35
MeloTTS
cpu
1.46s
36
LuxTTS
cpu
1.62s
37
LongCat-AudioDiT 3.5B
cuda
1.65s
38
KittenTTS Nano 0.1
cpu
1.71s
39
Soprano 1.1 80M
cpu
1.88s
40
Coqui XTTS-v2
cuda
1.99s
41
Qwen3-TTS 1.7B (CUDA-graph)
cuda
2.07s
42
Chatterbox
cuda
2.26s
43
Higgs Audio v3 TTS
cuda
2.29s
44
OpenVoice v2
cpu
2.60s
45
MOSS-TTS-Nano
cuda
3.08s
46
CosyVoice 3 0.5B
cuda
3.09s
47
VibeVoice Realtime 0.5B
cuda
3.22s
48
Sopro V2 Turbo
cpu
3.32s
49
VoxCPM2 2B
cuda
3.59s
50
MOSS-TTS v1.0
cuda
3.93s
51
MOSS-TTS v1.5
cuda
4.12s
52
Magpie-TTS
cuda
4.32s
53
Echo-TTS
cuda
4.32s
54
VibeVoice 1.5B
cuda
4.81s
55
Step-Audio-EditX
cuda
5.22s
56
IndexTTS-2
cpu
5.23s
57
IndexTTS-2
cuda
5.47s
58
Parler-TTS Mini v1
cuda
5.69s
59
MOSS-TTS-Nano
cpu
5.95s
60
Zonos v0.1
cuda
6.19s
61
Fish Speech 1.5
cuda
6.59s
62
MetaVoice-1B
cuda
7.53s
63
DramaBox
cuda
7.55s
64
Qwen3-TTS 1.7B Base
cuda
7.63s
65
dots.tts (soar)
cuda
8.82s
66
Chatterbox Turbo
cpu
9.17s
67
Audio8 TTS Preview 0.1B
cuda
9.67s
68
Audio8 TTS Preview 0.6B
cuda
10.19s
69
Dia 1.6B-0626
cuda
10.60s
70
Maya1
cuda
10.95s
71
Qwen3-TTS 0.6B CustomVoice
cuda
10.99s
72
Sesame CSM-1B
cuda
11.84s
73
OmniVoice
cpu
12.84s
74
Coqui XTTS-v2
cpu
13.26s
75
VibeVoice Realtime 0.5B
cpu
14.99s
76
ZipVoice 123M
cpu
15.03s
77
VibeVoice 7B
cuda
15.16s
78
Chatterbox
cpu
16.17s
79
OuteTTS 1.0 1B
cuda
16.87s
80
Miso TTS 8B
cuda
17.67s
81
Audio8 TTS Preview 0.1B
cpu
23.24s
82
Magpie-TTS
cpu
33.05s
83
VoxCPM2 2B
cpu
33.64s
84
Qwen3-TTS 1.7B Base
cpu
36.51s
85
Qwen3-TTS 0.6B CustomVoice
cpu
38.53s
86
Fish Speech S2-Pro
cuda
38.87s
87
Parler-TTS Mini v1
cpu
38.88s
88
Audio8 TTS Preview 0.6B
cpu
44.74s
89
Mars5-TTS
cpu
50.17s
90
F5-TTS v1
cpu
50.71s
91
Zonos v0.1
cpu
50.77s
92
Mars5-TTS
cuda
51.80s
93
VibeVoice 1.5B
cpu
62.28s
94
Fish Speech 1.5
cpu
63.58s
95
Sesame CSM-1B
cpu
70.00s
Prompt 5
[fr]"Bonjour, je m'appelle Cicero et je vais vous aider avec votre code aujourd'hui."