Breeze TTS 2 ist die Nr. 1 im Open-Weights-TTS-Leaderboard von Artificial Analysis

Breeze TTS 2 ist das beste Open-Weights-Text-zu-Sprache-Modell in der Provider Voice Arena von Artificial Analysis: Quality Elo Score von 1215 und 90 Punkte Vorsprung auf das zweitplatzierte Open-Weights-Modell, ermittelt in blinden Hörtests mit echten Menschen.

Breeze TTS 2: Platz 1 im TTS-Ranking mit offenen Gewichten bei Artificial Analysis

Breeze TTS 2 ist jetzt das Open-Weights-Text-zu-Sprache-Modell Nr. 1 im Provider Voice Arena Leaderboard von Artificial Analysis, mit einem Quality Elo Score von 1215.

Im Leaderboard-Snapshot vom 26. August 2026 lag Breeze TTS 2 vor jedem anderen Open-Weights-TTS-Modell, das Artificial Analysis bewertet hat. Der Vorsprung betrug 90 Elo-Punkte auf das zweitplatzierte Fish Audio S2 Pro und 113 Punkte auf das drittplatzierte Step Audio EditX.

Das ist ein wichtiger Meilenstein für BreezeBlue und für Open-Weights-Voice-AI insgesamt. Die Platzierung beruht auf blinden Hörpräferenzen echter Menschen, nicht auf vom Anbieter ausgewählten Werten oder automatisierten Audiometriken, und macht Breeze TTS 2 zum bestbewerteten Open-Weights-Modell in dieser unabhängigen TTS-Evaluation.

Was ist die Artificial Analysis TTS Arena?

Die Artificial Analysis Text to Speech Arena ist ein unabhängiger Benchmark, der Modelle zur Sprachgenerierung in blinden Hörtests direkt gegeneinander antreten lässt.

In jedem Vergleich hören die Teilnehmenden zwei Audioclips, die aus demselben Text erzeugt wurden, ohne zu sehen, welche Modelle dahinterstecken. Sie wählen den Clip, der natürlicher klingt, und Artificial Analysis verdichtet diese Präferenzen zu einem relativen Quality Elo Score. Ein höherer Elo-Wert bedeutet, dass die Hörenden dieses Modell im Vergleich zu den anderen Modellen in der Arena häufiger bevorzugt haben.

Das Leaderboard ist darauf ausgelegt, die wahrgenommene Sprachqualität so zu erfassen, wie echte Hörende sie erleben. Dazu gehören Eigenschaften wie:

  • Natürlichkeit

  • Audioqualität

  • Aussprache

  • Tempo

  • Prosodie und Ausdrucksstärke

Für die Provider Voice Arena bewertet Artificial Analysis jedes Modell mit einer repräsentativen Auswahl seiner verfügbaren Stimmen. Ziel ist es, männliche und weibliche Stimmen mit US- und UK-Akzent abzudecken, mit bis zu acht Stimmen pro Modell. Der resultierende Score spiegelt also das Gesamterlebnis mit den Stimmen eines Modells wider und nicht eine einzelne, handverlesene Demo.

Artificial Analysis veröffentlicht außerdem Stichprobengrößen, Konfidenzbereiche, Kategoriefilter und Akzentfilter, damit sich die Platzierung einordnen lässt. Elo ist ein relatives Maß, daher können sich die Werte verändern, wenn neue Stimmen abgegeben werden und neue Modelle in die Arena kommen.

Breeze TTS 2 führt das Open-Weights-Leaderboard an

Breeze TTS 2 steigt auf Platz 1 des Open-Weights-TTS-Leaderboards von Artificial Analysis
Breeze TTS 2 übernimmt Platz 1 im Open-Weights-Provider-Voice-Leaderboard von Artificial Analysis.

Die fünf besten Open-Weights-Modelle in der Provider Voice Arena waren:

RangModellEntwicklerQuality Elo
1Breeze TTS 2BreezeBlue1215
2Fish Audio S2 ProFish Audio1125
3Step Audio EditX (March 2026)StepFun1102
4Voxtral TTSMistral1082
5Magpie-Multilingual 357MNVIDIA1066

Breeze TTS 2 hatte 90 Punkte Vorsprung auf den nächsten Open-Weights-Wettbewerber. In einem Elo-System wird jeder Wert relativ zu den Hörpräferenzen im gesamten Modellfeld bestimmt. Ein solcher Vorsprung ist deshalb ein aussagekräftiges Signal dafür, wie konsequent sich die Hörenden für Breeze TTS 2 entschieden haben.

Auch in der vollständigen Provider Voice Arena zählt Breeze TTS 2 zu den bestbewerteten TTS-Systemen insgesamt, Seite an Seite mit führenden proprietären Modellen. Da sich die Arena-Werte mit jeder neuen Stimme fortlaufend aktualisieren, zeigt das Bild des vollständigen Leaderboards unten einen späteren Snapshot.

Breeze TTS 2 hervorgehoben unter den Top-Modellen im vollständigen Provider Voice Arena Leaderboard von Artificial Analysis
Breeze TTS 2 gehört in diesem Snapshot der vollständigen Provider Voice Arena zu den fünf besten Modellen insgesamt.

Warum dieser Platz 1 wichtig ist

Wir sind überzeugt, dass Entwickler sich nicht zwischen offenem Zugang und herausragender Stimmqualität entscheiden sollten. Open-Weights-Sprachmodelle bieten mehr Freiheit, ein Modell zu prüfen, zu evaluieren und in der eigenen Infrastruktur zu betreiben. In der wahrgenommenen Qualität lagen sie bisher jedoch hinter den stärksten kommerziellen APIs zurück.

Das Ergebnis von Artificial Analysis zeichnet ein anderes Bild. In blinden Vergleichen setzten die Hörenden Breeze TTS 2 klar vor den Rest des Open-Weights-Felds und in dieselbe Spitzengruppe wie führende proprietäre TTS-Systeme.

Damit ist die Platzierung relevant für Teams, die Folgendes bauen:

  • Konversationelle Voice-Agents

  • Charaktere für Games und Animation

  • Hörbücher und erzählerische Inhalte

  • KI-Synchronisation und Lokalisierungs-Workflows

  • Podcasts und Creator-Tools

  • Anwendungen im Kundenservice

Für diese Produkte muss Sprache mehr leisten, als Wörter korrekt auszusprechen. Sie muss natürlich klingen, Absicht transportieren, eine glaubwürdige Stimmidentität halten und zum Kontext der Interaktion passen. Präferenztests mit echten Menschen sind wertvoll, weil die Hörenden all diese Qualitäten gemeinsam beurteilen, statt sie auf ein einzelnes automatisiertes Signal zu reduzieren.

Gebaut, um eine Stimme zu gestalten und ihre Performance zu führen

Wir haben Breeze TTS 2 entwickelt, damit jeder Charakter die richtige Stimme und jede Zeile die richtige Performance bekommt. Es verbindet hoch bewertete Sprachqualität mit Werkzeugen, um Stimmen zu erschaffen und zu führen:

  • [Stimmdesign](/voice-design) erschafft eine unverwechselbare Stimme aus einer Beschreibung in natürlicher Sprache, ganz ohne Referenzaudio.

  • [Stimmklonen](/voice-cloning) nutzt Referenzaudio samt Transkript, um Klangfarbe, Rhythmus, Emotion und Stil eines Sprechers zu bewahren.

  • Stimmregie steuert Ton, Emotion, Tempo und Vortrag über Anweisungen in natürlicher Sprache, während die Referenzstimme wiedererkennbar bleibt.

  • Vocal Events fügen ausdrucksstarke Momente wie Lachen, Seufzen, Husten und Räuspern direkt im Skript hinzu.

  • Echtzeit-Streaming unterstützt die Audiogenerierung im Stream, mit einer Zeit bis zum ersten Audio (TTFA) von unter 40 ms.

  • Sprachausgabe auf Englisch und Chinesisch wird im Open-Weights-Release unterstützt.

Diese Fähigkeiten machen Breeze TTS 2 zu mehr als einer Sammlung vorgefertigter Stimmen. Entwickler und Creator können einen Charakter gestalten, seine Identität bewahren und festlegen, wie er eine bestimmte Zeile vorträgt, alles innerhalb desselben Modells.

Das Arena-Ergebnis ergänzt dieses Fähigkeitenpaket um ein wichtiges externes Signal: Als die Hörenden die generierte Sprache verglichen, ohne den Modellnamen zu kennen, ging Breeze TTS 2 als ihre erste Wahl unter den Open-Weights-Modellen hervor.

Ein neuer Maßstab für Open-Weights-Voice-AI

Kein öffentliches Leaderboard kann jedes Skript, jeden Sprecher, jede Sprache oder jede Produktionsumgebung abbilden. Aber blinde Präferenztests mit echten Menschen sind einer der klarsten Prüfsteine für das Erlebnis, das am meisten zählt: wie die generierte Stimme für Hörende tatsächlich klingt.

Das Ergebnis ist ein starker Ausgangspunkt. Breeze TTS 2 erreichte:

  • Platz 1 unter den Open-Weights-TTS-Modellen

  • Einen Quality Elo Score von 1215

  • 90 Punkte Vorsprung auf das zweitplatzierte Open-Weights-Modell

Für uns bestätigt dieses Ergebnis eine Kernidee hinter Breeze TTS 2: Ein Open-Weights-Modell kann natürliche, ausdrucksstarke Sprache liefern und Entwicklern zugleich mehr Kontrolle über Stimmerstellung, Performance und Deployment geben.

Breeze TTS 2 ist über den BreezeBlue Creator und die BreezeBlue API verfügbar. Entwickler finden außerdem die Modellgewichte von Breeze TTS 2 auf Hugging Face und den offiziellen PyTorch-Inferenzcode auf GitHub.

Quellen

Hör dir das Open-Weights-Stimmmodell Nr. 1 an

Gestalte eine Stimme, führe Regie bei ihrer Performance und generiere Sprache mit Breeze TTS 2 im BreezeBlue Creator, über die API oder direkt aus den offenen Gewichten.