Text rein. Stimme raus.
Lokale Sprachsynthese, direkt im Browser.
01 / Text & Wiedergabe
Eine Sitzung öffnen, Textfragmente senden und die Eingabe explizit abschließen. Audio spielt währenddessen bereits ab.
Live-Ausgabe
02 / Stimme & Modell
Schneller Start mit gespeicherter Stimme.
Dieses Base-Modell unterstützt keine Voice Instructions.
Sampling & Optionen
Codec, Transport & weitere Optionen
Referenzstimme hinzufügen
Vorberechnete Latents importieren
Statt Audio beide nativen Dateien wählen. Transkript und Name oben werden übernommen.
Gespeicherte Stimmen
Server & Fähigkeiten
Modell, Quantisierung, Engine, Grenzen und Startkonfiguration sind Servereigenschaften. Sie werden hier angezeigt, nicht durch einen Sprechauftrag heimlich verändert.
Bitte verbinden.
Letzter Auftrag (ohne Zugangsdaten)
Noch kein Auftrag.
Streaming-Ereignisse & Fehler 0
Empfangene Protokollereignisse und Browserstatus.
Was wird gemessen?
Ab Senden des Textes: erstes PCM = Empfang im Browser; hörbar = geplanter Wiedergabezeitpunkt des ersten Samples mit Betrag ≥ 256, einschließlich Browserpuffer. Kein Mikrofon-Messwert. RTF = Zeit bis zum letzten PCM / Audiodauer. Pausen und manuelle Eingabezeiten sind enthalten. WAV wartet auf die vollständige Ausgabe.