Text vorlesen lassen
Aus geschriebenen Wörtern wird hörbare Sprache. Probiere aus, wie Tempo und Satzzeichen das Zuhören verändern.
Am Beispiel verstehen
Probiere denselben Text mit einem anderen Tempo. Die Stimme wird von deinem Browser bereitgestellt; dies ist kein Vergleich bestimmter KI-Modelle.
So funktioniert es
Text-to-Speech wandelt geschriebenen Text in ein Audiosignal um. Stimme, Sprache und Aussprache hängen vom verwendeten System ab. Ein TTS-System muss den Inhalt nicht fachlich beurteilen, um ihn vorzulesen.
Gut zuhören
Achte auf Pausen, Zahlen, Abkürzungen und Namen. Ein flüssig gesprochener Satz kann trotzdem einen falschen Inhalt enthalten. Prüfe deshalb den Ausgangstext.
Ein Baustein im Projekt
Ein Vorlesehelfer verbindet Texterkennung mit Sprachausgabe. Ein Sprachassistent kann TTS verwenden, um eine bereits erstellte Antwort hörbar zu machen. Die umgekehrte Richtung – Sprache in Text – heisst Spracherkennung oder STT.
Dein Versuch
Lass denselben kurzen Text mit unterschiedlichem Tempo vorlesen. Welche Version kannst du besser verstehen?
Quellen & weiterführende Dokumentation
Damit kannst du weiterdenken.
-
Dein Zuhause mit Home Assistant automatisieren
Home Assistant frontend contributors; Aufnahme: LunoLabs · Apache-2.0
Wie wird aus einer Situation eine passende Reaktion?
Mit interaktivem Beispiel · 2 Videos
-
Ein Vorlesehelfer mit Kamera und Stimme
Kann ein kleines Gerät gedruckten Text für dich vorlesen?
-
Einen eigenen KI-Agenten verstehen und aufsetzen
Was verändert sich, wenn ein Sprachmodell Werkzeuge benutzen kann?
Mit interaktivem Beispiel · 2 Videos
Das hängt zusammen.
- OCR Bild mit Schrift → Bearbeitbarer Text
Text aus Bildern lesen
Ein Foto wird zu Text, den du kopieren, durchsuchen oder vorlesen lassen kannst.
4 Min. Einstieg - STT Gesprochene Sprache → Transkript
Gesprochenes aufschreiben
Aus einer Sprachaufnahme wird ein Transkript. Verstehe den Unterschied zwischen Gesagtem, erkanntem Text und einer ausgeführten Aufgabe.
4 Min. Einstieg
Aktuelles zu TTS
Weitere Beiträge suchen-
Vom Bild zur Stimme: drei Aufgaben, ein Projekt
OCR, visuelle Sprachmodelle und TTS helfen bei unterschiedlichen Aufgaben. So findest du den passenden Einstieg.