Zum Inhalt springen

Text to Speech

Text to Speech mit hochwertigen, menschenähnlichen KI-Stimmen

Vertraut von über 1 Mio. Nutzern • Kostenlos starten

Ausgewählt für Ihren Anwendungsfall

Ausgewählt für Ihren Anwendungsfall

Stimme auswählen

Sprache generieren

Emotional und kontextsensitiv KI-Stimmen für Text to Speech

Unsere Voice AI reagiert auf emotionale Hinweise im Text und passt die Sprechweise sowohl an den unmittelbaren Inhalt als auch an den weiteren Kontext an. So erreichen unsere KI-Stimmen ein breites emotionales Spektrum und vermeiden logische Fehler beim Vorlesen Ihrer Inhalte.

Emotion, Sprechweise und Regie steuern

Erstellen Sie steuerbare, ausdrucksstarke Sprache mit Emotionen, Audioereignissen und immersiven Klangwelten.

Zugriff auf eine Bibliothek mit über 10.000 menschenähnlichen Stimmen

Entdecken Sie eine stetig wachsende Sammlung ausdrucksstarker, lebensechter Stimmen für jeden Einsatzbereich – von Erzählungen bis zur Charaktergestaltung.

Unterstützung für Dialoge

Erstellen Sie Audio-Dialoge, in denen Sprecher Kontext und Emotionen teilen.

Eine Stimme klonen oder gestalten

Replizieren Sie Ihre eigene Stimme sofort oder erstellen Sie einzigartige KI-Stimmen mit voller Kontrolle.

Mehrsprachige Sprachausgabe

Erwecken Sie Geschichten in über 70 Sprachen zum Leben – mit Emotionen und Klarheit auf muttersprachlichem Niveau.

Für vielfältige Einsatzbereiche entwickelt – von KI-Agenten bis zu Hörbüchern und Voiceovers

Konversationsagenten

Nutzen Sie KI-Text-to-Speech, um natürliche, menschenähnliche Stimmen für Chatbots und virtuelle Assistenten zu erstellen. Das verbessert die Interaktion durch realistische Antworten.
TTS used for Conversational Agents

Gaming

Generieren Sie Voiceovers für Videospielcharaktere mit der Text-to-Speech-API – mit kontextsensitiven und emotional passenden Stimmen für Spielszenarien.
Text to Speech for narration in video games

Hörbücher

Wandeln Sie geschriebenen Text in natürlich klingende KI-Stimmen für Hörbücher um und produzieren Sie Inhalte schnell in mehreren Sprachen.
Use TTS to generate audiobooks

Video-Voiceovers

Produzieren Sie hochwertige Voiceovers für Videos, TV-Shows und Animationen mit KI-Text-to-Voice. Das macht menschliche Sprecher überflüssig und beschleunigt die Produktion.
Add voiceovers to videos with TTS

Podcasts

Nutzen Sie KI-Text-to-Speech für Podcasts mit konsistenter, professionell klingender Erzählstimme und reduzieren Sie den Aufwand für manuelle Aufnahmen.
Generate podcasts in Studio

Barrierefreiheit

Integrieren Sie Text to Speech in Websites und Apps, um Audio-Versionen von Inhalten bereitzustellen. So können Nutzer mit Sehbehinderungen oder Leseschwierigkeiten leichter auf Informationen zugreifen.
Use text to speech for screen readers

Millionen von Wörtern werden jede Minute generiert

Sprache in über 70 Sprachen und zahlreichen Akzenten generieren

  • English
  • Afrikaans
  • Arabic
  • Armenian
  • Assamese
  • Azerbaijani
  • Belarusian
  • Bengali
  • Bosnian
  • Bulgarian
  • Catalan
  • Cebuano
  • Chichewa
  • Chinese
  • Croatian
  • Czech
  • Danish
  • Dutch
  • Estonian
  • Filipino
  • Finnish
  • French
  • Galician
  • Georgian
  • German
  • Greek
  • Gujarati
  • Hausa
  • Hebrew
  • Hindi
  • Hungarian
  • Icelandic
  • Igbo
  • Indonesian
  • Irish
  • Italian
  • Japanese
  • Javanese
  • Kannada
  • Kazakh
  • Kirghiz
  • Korean
  • Latvian
  • Lingala
  • Lithuanian
  • Luxembourgish
  • Macedonian
  • Malay
  • Malayalam
  • Mandarin Chinese
  • Marathi
  • Nepali
  • Norwegian
  • Pashto
  • Persian
  • Polish
  • Portuguese
  • Punjabi
  • Romanian
  • Russian
  • Serbian
  • Sindhi
  • Slovak
  • Slovenian
  • Somali
  • Spanish
  • Swahili
  • Swedish
  • Tamil
  • Telugu
  • Thai
  • Turkish
  • Ukrainian
  • Urdu
  • Vietnamese
  • Welsh
  • African
  • American
  • Argentine
  • Australian
  • British
  • Californian
  • Canadian
  • Cockney
  • Country
  • Czech Moravian
  • Desi
  • Filipino
  • French Swiss
  • German
  • German Bavarian
  • Indian
  • Irish
  • Italian
  • Jamaican
  • Latin American
  • Latino
  • Mexican
  • New York
  • Pakistani
  • Portuguese
  • Russian
  • Scandinavian
  • Scottish
  • Southern USA
  • Spanish
  • Spanish Castilian
  • Texas
  • Turkish Istanbul

Auf Basis der leistungsstärksten Text-to-Speech-Modelle

Eleven v3

Unser fortschrittlichstes, ausdrucksstärkstes Modell mit Audio-Tags für präzise emotionale Kontrolle. Ideal für Storytelling, Gaming und Medienproduktion in über 70 Sprachen.

  • Dramatische Sprechweise und Performance
  • Über 70 unterstützte Sprachen
  • Zeichenlimit von 5.000
  • Dialoge mit mehreren Sprechern

Multilingual v2

Unser lebensechtestes, emotional reichstes Text-to-Speech-Modell mit Unterstützung für 29 Sprachen. Ideal für Voiceovers, Hörbücher, Postproduktion und Content-Erstellung.

  • Natürlich klingende Ausgabe
  • 29 unterstützte Sprachen
  • Zeichenlimit von 10.000
  • Für lange Generierungen entwickelt

Flash v2.5

Unser hochwertiges TTS-Modell mit geringer Latenz in 32 Sprachen. Ideal für Entwickler-Anwendungen, bei denen Geschwindigkeit zählt und nicht-englische Sprachen benötigt werden.

  • Extrem geringe Latenz (~75 ms*)
  • 32 unterstützte Sprachen
  • Zeichenlimit von 40.000
  • Schnelleres Modell, 50 % niedrigerer Preis pro Zeichen

Turbo v2.5

Hochwertiges Modell mit geringer Latenz und ausgewogenem Verhältnis zwischen Qualität und Geschwindigkeit

  • Hochwertige Stimmgenerierung
  • 32 unterstützte Sprachen
  • Zeichenlimit von 40.000
  • Geringe Latenz (~250–300 ms†), 50 % niedrigerer Preis pro Zeichen

Vertraut von führenden Creators weltweit und ihren Communities

Text-to-Speech-Preise

0 $ pro Monat

10k Credits pro Monat

Kostenlos
0 $ pro Monat
Starter
6 $ pro Monat
Creator
22 $ pro Monat, erster Monat 11 $
Pro
99 $ pro Monat

10k Credits pro Monat

30k Credits pro Monat

121k Credits pro Monat

600k Credits pro Monat

Text to Speech (UI)

Inklusive Minuten

Zusätzliche Minuten

Audioqualität

~10

~0,36 $

128 kbps, 44,1kHz

~30

~0,20 $

128 kbps, 44,1kHz

~121

~0,18 $

128 kbps, 44,1kHz

~600

~0,17 $

128 & 192 kbps (über Studio & API), 44,1kHz

Preise exkl. Steuern, Abgaben und Zölle. Alle Preismodelle anzeigen.

Sicherheit und Infrastruktur auf Enterprise-Niveau für jeden Umfang

Foreground

Verfügbar im Web, auf Mobilgeräten sowie über APIs und SDKs

ElevenLabs Studio

Die besten KI-Audiomodelle in einem leistungsstarken Editor.

Use TTS in the ElevenLabs Studio

ElevenLabs Mobile App

Generieren Sie ausdrucksstarkes Audio in Sekunden mit unseren iOS- und Android-Apps.

ElevenLabs Mobile app

Text-to-Speech-APIs und SDKs

Integrieren Sie ElevenLabs Text to Speech (TTS) über APIs oder SDKs in Ihr Produkt.

TTS API

Der globale Einfluss der KI-Audioforschung

Entdecken Sie unsere KI-Stimmen für Text to Speech

Häufig gestellte Fragen

Neueste Updates

Erstellen Sie mit hochwertiger KI-Audio