So wählen Sie das richtige Modell

Dieser Leitfaden zeigt Ihnen, wie Sie das passende ElevenLabs-Modell für Ihren Anwendungsfall auswählen.

ElevenLabs bietet eine Reihe von Modellen, die für unterschiedliche Anforderungen optimiert sind. Die richtige Wahl hängt von Ihrem Anwendungsfall, Ihren Latenzanforderungen und Ihren Qualitätserwartungen ab. Vollständige Spezifikationen finden Sie in der Modellreferenz.

Nach Anforderung

Qualität

Verwenden Sie eleven_v4

Das Flaggschiffmodell mit der höchsten Wiedergabetreue, dem reichsten emotionalen Ausdruck und der breitesten Sprachunterstützung.

Niedrige Latenz

Verwenden Sie eleven_v4_turbo

Optimiert für Echtzeitanwendungen mit ~75 ms Latenz.

Nach Anwendungsfall

Content-Erstellung

Verwenden Sie eleven_v4

Ideal für professionelle Inhalte, Hörbücher und Videokommentare.

Konversationsagenten

Verwenden Sie eleven_v4_turbo für die ausdrucksstärkste Wiedergabe oder eleven_flash_v2_5 und eleven_flash_v2 für die niedrigste Latenz.

Verwenden Sie das 2.5-Modell für Sprachunterstützung außerhalb des Englischen.

Optimiert für Konversationsanwendungen in Echtzeit.

Transkription

Verwenden Sie scribe_v2 für Batch-Transkription, scribe_v2_medical für medizinisches und klinisches Audio oder scribe_v2_realtime für Echtzeit-Transkription.

Modernste Genauigkeit in über 90 Sprachen mit Sprecherdiarisierung und Zeitstempeln auf Wortebene.

Stimmenverzerrer

Verwenden Sie eleven_multilingual_sts_v2

Spezialisiert auf Speech-to-Speech-Konvertierung.

Nächste Schritte