

Bland Speech v3
#3 in Sprachsynthese (TTS)Bland · v3 · 3× · zuletzt 06. Aug. 2026
Bland Speech v3 ist ein proprietäres Text-to-Speech-Modell von Bland, das auf über 100 Millionen realen menschlichen Gesprächen trainiert wurde und speziell für Telefongespräche und Voice-AI-Agenten entwickelt wurde. Es erzielte im Audio Realism Bench von Design Arena die Bestplatzierung unter den TTS-Modellen und schlug dabei ElevenLabs, OpenAI, Cartesia und xAI, wobei nur echte menschliche Sprecher noch realistischer bewertet wurden. Das Modell unterstützt Sprachausgabe über eine einzelne API (/v1/speak bzw. /v2/tts), Streaming per HTTP-Chunks oder WebSocket sowie Instant- und Professional-Voice-Cloning. Zugriff erfolgt über die Bland-Plattform (bland.ai/speech, docs.bland.ai) mit nutzungsbasierter Abrechnung pro Zeichen.