Wir suchen eine:n TTS/STT Experte:in, der:die unsere Text-to-Speech und Speech-to-Text Systeme weiterentwickelt. Du wirst die Natürlichkeit und Emotionalität der generierten Sprache für unsere Avatare verbessern und an der Spitze der Sprachtechnologie mitarbeiten.
Tätigkeiten
- Wir entwickeln und optimieren unsere Sprachsynthese- und Spracherkennungssysteme.
- Wir verbessern die natürliche Sprachverarbeitung für flüssigere Dialoge.
- Wir optimieren Latenz und Qualität der Echtzeit-Sprachverarbeitung.
- Wir integrieren Sprach-APIs und entwickeln eigene Lösungen.
Anforderungen
- Master oder PhD in Sprachtechnologie oder Computerlinguistik
- Erfahrung mit Deep Learning für Sprachsynthese und -erkennung
- Kenntnisse in Python und C++
- Vertrautheit mit modernen TTS/STT-Modellen und -APIs (z. B. Whisper, CosyVoice, F5-TTS oder Google/Amazon Speech)
- Forschungserfahrung im Bereich TTS/STT ist von Vorteil
Team
Du wirst Teil eines internationalen Teams, das an der Spitze der Sprachtechnologie arbeitet. Wir bieten Lernförderung, Forschungsmöglichkeiten und Zugang zu modernster Hardware.
Bewerbungsprozess
- Erster Call
- Video-Interview
- Triff das Team