Anzeige
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige
Lesedauer 3 Min.

Text to speech service

Gemessen daran, wie gut die Übertragung von Text in Sprache bereits funktioniert, wird diese Technologie noch von sehr wenigen Apps genutzt. Microsoft bietet mit Azure Speech eine einfache Möglichkeit Texte den Nutzern per Sprachausgabe näherzubringen.
Laut Microsoft wird die Ausgabe nahezu in Echtzeit generiert und sie lässt sich sogar als Audio-Datei speichern, um sie später ohne Neugenerierung parat zu haben. Auch die Sprecher hören sich dabei weitaus besser an, als die in Windows enthaltenen Muster, welche man direkt in jeder App dank des .NET-APIs System.Speech.Synthesis nutzen kann.Die Sprachsynthese in Azure steht in 45 Sprachen zur Verfügung, darunter auch deutsch. Für viele Sprachen gibt es sowohl eine männliche als auch eine weibliche Stimme für die Sprachausgabe. Auf dieser Seite können Sie sich die englischen, die deutschen sowie ein paar weitere Stimmen anhand von Mustersätzen anhören. Einstellbar sind laut Microsoft Tonhöhe, Geschwindigkeit, Lautstärke, Betonung sowie zusätzliche Pausen.Die Dokumentation dazu finden Sie auf dieser Seite. Dort gibt es unter anderem einen Schnellstart, der zeigt, wie man mithilfe von Python und dem Text-to-Speech-REST-API Text in Sprache konvertiert. Für die Schnellstartanleitung wird ein Azure-Cognitive-Services-Konto mit einer Ressource für den Speech-Dienst benötigt. Wer über kein Konto verfügt, kann über die kostenlose Testversion einen Abonnementschlüssel abrufen.Den direkten Einstieg in die Thematik finden Sie auf dieser Seite, wobei dort neben API-Keys für Text to Speech auch für Speech to Text sowie die Übersetzung und – als Preview – auch eine Sprecher-Erkennung angeboten werden.Nicht nur die Standard-Stimmen können genutzt werden, sondern man kann Stimmen auch selbst anlegen und trainieren. Allerdings gibt es solche Custom Voice Models derzeit nur für englisch und chinesisch.Beispiele: azure.microsoft.com/en-us/services/cognitive-services/text-to-speech/Dokumentation: docs.microsoft.com/en-us/azure/cognitive-services/speech-service/how-to-text-to-speechAusprobieren: azure.microsoft.com/en-us/try/cognitive-services/?api=speech-services
Miscellaneous

Neueste Beiträge

Security ist essenziell - Secure Boot: Sicherheit von Anfang an
Die beste Verschlüsselung wird ausgehebelt, wenn das Betriebssystem schon beim Bootvorgang kompromittiert wird.
8 Minuten
25. Mai 2026
Interaktive Planung und integrierte AI-Code-Reviews mit Cursor - Die KI-IDE Cursor in der Praxis, Teil 1
Cursor kombiniert den Plan-Modus mit integrierten AI-Code-Reviews und verbindet so Planung mit Umsetzung und Qualitätssicherung in einem interaktiven Entwicklungsworkflow.
8 Minuten
3. Jun 2026
Warum moderne Anwendungen neue Messmethoden brauchen - Real User Monitoring im Wandel
Die Kombination aus Real User Monitoring und einer umfassenden Observability-Strategie ermöglicht es, Frontend-Interaktionen mit den zugrunde liegenden Systemprozessen zu verknüpfen. KI-gestützte Observability hilft dabei, die Telemetriedaten auszuwerten und komplexe Zusammenhänge sichtbar zu machen.
6 Minuten

Das könnte Dich auch interessieren

00:00
Wenn die KI den Bug findet, bevor Du anfängst zu suchen - KI in der Softwarewartung
Root-Cause-Analysis, Technical Debt, Legacy-Dokumentation – das sind die Klassiker, die Entwickler:innen regelmäßig Stunden kosten. Harald Binkle erklärt im Interview, wie KI-Werkzeuge die Arbeit der Maintenance vereinfachen können. Wer mehr will, sollte auf die Infinite AI Conference 2026 kommen.
5. Mai 2026
Elektronische Schaltkreise im Browser simulieren - Simulation
Statt mit Steckfeld oder Lötkolben kann man auf dieser Website Schaltungen per Drag and Drop zusammenstellen und deren Verhalten testen.
2 Minuten
26. Jul 2018
Deep Learning in .NET – TensorFlow.NET und TorchSharp - .NET, Python und KI, Teil 3
Mit modernen KI-Frameworks lassen sich Deep-Learning-Modelle direkt in C# entwickeln.
6 Minuten
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige