Text-to-Speech (Sprachausgabe)
Lokale Piper-Stimmen oder Online-Dienste einrichten, Stimmen installieren und testen und den Sprach-Cache der MuPiBox verwalten.
Die Box spricht: Titel und Kategorien beim Antippen, die Uhrzeit, den Akkustand, Nachrichten aus der Verwaltung oder Home Assistant. Unter Text-to-Speech richtest du die Stimme ein.
Grundregel: eine Box = eine Sprache = eine aktive Stimme. Nach einer Änderung erzeugt die Box ihre Sprachdateien im Hintergrund neu.
Konfiguration
| Auswahl | Beschreibung |
|---|---|
| Lokal (Piper) | Stimmen laufen direkt auf der Box, ohne Internet und ohne Kosten. Empfohlen. |
| Microsoft Azure | Offizieller Dienst mit Neural-Stimmen; eigener Speech-Schlüssel nötig, kostenloser F0-Tarif verfügbar. Der Text wird an Azure übertragen. |
| Google Cloud TTS | Offizieller Dienst; eigenes Service-Account-JSON und aktiviertes Billing nötig. |
| Google Translate (experimentell) | Kostenlos ohne Zugangsdaten, nutzt einen inoffiziellen Endpunkt, der sich jederzeit ändern kann. |
Schlüssel und JSON-Dateien werden nur lokal gespeichert und nach dem Speichern nicht wieder angezeigt.
- Hintergrund-CPU: begrenzt, wie viel Rechenleistung die Vorbereitung im Hintergrund nutzen darf, damit die Wiedergabe flüssig bleibt.
- Pre-Rendering: bereitet neue oder geänderte Texte automatisch vor. Bei Online-Diensten standardmäßig aus, weil es Freikontingent verbraucht.
Stimmen
Der Stimmenkatalog listet verfügbare Piper-Stimmen je Sprache. Viele lassen sich vorab über ein kurzes Hörbeispiel testen; das vollständige Modell wird erst mit „Installieren“ gespeichert.
Stimme testen
Einen Testtext eingeben und anhören – über den aktuellen Audioausgang der Box.
Cache
Gesprochene Texte werden als Audiodateien gespeichert und sofort abgespielt.
- Fehlende erzeugen: erfasst alle sichtbaren Inhalte und erzeugt nur fehlende Dateien.
- Neue Generation: erstellt den Cache für die aktuelle Sprache/Stimme neu (z. B. nach einem Stimmenwechsel).
- Aufräumen: löscht veraltete Generationen sofort.