MuPiBox Dokumentation MuPiBox NG

Text-to-Speech (Sprachausgabe)

Lokale Piper-Stimmen oder Online-Dienste einrichten, Stimmen installieren und testen und den Sprach-Cache der MuPiBox verwalten.

Die Box spricht: Titel und Kategorien beim Antippen, die Uhrzeit, den Akkustand, Nachrichten aus der Verwaltung oder Home Assistant. Unter Text-to-Speech richtest du die Stimme ein.

Grundregel: eine Box = eine Sprache = eine aktive Stimme. Nach einer Änderung erzeugt die Box ihre Sprachdateien im Hintergrund neu.

Konfiguration

AuswahlBeschreibung
Lokal (Piper)Stimmen laufen direkt auf der Box, ohne Internet und ohne Kosten. Empfohlen.
Microsoft AzureOffizieller Dienst mit Neural-Stimmen; eigener Speech-Schlüssel nötig, kostenloser F0-Tarif verfügbar. Der Text wird an Azure übertragen.
Google Cloud TTSOffizieller Dienst; eigenes Service-Account-JSON und aktiviertes Billing nötig.
Google Translate (experimentell)Kostenlos ohne Zugangsdaten, nutzt einen inoffiziellen Endpunkt, der sich jederzeit ändern kann.

Schlüssel und JSON-Dateien werden nur lokal gespeichert und nach dem Speichern nicht wieder angezeigt.

  • Hintergrund-CPU: begrenzt, wie viel Rechenleistung die Vorbereitung im Hintergrund nutzen darf, damit die Wiedergabe flüssig bleibt.
  • Pre-Rendering: bereitet neue oder geänderte Texte automatisch vor. Bei Online-Diensten standardmäßig aus, weil es Freikontingent verbraucht.

Stimmen

Der Stimmenkatalog listet verfügbare Piper-Stimmen je Sprache. Viele lassen sich vorab über ein kurzes Hörbeispiel testen; das vollständige Modell wird erst mit „Installieren“ gespeichert.

Stimme testen

Einen Testtext eingeben und anhören – über den aktuellen Audioausgang der Box.

Cache

Gesprochene Texte werden als Audiodateien gespeichert und sofort abgespielt.

  • Fehlende erzeugen: erfasst alle sichtbaren Inhalte und erzeugt nur fehlende Dateien.
  • Neue Generation: erstellt den Cache für die aktuelle Sprache/Stimme neu (z. B. nach einem Stimmenwechsel).
  • Aufräumen: löscht veraltete Generationen sofort.