System · die Stimme, sie hört und spricht
Larynx
Sprache rein, Sprache raus.
Austauschbare Transkription und Sprachsynthese, damit sich ein Interview wie ein Gespräch anfühlt, nicht wie ein Formular. Lokal oder in der Cloud, für jede Anfrage gewählt.
In aktiver EntwicklungDer Ablauf
- Austauschbare Anbieter für STT und TTS, lokal ↔ Cloud.
- Ein Baustein mit eigenem Lebenszyklus.
- Pro Anfrage von Thalamus gesteuert, nie fest verdrahtet.
Im Zusammenspiel
Legt sich für Lens um Cortex: hört die Frage, spricht die belegte Antwort.
Unter der Haube
Austauschbare Ohren und Stimme, hinter benannten Profilen.
Zwei Teilstrecken, Transkription und Synthese, jede mit einem austauschbaren Anbieter. Ein Profil benennt die ganze Kette, und der Broker wählt pro Anfrage eines aus.
Die Kaskade
Larynx übernimmt die beiden Enden; der Broker setzt die belegte Antwort von Cortex dazwischen. Es gibt auch eine Live-Brücke im Vollduplex, bei der die Engine Cortex als Werkzeug aufruft.
Spracherkennung
Sprachausgabe
Profile · benannte Ketten
Die übrigen Systeme
Dies ist ein Teil eines Systems, das für ein einziges Versprechen gebaut ist: Jede Antwort ist belegt und rechtebewusst, oder sie kommt gar nicht.