Fähigkeiten
Was die OmniGENIE-Technologiebasis heute kann — gekennzeichnet je Fähigkeit
Diese Seite listet die Fähigkeiten der GENIE-Technologie auf, auf der OmniGENIE basiert. Jede Zeile trägt ein Statuslabel. Verfügbar bedeutet, dass die Fähigkeit heute in der produktiven GENIE-Plattform aktiv ist; es bedeutet nicht, dass eine OmniOmni-Integration existiert. Siehe die Legende unter Zweck & Nutzen.
Vorgangsgedächtnis
| Fähigkeit | Beschreibung | Status |
|---|---|---|
| Faktenextraktion | Typisierte Fakten (Persona, episodisch, Anweisung, Wert, offene Frage, abgeleitete Überzeugung) werden aus Gesprächsbeiträgen extrahiert und mit ihrem Quellbeitrag verknüpft. | Verfügbar |
| Revisionshistorie | Fakten werden nie an Ort und Stelle überschrieben. Eine Korrektur erzeugt einen neuen Fakt und markiert den vorherigen als abgelöst, sodass die Informationsgrundlage einer vergangenen Aktion rekonstruiert werden kann. | Verfügbar |
| Sensibilitätsbezogener Abruf | Als sensibel gekennzeichnete Fakten (zum Beispiel Gesundheits- oder Geschäftsgeheimnisse) erfordern eine höhere Relevanzschwelle, bevor sie in einem Gespräch angezeigt werden. | Verfügbar |
| Gedächtnisgraph | Ein visueller Graph des eigenen gespeicherten Gedächtnisses eines Nutzers wird asynchron nach jeder Sitzung erzeugt. Es handelt sich um eine abgeleitete Ansicht, nicht um eine Quelle der Wahrheit. | Verfügbar |
| Korrektur und Löschung einzelner Fakten | Ein bestimmter Gedächtniseintrag kann per Sprache oder in der Benutzeroberfläche korrigiert oder gelöscht werden, mit einer kurzen Karenzzeit zum Rückgängigmachen. | Verfügbar |
| Vollständige Kontolöschung | Die Löschung entfernt personenbezogene Daten über das gesamte Datenmodell hinweg in einer Transaktion. Ein automatisierter Test stellt sicher, dass jede nutzerbezogene Tabelle abgedeckt ist. Ein gehashter Tombstone verhindert eine versehentliche Neuanlage. | Verfügbar |
| Reflexionsdurchlauf | Ein optionaler Hintergrunddurchlauf kann übergeordnete Muster aus gespeicherten Fakten sichtbar machen. | Implementiert, nicht aktiviert |
Details, einschließlich Herkunft, Sensibilitätsstufen, Löschung und Aufbewahrung, finden Sie unter Gedächtnis & Daten-Lebenszyklus.
Sprache, Telefonie und Text
| Fähigkeit | Beschreibung | Status |
|---|---|---|
| Echtzeit-Sprachinteraktion | Verzögerungsarmes Gespräch über WebRTC mit natürlicher Unterbrechung (Barge-in). Wenn ein Nutzer unterbricht, wird nur das tatsächlich Gehörte im Gedächtnis behalten. | Verfügbar |
| Telefonie | Ein- und ausgehende Anrufe und SMS über einen SIP-Trunk, mit mandantenbezogener Zuordnung von Telefonnummern. | Verfügbar |
| Kaskaden- und Speech-to-Speech-Pipelines | Speech-to-Text, Sprachmodell und Text-to-Speech laufen standardmäßig als Kaskade; ein alternativer, verzögerungsarmer Speech-to-Speech-Modus ist verfügbar. | Verfügbar |
| Automatischer Sprach-Anbieter-Fallback | Fällt der primäre Text-to-Speech-Anbieter aus, wechselt das System für diesen Gesprächsbeitrag zu einem sekundären Anbieter. Für das Sprachmodell gibt es keinen entsprechenden automatischen Fallback. | Verfügbar |
| Strukturierte Anrufartefakte | Anrufe erzeugen strukturierte Notizen und Folgeaufgaben, die über den Anruf hinaus bestehen bleiben. Vollständige Sitzungsprotokolle oder Entscheidungszusammenfassungen werden heute nicht erstellt. | Verfügbar |
| Spracherkennung registrierter Personen | Opt-in-Erkennung registrierter Sprecher mit expliziter Einwilligungserfassung und Widerruf. | Implementiert, nicht aktiviert |
| Meeting-Begleiter | Ein Echtzeit-Assistent für Besprechungen mit mehreren Sprechern. Ein Architekturentwurf existiert; die Fähigkeit ist nicht gebaut. | Roadmap |
Tools, Koordination und Freigaben
| Fähigkeit | Beschreibung | Status |
|---|---|---|
| Tool-Aufruf mit Sensibilitätsstufen | Jedes dem Assistenten zur Verfügung stehende Tool ist mit einer Sensibilitätsstufe (niedrig, mittel, hoch) gekennzeichnet, die steuert, wie und wann es aufgerufen werden kann. | Verfügbar |
| Tool-Aufruf-Protokollierung | Tool-Aufrufe werden mit einem kryptografischen Digest ihrer Argumente und einem Ergebnisstatus protokolliert. Rohargumente werden nicht im Protokoll gespeichert. | Verfügbar |
| Web-Recherche mit Quellenangaben | Ein optionales Recherche-Tool ruft externe Quellen ab und zitiert sie, wenn ein Suchanbieter konfiguriert ist. | Implementiert, nicht aktiviert |
| Abgestuftes Agent-Routing | Ein an die Agent-to-Agent-Spezifikation der Linux Foundation angelehntes Routing-Design liefert für eine Anfrage eines von fünf Ergebnissen: automatisch zulassen, mit Zusammenfassung zulassen, Freigabe erforderlich, blockieren oder an einen Menschen eskalieren. | Implementiert, nicht aktiviert |
| Delegationsmodell | Eine strukturierte Gewährung (Gewährender, Geltungsbereich, erlaubte und verbotene Aktionen, Freigabemodus, Ablauf, Widerruf), angelehnt an die Standards OAuth Token Exchange und Rich Authorization Requests. Derzeit beschränkt auf den Fall, dass der Assistent einer Person für eine andere handelt. | Implementiert, nicht aktiviert |
| Einmal-Freigabetoken | Ein kurzlebiges, kryptografisch gebundenes Freigabetoken (inspiriert von OpenID CIBA) für bestimmte Änderungsabläufe. Es ist heute kein allgemeines Freigabetor für Finanztransaktionen. | Implementiert, nicht aktiviert |
| Workspace-Integration | Verbindung zu einem Google-Workspace-Konto eines Nutzers (E-Mail-Entwürfe, Kalender, Dateien) mit Tokens, die darauf ausgelegt sind, verschlüsselt gespeichert zu werden. | Verfügbar |
| Gruppen- und Gastmodus | Eine optionale Gruppenfunktion für gemeinsam genutzte Artefakte ohne Teilen des privaten Gedächtnisses; ein Gastmodus ohne dauerhaftes Gedächtnis. | Implementiert, nicht aktiviert |
In Entwicklung für OmniGENIE
Die folgenden Fähigkeiten sind Teil des OmniGENIE-Zieldesigns. Sie existieren heute nicht im Code.
| Fähigkeit | Beschreibung | Status |
|---|---|---|
| Aktionsstufen für Finanzoperationen | Beobachten, Entwerfen, Empfehlen, Ausführen mit Freigabe; vollständig autonome Ausführung ist für Finanzmarktaktionen deaktiviert. | In Entwicklung |
| Mandantentrennung auf Institutsebene | Isolation auf Organisationsebene, zusätzlich zur heutigen nutzerbezogenen Abgrenzung. | In Entwicklung |
| Enterprise-Identitätsföderation | Anmeldung über den Identitätsanbieter des Instituts (OpenID Connect oder SAML) anstelle von Consumer-OAuth. | In Entwicklung |
| Freigabe über OmniPersona | Anfordern und Signieren von Freigaben für von OmniGENIE vorbereitete Aktionen über den bestehenden Proof-of-Action-Ablauf. | In Entwicklung |
| Legal Hold | Eine Aufbewahrungssperre, die Löschung blockiert, wo gesetzliche Aufbewahrungspflichten gelten. | In Entwicklung |
| Automatischer Circuit Breaker | Automatischer Wechsel in den Nur-Lese-Modus bei anomalen Fehlerraten oder Tool-Aufrufmustern. | In Entwicklung |
Vom persönlichen Assistenten zur institutionellen Schicht
GENIE wurde als persönlicher, deutschsprachiger Assistent gebaut. Die Tabelle zeigt, wie sich seine Konzepte in institutionelle Begriffe übersetzen lassen und welche Übersetzungen durch eine bestehende Fähigkeit gestützt werden.
| Persönliches Konzept | Institutionelle Lesart | Gestützt durch |
|---|---|---|
| Zweites Gedächtnis | Richtliniengesteuertes, zweckgebundenes Vorgangsgedächtnis | Faktenextraktion, Revisionshistorie, sensibilitätsbezogener Abruf (Verfügbar) |
| „Kennt Sie" | Autorisierter, zweckgebundener Kontext je Konto | Nutzerbezogene Datenabgrenzung (Verfügbar); Mandantentrennung auf Institutsebene (In Entwicklung) |
| Telefonassistent | Offengelegter Sprachinteraktionsagent mit Regeln, Übergabe und Aufzeichnungen | Telefonie, strukturierte Anrufartefakte (Verfügbar) |
| Persönliche Loyalität | Betrieb ausgerichtet auf den beauftragenden Prinzipal unter einer expliziten Gewährung | Delegationsmodell, abgestuftes Routing (Implementiert, nicht aktiviert) |
| Agent-zu-Agent | Kontrollierte Koordination zwischen Agenten mit Identität, Berechtigung und überprüfbarer Übergabe | Abgestuftes Routing (Implementiert, nicht aktiviert); OmniOmni-Aktionsstufen (In Entwicklung) |
Auf dieser Seite werden keine Leistungskennzahlen, Genauigkeitsraten, Kapazitätsgrenzen oder Latenzwerte veröffentlicht. Solche Werte werden je Deployment gemeinsam mit dem Institut festgelegt und gemessen.