Gedächtnis & Daten-Lebenszyklus
Herkunft, Revisionshistorie, Sensibilität, Korrektur, Löschung und Aufbewahrung des Vorgangsgedächtnisses
Das Vorgangsgedächtnis ist der Kern von OmniGENIE. Diese Seite beschreibt den Lebenszyklus eines Gedächtniselements von der Erfassung bis zur Löschung. Die Mechanismen der GENIE-Plattform sind mit Verfügbar gekennzeichnet; institutionelle Governance-Ergänzungen sind mit In Entwicklung gekennzeichnet.
Gedächtnismodell
| Schicht | Inhalt | Status |
|---|---|---|
| Gesprächsbeiträge | Die rohen Beiträge einer Sitzung, kontobezogen abgegrenzt. | Verfügbar |
| Typisierte Fakten | Aus Beiträgen extrahierte Fakten mit einem Typ (Persona, episodisch, Anweisung, Wert, offene Frage, abgeleitete Überzeugung), einer Verknüpfung zum Quellbeitrag, einer optionalen realweltlichen Ereigniszeit und einer Sensibilitätskennzeichnung. | Verfügbar |
| Revisionskette | Ein korrigierter Fakt wird nicht an Ort und Stelle bearbeitet. Ein neuer Fakt wird geschrieben, und der vorherige wird mit einem Zeitstempel als abgelöst markiert, sodass sowohl der alte als auch der neue Zustand rekonstruierbar bleiben. | Verfügbar |
| Abgeleiteter Graph | Ein asynchron projizierter Wissensgraph zur visuellen Erkundung. Abgeleitet, verwerfbar, nie eine Quelle der Wahrheit. | Verfügbar |
| Strukturierte Anrufartefakte | Notizen und Folgeaufgaben aus Anrufen. | Verfügbar |
Die Revisionskette folgt einem Invalidate-and-Supersede-Muster. Sie ist keine vollständige bitemporale Datenbank mit unabhängigen Abfragen von Gültigkeits- und Transaktionszeit. Öffentliche Beschreibungen verwenden daher den Begriff revisionsverfolgtes Gedächtnis.
Phasen des Lebenszyklus
Erfassung
Beiträge werden kontobezogen gespeichert. Unterbrochene Sprachbeiträge behalten nur das tatsächlich Gehörte.
Extraktion
Nach einer Sitzung werden Fakten asynchron extrahiert, typisiert, mit ihrem Quellbeitrag verknüpft und mit einer Sensibilitätsstufe versehen. Die Extraktion ist derzeit für deutschsprachige Gespräche optimiert.
Abruf
Während eines Gesprächs werden relevante Fakten angezeigt. Als sensibel gekennzeichnete Fakten erfordern eine höhere Relevanzschwelle. Schwellenwerte sind heute Systemkonstanten; eine institutsspezifische Konfiguration ist in Entwicklung.
Korrektur
Ein Nutzer kann einen Fakt per Sprache oder in der Oberfläche korrigieren. Die Korrektur erzeugt eine neue Revision und markiert den vorherigen Fakt als abgelöst.
Löschung einzelner Elemente
Ein bestimmter Fakt kann gelöscht werden, mit einer kurzen Karenzzeit, in der die Löschung rückgängig gemacht werden kann. Nach der Karenzzeit wird das Element endgültig entfernt, und der Audit-Datensatz enthält den wörtlichen Inhalt nicht mehr.
Vollständige Löschung
Eine Kontolöschung entfernt personenbezogene Daten über das gesamte Datenmodell hinweg in einer Transaktion. Ein automatisierter Test stellt sicher, dass jede kontobezogene Tabelle Teil des Löschinventars ist. Ein gehashter Tombstone der Kontokennung verhindert für einen begrenzten Zeitraum eine versehentliche Neuanlage.
Governance-Kontrollen
| Kontrolle | Beschreibung | Status |
|---|---|---|
| Zweckbindung | Das Gedächtnis wird für den Vorgangszweck des Assistenten innerhalb des Kontos genutzt. Institutsdefinierte Zwecke je Gedächtnisklasse. | Verfügbar / In Entwicklung |
| Herkunft | Jeder extrahierte Fakt verknüpft sich mit seinem Quellbeitrag. Die Herkunft für Fakten, die aus OmniOmni-Komponentendaten abgeleitet werden, ist Teil des Integrationsdesigns. | Verfügbar / In Entwicklung |
| Zugriff | Kontobezogene Abgrenzung. Rollenbasierter Zugriff auf gemeinsam genutztes institutionelles Gedächtnis. | Verfügbar / In Entwicklung |
| Aufbewahrung | Heute existiert kein automatischer Aufbewahrungsplan. Aufbewahrungsklassen mit gesetzlichen Mindest- und Höchstfristen je Gedächtnisklasse. | In Entwicklung |
| Legal Hold | Eine Sperre, die Löschung blockiert, wo gesetzliche Aufbewahrungspflichten gelten, und gesperrte Elemente von der Inferenz ausschließt, während sie in einem isolierten Archiv aufbewahrt werden. | In Entwicklung |
| Export | Strukturierter Export des Gedächtnisses eines Kontos für Auskunftsersuchen betroffener Personen oder institutionelle Prüfung. | In Entwicklung |
| Modelltraining | Gesprächsinhalte werden für die Inferenz genutzt, nicht für das Training von Foundation-Modellen durch OmniGENIE. Vertragliche Zusicherungen mit Modellanbietern sind Teil der Drittparteibewertung des Instituts. | Verfügbar |
Datenflüsse
Gesprächsinhalte verlassen zwangsläufig die Laufzeitumgebung des Assistenten zur Inferenz. Die aktuelle Plattform ist mit den folgenden Anbieterklassen konfiguriert; die konkreten Anbieter und deren vertragliche Datenverarbeitung sind Teil der Drittparteirisikobewertung des Instituts.
| Funktion | Anbieterklasse | Hinweis |
|---|---|---|
| Sprachmodell | Cloud-Modellanbieter über ein Gateway mit Modell-Allowlist | Heute ist eine Modellfamilie konfiguriert. |
| Speech-to-Text | Cloud-Anbieter | Einzelner Anbieter. |
| Text-to-Speech | Cloud-Anbieter mit automatischem Fallback zu einem zweiten Anbieter | |
| Sprachtransport | Medienserver, selbst gehostet oder verwaltet | |
| Telefonie | SIP-Trunk-Anbieter | |
| Datenspeicher | Selbst gehostetes PostgreSQL und Redis | Der Standort folgt der Infrastruktur des Betreibers. |
Auf dieser Seite wird keine Garantie zum Datenstandort abgegeben. Die Region-Festlegung für Modell-, Sprach- und Telefonieanbieter ist eine Konfigurations- und Vertragsfrage, die je Deployment gemeinsam mit dem Institut geklärt wird.
DSGVO-Orientierung
- Personenbezogene Daten im Vorgangsgedächtnis werden nur für den definierten Vorgangszweck verarbeitet.
- Korrektur und Löschung werden auf Ebene einzelner Fakten sowie des gesamten Kontos unterstützt.
- Löschanfragen unterliegen gesetzlichen Aufbewahrungspflichten, die gegebenenfalls Vorrang haben; der Legal-Hold-Mechanismus zur technischen Durchsetzung ist in Entwicklung.
- Wo OmniGENIE mit natürlichen Personen per Sprache oder Text interagiert, ist es darauf ausgelegt offenzulegen, dass sie mit einem KI-System interagieren.
Diese Orientierung stellt keine Rechtsberatung dar. Datenschutzbewertungen, einschließlich einer etwaigen Datenschutz-Folgenabschätzung für die Spracherkennung registrierter Personen, werden vom einsetzenden Institut durchgeführt.