Sicherheit und Compliance

Er erinnert sich. Und seine Zuverlässigkeit wird gemessen.

Ein Easycore-Agent erinnert sich von einer Sitzung zur nächsten an Ihre Arbeit. Alle sechs Stunden wird sein Verhalten von Code bewertet, nie vom Agenten selbst. Hier beides im Detail.

Das Gedächtnis, in drei Schritten.

Aus rohen Sitzungen wird geordnetes Wissen: behalten, konsolidiert und im richtigen Moment wiedergefunden.

  1. Behalten

    Am Ende jeder Sitzung werden die nützlichen Fakten extrahiert: Präferenzen, Entscheidungen, Kontext. Stündlich werden die rohen Sitzungen durch reines Parsen zusammengefasst, ohne Modellaufruf. Zweimal täglich verfasst der Agent eine strukturierte Reflexion über seine Arbeitsweise.

  2. Konsolidieren

    Zweimal täglich werden die jüngsten Gespräche verdichtet: Dubletten entfernt, Widersprüche aufgelöst. In Ruhephasen werden ähnliche Erinnerungen zusammengeführt und veraltete archiviert. Alle drei Stunden wird das Referenzgedächtnis mit einer freigegebenen Fassung abgeglichen; jede Abweichung wird korrigiert.

  3. Wiederfinden

    Bei jeder Nachricht werden vier Indizes parallel abgefragt: eine hybride Suche nach Stichwort und Bedeutung, ein Faktengedächtnis, ein datierter Wissensgraph, in dem ein überholter Fakt als ungültig markiert statt gelöscht wird, und ein semantischer Ersatzindex. Lange Sitzungen werden auf drei Ebenen verdichtet, damit der rote Faden nie verloren geht.

Jede Erinnerung wird eingeordnet, bevor sie in den Kontext gelangt.

Jede infrage kommende Erinnerung wird eingeordnet, bevor sie in den Kontext gelangt: Übereinstimmung der vier Quellen, Nähe zur Frage, Aktualität und Verlässlichkeit ihrer Herkunft.

Gelesen wird lokal.

Die vier Quellen werden auf der Maschine des Kunden zusammengeführt: Deduplizierung, Sortierung nach Score, begrenzter Umfang. Kein Drittmodell liest Ihre Erinnerungen, um sie wiederzufinden.

Er lernt auch Verfahren.

Wenn eine Arbeitsfolge gelingt, kann der Agent sie als Fähigkeit niederschreiben: wann sie anzuwenden ist, Vorgehen, Fallstricke, Prüfung. Ein Validator prüft das Format und blockiert Dubletten; der Inhalt wird erst geladen, wenn er gebraucht wird.

Ihr Gedächtnis gehört Ihnen: pro Kunde isoliert, bei Vertragsende zurückgegeben (Reversibilität nach DORA).

Der Vertrauensscore, samt Methode.

Der Score beruht nicht auf dem, was der Agent über sich selbst sagt. Er wird von Code aus seinen tatsächlichen Sitzungen berechnet. Anschließend ergänzt ihn der vom Agenten getrennte Vertrauensdienst von Easycore um die Integrität der Audit-Kette.

Screenshot aus dem Easycore-Cockpit: Radar der acht überwachten Dimensionen eines Agenten, jeweils auf 100 bewertet, mit der Zahl der Beobachtungen
Echter Screenshot aus dem Cockpit (Oberfläche auf Englisch): acht Dimensionen, jeweils auf 100 bewertet, mit der Zahl der Beobachtungen (n). Eine Dimension ohne Signal wird nicht angezeigt.
Die acht Dimensionen und ihre Koeffizienten
DimensionWas sie misstKoeffizient
Erhöhen den Score
AbschlussquoteAnteil der Sitzungen, die ohne Abbruch und ohne übermäßige Fehler abgeschlossen werden (mehr als 30 % fehlerhafte Tool-Aufrufe).0,30
Zuverlässigkeit geplanter AufgabenAnteil der geplanten Aufgaben, die ohne übermäßige Fehler laufen.0,20
KonsistenzGleichmäßigkeit der Zahl der Tool-Aufrufe von Sitzung zu Sitzung, bei gleicher Art von Arbeit.0,15
Als Risiken gemessen: senken den Score
FehlerbeherrschungAnteil der abgebrochenen oder fehlerlastigen Sitzungen.0,15
StabilitätSchwankung der Sitzungsdauer, bei gleicher Art von Arbeit.0,08
Resistenz gegen Tool-AnomalienAbweichung der verwendeten Tools vom üblichen Profil des Agenten.0,07
Stabilität der AntwortzeitAnstieg der medianen Antwortzeit zwischen der ersten und der zweiten Hälfte des Zeitraums.0,05
Vom Vertrauensdienst ergänzt
Integrität der Audit-KetteKontinuität der Kette: Jedes versiegelte Ereignis ist korrekt mit dem vorherigen verknüpft.0,10

Die Berechnung.

  1. Alle sechs Stunden werden die Sitzungen der letzten 24 Stunden und der letzten 7 Tage ausgewertet. Jede Dimension ist eine Zahl zwischen 0 und 1.

  2. Score des Agenten, begrenzt auf 0 bis 1:

    (0,30 × Abschluss + 0,20 × geplante Aufgaben + 0,15 × Konsistenz) / 0,65 − (0,15 × Fehler + 0,08 × Volatilität + 0,07 × Tool-Anomalien + 0,05 × Antwortzeit-Drift) / 0,35

  3. Endgültiger Score, vom Vertrauensdienst ergänzt:

    0,90 × Score des Agenten + 0,10 × Integrität der Audit-Kette

    Ohne versiegeltes Ereignis im Zeitraum wird der Score des Agenten unverändert übernommen.

  4. Das Cockpit zeigt den Score auf 100 und seinen Verlauf. Risiken erscheinen dort in positiver Richtung: 100 minus das gemessene Risiko.

Sehen Sie Gedächtnis und Score an Ihren eigenen Fällen.