D-CAT Group ↗ Kontakt ENTRDEESAZ
4-Wochen-Pilot starten

Vertrauensmodell

Jede Zahl hat eine Adresse.

Eine Zahl ohne Adresse erreicht den Bildschirm nicht. Das Vertrauensmodell verlässt sich nicht auf Prompting, und es geht nicht davon aus, dass Fehler abnehmen, wenn Modelle besser werden. Es verlässt sich auf eine deterministische Kontrollkette zwischen der Zahl und dem Satz — und darauf, festzuhalten, was diese Kette abgelehnt hat.

Nachvollziehbarkeit

Läuft eine Abfrage, wird ihr Ergebnis in einen Umschlag versiegelt. Jeder Wert darin erhält eine Adresse.

Welcher Umschlag, welche Zeile, welche Zelle — und am Ende eine Prüfziffer, damit nicht versehentlich die falsche Tür geöffnet wird. Nutzt der Agent eine Zahl, gibt er diese Adresse an. Die Engine schlägt sie nach und vergleicht. Selbst ein Prozentwert wird nie dem Modell überlassen: Es kann nicht „dividiere“ sagen, es fragt die Engine nach dem Verhältnis.

Der Aufbau einer Nachweisadresse Die Adresse e1.r1.v.1u besteht aus vier Teilen: e1 bezeichnet den versiegelten Umschlag eines Abfrageergebnisses, r1 die Zeile darin, v.1 die Zelle in dieser Zeile, und das abschließende u ist eine Prüfziffer, die überprüft wird, bevor die Adresse aufgelöst wird. e1.r1.v.1u e1 Umschlag Das versiegelte Ergebnis einer Abfrage. r1 Zeile Welche Zeile dieses Ergebnisses. v.1 Zelle Welcher Wert in der Zeile. u Prüfziffer Geprüft, bevor die Adresse aufgelöst wird.
Der Agent deklariert eine Adresse. Die Engine löst sie auf. Keine Stufe in diesem Diagramm ist eine, in der das Modell steckt — und genau darum geht es.

Vier Schritte, in dieser Reihenfolge, jedes Mal

  1. Die angegebene Adresse wird zerlegt — Umschlag, Zeile, Zelle.
  2. Die Prüfziffer wird verifiziert. Schlägt sie fehl, wird gar nicht erst aufgelöst.
  3. Der Umschlag wird geöffnet und der tatsächliche Wert in der Zelle gelesen.
  4. Die Zahl, die der Agent geschrieben hat, und der gelesene Wert werden verglichen.

Gemessene Trefferquote gegen versehentliches Auflösen auf eine Nachbarzelle: 97,63 % mit einer Prüfziffer, 100 % mit zweien · interne Messung. FinalGuard-Vergleich ≈ 2 ms · Demomessung.

Grenze

Die Adresse reicht bis zum Abfrageschritt — welche Abfrage, welcher Zeitraum, welche Filter — nicht bis zur einzelnen Warehouse-Zeile. Wir schreiben das lieber hier hin, als dass Sie es in Woche drei eines Piloten entdecken.

Trust-Stufen

A freigegebene offizielle Kennzahl · B abgeleitet · C explorativ oder Kandidat. Ein Wert der Stufe C kann nicht roh in einen Brief gelangen, und die Hochstufung auf A ist eine menschliche Entscheidung.

Ein einzelnes Abzeichen mit einem „Konfidenzwert“ gibt es bewusst nicht.

FinalGuard

Das letzte Gate vor der Auslieferung. Keine KI. Nicht abschaltbar.

Null Toleranz: Ein Cent daneben wird abgelehnt, und eine Antwort, die vor dem Lauf einer Abfrage geschrieben wurde, wird abgelehnt, selbst wenn die Zahl zufällig stimmt.

Der Agent schrieb…WarumUrteil
den exakten Wert aus dem Umschlagidentischbesteht
eine übliche Rundung davonRundungsregeln sind ausdrücklich festgelegtbesteht
eine Differenz, die die Engine berechnet hattesie steht im Umschlagbesteht
einen Wert, der um eine Einheit abweichtweder identisch noch eine gültige Rundungabgelehnt
eine Summe, die der Agent selbst gebildet hatder Agent rechnet nichtabgelehnt
„über neun Regionen hinweg“ ohne Nachweisklein oder nicht, unbewiesen ist unbewiesenabgelehnt

Die Ablehnungsleiter

  1. Erste Ablehnung → die Antwort wird zurückgehalten; dem Agenten wird gesagt, die Werte aus dem Umschlag wortgetreu zu verwenden.
  2. Zweite Ablehnung → gibt es genau einen eindeutigen Umschlag, schreibt die Engine die Antwort selbst.
  3. Dritte Ablehnung → ehrlicher Abbruch.

Einbehaltene Werte

Eine Zahl ohne Nachweis wird aus dem Text entfernt und mit ihrer Begründung in einem Kasten unter der Antwort protokolliert. Sie ist strukturell von Export, Weitergabe und Gedächtnis ausgeschlossen. Wurde eine Korrektur vorgenommen, erscheint unter der Antwort ein Hinweis — nie versteckt.

Gemessen. Über unsere eigene Betriebsaufzeichnung hinweg hat die Herkunftsprüfung 282 Antwortentwürfe über 275 Läufe gestoppt; der Agent korrigierte 87,2 % im nächsten Versuch. Die Prüfseite, die diese Zahl führt, weigert sich, eine Trendlinie hindurchzulegen: Eine steigende Ablehnungsquote bedeutet nicht, dass die Agenten schlechter geworden sind.

Eine bewusste Leerstelle. Es gibt kein Abzeichen „Geprüft ✓“. Gekennzeichnet wird nur das Unprüfbare, damit eine zufällige Übereinstimmung nie einen falschen Stempel verdient.

Was die Gates abgelehnt haben

Mitten im Lauf schickte die Engine einen ganzen Antwortentwurf zurück.

Jeder Anbieter kann Ihnen ein gutes Briefing zeigen. Verlangen Sie zu sehen, was das System zu sagen verweigert hat.

Das ist ein einzelner geplanter Lauf, vollständig geöffnet. Er begann um 05:00 Uhr, war 285 Sekunden später fertig und kostete 78 Cent Modellausgaben, eingefroren zum an diesem Tag geltenden Preis. Dreizehn Kandidaten erreichten die Datenbank. Zwei überstanden die Gates nicht, und ihre Gründe liegen weiterhin vor.

05:00
scheduled start
285 s
total duration
$0.78
model spend, frozen
13
candidates produced
11
published
2
held, with reasons

Geltungsbereich: ein realer geplanter Lauf aus unserer eigenen Betriebsaufzeichnung, Namen maskiert, aus der Datenbank des Produkts gelesen. Kein Kundenbenchmark.

Seine Zahlen hatten keine Adresse, die die Engine auflösen konnte. Das hat sie geschrieben.

Engine · Strukturregel · Herkunft der ZahlenNICHT AUSGELIEFERT
[engine] Structural rule (numeric provenance): every figure in a final answer
is exactly one of three things. ADDRESSED (declared in the claims block with
the ref you read it from), COMPUTED (declared with op and operands that are
addresses), or STRUCTURE the engine or the user put there. Nothing else is
proven. A value that merely EXISTS somewhere in the evidence is not proven
until you name its address.
Ihre Antwort wurde NICHT ausgeliefert.
Die Abschlusszusammenfassung eines gewöhnlichen Laufs in der Konsole, überschrieben mit Operation trace, what this run did. Sie lautet: Der Agent arbeitete 10 Runden und schickte 50 Abfragen an das Warehouse. Ein Antwortversuch wurde zurückgeschickt, weil er Zahlen enthielt, deren Quelle er nicht nennen konnte; dem Agenten wurde das gesagt, und sein nächster Versuch wurde angenommen. Sechs Ausgaben wurden veröffentlicht: drei Findings, drei Recommendations. Kosten 0,79 US-Dollar, 179 Tausend Eingabe- und 15 Tausend Ausgabe-Token, davon 100 Tausend aus dem Cache. Darunter eine in Prosa ausgeschriebene Darstellung der Arbeit des Agenten.
DemodatenDieselbe Abrechnung am Ende eines gewöhnlichen Laufs, am Lauf selbst statt in einem Bericht darüber: wie viele Runden, wie viele Abfragen, was zurückgeschickt wurde und warum, was veröffentlicht wurde und was es gekostet hat, bis hinunter zu den aus dem Cache gelesenen Token.

Über die gesamte Betriebsaufzeichnung wurden elf Kandidatenobjekte zurückgehalten. Neun gehörten zur selben Familie: am schnellsten wachsend, am schwächsten, am höchsten. Die Satzart, die das Gate am häufigsten abfängt, ist genau die Satzart, nach der eine Führungskraft am ehesten handelt.

Geltungsbereich: gesamte Betriebsaufzeichnung, 3 Agenten, 3,5 Wochen, aus der eigenen Datenbank des Produkts gelesen. Kein Kundenbenchmark.

Ein geplanter Lauf und die Unterhaltung, die ihm folgt, von Anfang bis Ende. Demodaten, eine Minute fünfundvierzig, ohne Kommentar: der Lauf-Stream, die beim Start eingefrorenen Einstellungen, was er veröffentlicht und was er zurückgehalten hat, dann ein Finding, das in die Unterhaltung mitgenommen und dort hinterfragt wird.

Im Produkt

Das Nachweisfeld, im Auslieferungszustand

Jede Zahl trägt die Adresse, die der Agent für sie angegeben hat, und das, was die Engine beim Auflösen dieser Adresse vorgefunden hat.

Ein veröffentlichtes Finding mit der Überschrift: Der Bruttoumsatz von Fresh Food ohne Promotion wuchs nur um plus 57,01 Prozent, deutlich unter dem Netzdurchschnitt von 96,97 Prozent. Zwei Zahlen im Fließtext tragen ein Kreuzzeichen, und unter dem Text steht eine Zeile: Aussage des Modells, nicht von der Engine verifiziert. Darunter sagt ein Evidence-Feld, dass jede Zahl darunter die Adresse trägt, die der Agent für sie angegeben hat, dass die Engine diese Adresse aufgelöst hat und dies das Vorgefundene ist. Jede Zeile nennt ihre Kennzahl, ihren Zeitraum und ihren Promotionsstatus, und jede ist entweder als von der Engine berechnet oder als an der Quelle gemessen gekennzeichnet.
DemodatenZwei Werte im Fließtext darüber tragen ein Kreuzzeichen und die Zeile Aussage des Modells — nicht von der Engine verifiziert. Alles andere ist darunter mit der Adresse aufgeführt, aus der es gelesen wurde, und jede Zeile sagt, ob die Engine es an der Quelle gemessen oder berechnet hat — eine Unterscheidung, die die meisten Werkzeuge überhaupt nicht treffen.
Das Nachweisfeld eines Findings zur Warenkorbtiefe unter Promotion, mit einer geöffneten Herleitung. Die Zahl 1,5149 für verkaufte Einheiten je Transaktion wird dargestellt als: Diese Zahl stammt aus 677,526 geteilt durch 447,235, und jeder Operand ist darunter mit eigener Kennzahl, eigenem Zeitraum und eigenem Promotionsstatus aufgeführt.
DemodatenEine abgeleitete Zahl, geöffnet. Sie wird nicht behauptet — sie wird als die Division gezeigt, aus der sie stammt, und jeder Operand trägt seine eigene Adresse, genau wie die gemessenen Zahlen darüber. Nichts hier wurde vom Modell geschrieben.

Vier Fragen

Unternehmensvertrauen ruht auf vier Fragen. Keine davon bleibt der KI überlassen — und jede Antwort nennt ihre Grenze.

Nachvollziehbarkeit — „Woher kam diese Zahl?“

Jede Zahl trägt eine dreiteilige Adresse: Umschlag, Zeile, Zelle. Die Engine vergibt sie; der Agent gibt sie nur an. Jede Aufzeichnung ist mit dem Lauf, dem Agenten, dem eingefrorenen Modell und der Benutzerberechtigung verknüpft, die sie erzeugt haben. Werte werden bei der Erzeugung auf die Aufzeichnung eingefroren, sodass der Nachweis auch dann bestehen bleibt, wenn das Lauf-Log bereinigt wird.

Grenze

Die Adresse reicht bis zum Abfrageschritt — welche Abfrage, welcher Zeitraum, welche Filter — nicht bis zur einzelnen Warehouse-Zeile.

Prüfbarkeit — „Wer, wann, womit, zu welchen Kosten?“

Das Audit-Log ist append-only. Keine Aufzeichnung wird gelöscht, nur archiviert; Bewertungen werden überstempelt. Die Publikationskette ist deterministisch: gleiche Eingabe, gleiches Ergebnis. Jeder verworfene, zurückgehaltene oder doppelte Kandidat steht mit seiner Begründung im Guard Ledger. Grenzen für Schritte, Zeit und Kosten werden vor jedem Lauf eingefroren.

Grenze

Das Audit-Log liegt im Produkt. Der Export in ein SIEM oder ein externes Prüfsystem wird im Piloten gesondert abgegrenzt.

Transparenz — „Was hat das System getan, und was nicht?“

Nichts verschwindet stillschweigend. Ein wiederkehrendes Thema wird ongoing / repeat gestempelt und gezählt, nicht versteckt. Ein leerer Zeitraum fällt in eine eigene Klasse data state. Kausale oder superlative Sprache wird als interpretive gekennzeichnet: Gemessenes wird von Gedeutetem getrennt. Im Chat getroffene Annahmen werden ausgeschrieben.

Grenze

Benachrichtigungstexte tragen bewusst keine Werte. Transparenz liegt in der Aufzeichnung, nicht in der Benachrichtigung.

Erklärbarkeit — „Warum kam es zu diesem Schluss?“

In jedem Finding schreibt die Engine Kennzahl, Zeitraum und Filter. Jede Recommendation öffnet mit einem Klick das Finding, auf dem sie beruht. „Drill down in chat“ nimmt das Finding als zitierte Daten mit in eine Unterhaltung, sodass das „Warum?“ über denselben Nachweis gestellt wird.

Grenze

Das Produkt erklärt, woher die Zahlen im Satz kamen — nicht, warum das Modell den Satz so formuliert hat. Der Schweregrad ist eine Aussage des Agenten. Der Nachweis wird erklärt; das Urteil bleibt menschlich.

Das Audit-Log in der Konsole, mit dem Untertitel: Anmeldeereignisse plus jede Änderung, ein append-only Ledger. Die Spalten lauten Zeit, Ereignis, Akteur, Zusammenfassung und Detail. Sichtbare Zeilen umfassen ein Ereignis narrative_generated mit 1001 Eingabe-Token, 291 Ausgabe-Token und 0,00736 US-Dollar; ein Ereignis scheduler_fire, dessen Akteur System ist, zusammengefasst als geplante Auslösung eingereiht für Agent 18, Lauf 1325; create-Ereignisse, die die Routen nennen, aus denen sie stammen; und Anmeldeereignisse.
DemodatenDas Ledger hinter dem Absatz darüber. Eine geplante Auslösung wird auf System gebucht statt auf eine Person, und ein erzeugter Fließtext trägt seine eigene Token-Zahl und seine Kosten. Zwei Dinge, die es noch nicht tut: Die Detailspalte ist in jeder Zeile leer, und eine über die Oberfläche geänderte Einstellung erzeugt keine eigene Zeile. Beides steht auf der Liste des Produkts, und beides wird hier nicht verschwiegen.

Abwesenheit und Annahme

Das Zweite, das so gefährlich ist wie eine falsche Zahl: eine richtige Zahl, falsch verstanden.

  • Annahmen werden vorab genannt. „Sie haben keinen Zeitraum angegeben; das Gesamtjahr 2024 wurde angenommen.“ Ein fester Satzbaustein, jedes Mal gleich.
  • Aktualität wird gemessen, nie angenommen. „Dieses Modell enthält Daten bis 31. Dez. 2025 — gemessen, nicht geschätzt.“
  • Eine Granularität, die das Modell nicht führt, wird abgelehnt, nicht genähert. „Eine Quartalssicht ist in diesem Modell nicht verfügbar.“ Die Engine baut kein Quartal aus Monaten zusammen, um die Frage zu bedienen.
  • Ein eingeschränkter Nutzer sieht seine eigene Einschränkung. „Geltungsbereich: Filiale — Maltepe Park.“ Die Regel lebt in der Engine; ohne auflösbare Identität hält sie an, statt auf „alles anzeigen“ zurückzufallen.
  • Personenbezogene Daten werden maschinell maskiert. Eine Aufschlüsselungsbezeichnung wird per Regel auf Initialen verkürzt, nicht per Prompt.
  • Abwesenheit wird veröffentlicht, nicht verschluckt. Ein Zeitraum ohne Daten wird zu einem data state mit der Grundlage empty_result_set: „keine gemessene Null; in diesem Fenster sind keine Transaktionen erfasst.“ Kein Schweregrad-Abzeichen, ein eigener Bereich, und keine Recommendation darf darauf beruhen.

Selbstprüfung

„Jede Zahl wird geprüft“ ist eine Behauptung. Also wird sie jede Woche getestet.

Golden Set

Ein versiegelter Fragensatz. Liefern zwei Läufe denselben Fingerabdruck, hat sich das Verhalten nicht geändert. Ändert sich das Modell oder der Code, zeigt sich der Unterschied sofort.

Null-Toleranz-Linie

Zahlen ohne Quelle, die Weigerung zu schätzen, die Maskierung personenbezogener Daten. Auch das Erreichen der Schwelle durch Löschen von Zahlen wird erkannt.

Takt

Die Tests laufen automatisch jede Woche und bei jedem Release-Abschluss. Widerspricht eine Behauptung der Messung, stoppt sich das System selbst.

Ansicht laufender Dienste

Bei jedem Laden gemessen; es zeigt nie einen gespeicherten Status.

Das Vertrauensmodell geht nicht davon aus, dass Fehler abnehmen, wenn Modelle besser werden. Selbst wenn sich das Modell ändert, bleiben Adressierung, Audit-Log, Publikationskette und Berechtigungsprüfungen deterministisch.