Policy vor der Inferenz. Evidence danach.
Legen Sie organisationsbezogenes Routing und optionale Budgets fest und prüfen Sie, was genutzt und was geändert wurde. Dieselben Regeln gelten für jede Anfrage, unabhängig vom Konsumenten.
D×E-Routing-Richtlinie
Legen Sie Datensensibilitäts-Standards (D-Klasse) für Nachrichten und Dateien fest, weisen Sie Anbieter-Umgebungsklassen (E-Klasse) zu und blockieren Sie inkompatible Anfragen vor der Inferenz.
Data-Routing entdecken →Budgets
Begrenzen Sie optional Ausgaben pro Mitglied oder API-Schlüssel und pro Anbieter. Nutzung bleibt unbegrenzt, bis Sie diese Obergrenzen setzen. Steinkauz AI enthält kein Inferenz-Guthaben.
Budgets entdecken →Nutzungs- und Audit-Sichtbarkeit
Prüfen Sie Inferenz-Aktivität über alle Konsumenten, sehen Sie sich Konfigurations-Audits für Richtlinien- und Anbieteränderungen an und verfolgen Sie administrative Aktionen.
Audit-Sichtbarkeit entdecken →Routing
Data-Routing-Richtlinie
Wählen Sie, welche Anbieter-Umgebungsklassen welche Datensensibilitätsstufe verarbeiten dürfen. Inkompatible Chat- und API-Anfragen werden vor der Inferenz blockiert.
Interaktive Demo. Es werden keine Daten gespeichert.
Datensensibilitäts-Standards
Nachrichten- und Datei-Sensibilität können getrennt konfiguriert werden. Enthält eine Anfrage eine Datei, nutzt Steinkauz AI die strengere effektive Sensibilität.
Standard-Sensibilität für Nachrichteninhalte im Chat, bevor das Routing geprüft wird.
Vorausgewählte Sensibilität für hochgeladene Dateien. Anhänge können die effektive Sensibilität über den Nachrichten-Standard anheben.
Anbieter
Jeder Anbieter hat eine Anbieter-Umgebungsklasse (E-Klasse). Wählen Sie einen, um eine Anfrage zu simulieren.
Anfrage simulieren
Wählen Sie, ob die Anfrage einen Dateianhang enthält, um zu sehen, wie die effektive Sensibilität berechnet wird.
Effektive Sensibilität: D0: Öffentlich
D×E-Routing-Matrix
Konfigurieren Sie, welche Anbieter-Umgebungsklassen welche Datensensibilitätsstufe verarbeiten dürfen. Zellen umschalten, um Kombinationen zu erlauben oder zu blockieren.
| Datensensibilität | E0E0: Nicht klassifiziert | E1E1: Öffentlich verwaltet | E2E2: Enterprise verwaltet | E3E3: Private Cloud | E4E4: Kundengehostet | E5E5: On-Premise |
|---|---|---|---|---|---|---|
| D0D0: Öffentlich | ||||||
| D1D1: Intern | ||||||
| D2D2: Vertraulich | ||||||
| D3D3: Eingeschränkt | ||||||
| D4D4: Kritisch |
Chat und API teilen diese Matrix. API-Schlüssel haben zusätzlich eine Datensensibilitäts-Vorgabe und eine Mindest-Anbieterumgebung. Eine Anfrage darf die Sensibilität anheben, nicht die Untergrenze des Schlüssels senken.
Budgets
Optionale Obergrenzen, kein enthaltenes Guthaben
Begrenzen Sie Kosten und/oder Tokens pro Mitglied oder dediziertem API-Schlüssel, pro Anbieter. Leer bedeutet unbegrenzt. Verbleibend 0 blockiert weitere Anfragen auf diesem Anbieter.
- Caps sind optional und gelten pro Mitglied oder dediziertem API-Schlüssel × Anbieter, nicht als ein einziges globales Limit und nicht als enthaltene Inferenz
- Kosten- und Token-Obergrenzen können unabhängig gesetzt werden; ein leeres Feld bleibt auf dieser Spur unbegrenzt
- Vererbte Schlüssel folgen dem Mitglieder-Budget der erstellenden Person; dedizierte Schlüssel haben eigene Obergrenzen
- Bestehende Tools, eigene Software und der integrierte Chat teilen dieselben Regeln. Caps setzen sich jeden UTC-Kalendermonat zurück
Optionale Obergrenzen pro Mitglied oder dediziertem API-Schlüssel, pro Anbieter. Leere Felder bleiben unbegrenzt. Verbleibend 0 blockiert weitere Anfragen auf diesem Anbieter.
Anthropic
Maya Chen
Mitglied
Tom Weber
Mitglied
Unbegrenzt
billing-bot
Dedizierter API-Schlüssel
Azure OpenAI
Maya Chen
Mitglied
Unbegrenzt
Unbegrenzt
Nur Vorschau. Owner und Admins konfigurieren Live-Budgets in der App unter Einstellungen → Budgets. Caps setzen sich jeden UTC-Kalendermonat zurück.
Audit
Sichtbarkeit und Audit
Zwei ergänzende Oberflächen: KI-Inferenz-Aktivität und Konfigurationsänderungen.
Schnelle Metadaten zeigen Anbieter, Modell, Tokens, Antwortzeit und Kosten für diese Antwort.
Transparenz pro Nachricht
Sehen Sie, welches Modell genutzt wurde, was es gekostet hat, und prüfen Sie Metadaten jeder Antwort. Die vollständige Spur finden Sie in der durchsuchbaren Aktivitätshistorie.
Klicken Sie auf das Info-Symbol für schnelle Metadaten einer Antwort.
KI-Inferenz-Aktivität
- Metadaten pro Nachricht im Chat: Anbieter, Modell, Tokens, Kosten, Latenz und schneller Routing-Kontext
- Eigene Aktivitätsseite für durchsuchbare Anfragen über Chat und API mit API-Schlüssel-Zuordnung
- Schritt-Drill-down in Modellaufrufe, Timing, Kosten und exportierbare Historie
- Einheitliche Nutzungs- und Kostensichtbarkeit für Abgleich und Prüfung
Jede Inferenz-Anfrage, ob Chat oder API, erscheint in einem durchsuchbaren Aktivitätsprotokoll mit Drill-down-Details.
pde_8f2a…c91dSchnelle Metadaten sind pro Nachricht im Chat verfügbar. Öffnen Sie Einstellungen → Nutzung für die vollständige Aktivitätsseite mit Filtern, Export und Schritt-Drill-down.
Filtern Sie nach Quelle, Modell, API-Schlüssel oder Routing-Klasse. Prüfen Sie Modellschritte, Timing, Kosten und die Policy-Entscheidung der Anfrage.
Jede relevante Richtlinien- oder Anbieteränderung hinterlässt eine Spur zur Prüfung.
D3: Eingeschränkt → E1: Öffentlich verwaltet nach Matrix-Update blockiert.
Standard-Dateisensibilität von D1: Intern auf D2: Vertraulich geändert.
Optionale Kostenobergrenze für Alex auf Azure OpenAI gesetzt.
Azure-OpenAI-Anbieter-Umgebungsklasse auf E3: Private Cloud aktualisiert.
Routing-, Anbieter-, Budget- und Mitgliedschafts-Audit-Protokolle sind in den Organisations-Einstellungen verfügbar.
Konfigurations-Audit
- Routing-Richtlinien-Audit für Matrix-Änderungen, blockierte Routing-Versuche und Sensibilitäts-Herabstufungen mit Begründung
- Budget-Audit für Cap-Änderungen an Mitgliedern und API-Schlüsseln
- Anbieter-Audit für Erstellung, Updates, Löschung und Umgebungsklassen-Änderungen
- Administratives Audit für mitgliedschafts- und abrechnungsrelevante Organisations-Änderungen
KI steuern, ohne Agilität zu verlieren
Setzen Sie Policy einmal. Wenden Sie sie auf die Werkzeuge an, die Sie bereits nutzen, auf die Software, die Sie bauen, und auf den enthaltenen Chat.