KI-Nutzung – Kosten und Nutzer
Anfragen, Token und Kosten nach Tagen, Modellen und Nutzern aufgeschlüsselt. Dazu die letzten Anfragen mit einer Detailansicht für jede einzelne.
Der Bericht Nutzung beantwortet drei Fragen: Wie viele Anfragen, wie viele Token und was hat es gekostet.
Schritt für Schritt
Bericht öffnen und Zeitraum festlegen
- Klappe im Seitenmenü unter der Überschrift Dashboard den Bereich Berichte → KI auf und wähle Nutzung. Dafür brauchst du die Berechtigung für den Bericht KI-Nutzung (Gruppe Report in den Feldberechtigungen).
- Der Bildschirm heißt KI-Nutzungsstatistiken, der Untertitel lautet Überwache Nutzung und Kosten der KI-Integrationen. Das Infosymbol neben dem Titel erklärt genau, was gezählt wird.
- Lege den Datumsbereich fest: Letzte 7 Tage, Letzte 30 Tage (Standard), Letzte 90 Tage, Dieses Jahr oder Benutzerdefiniert. Bei Benutzerdefiniert erscheinen die Felder Von und Bis.
- Schränke die Ergebnisse über die Liste Modell (standardmäßig Alle Modelle) und Kontext (Alle Kontexte) ein.
- Mit Aktualisieren werden die Daten neu berechnet. Der Bericht wird nicht zwischengespeichert und kann daher bei einem langen Zeitraum länger laden. Neben der Schaltfläche siehst du den genauen Zeitraum und die Anzahl der einbezogenen Tage. Alle Diagramme und Tabellen verwenden denselben Zeitraum, dasselbe Modell und denselben Kontext.
Herausfinden, wofür und von wem Geld ausgegeben wird
- Beginne mit den sechs Kacheln oben: Anfragen, Erfolgsquote, Token, Gesamtkosten, Ø Zeit und Fehler. Die Beträge werden in US-Dollar angegeben. Unter den Kosten steht, ob der Anbieter die tatsächliche Gebühr gemeldet hat oder ob der Betrag anhand älterer Daten geschätzt wurde. Die Erfolgsquote wird für abgeschlossene Anfragen berechnet; Fehler enthalten auch Zeitüberschreitungen.
- Die Diagramme Anfragen pro Tag, Token pro Tag und Kosten pro Tag zeigen, ob die Kosten gleichmäßig oder sprunghaft steigen.
- Nutzung nach Modell beantwortet die Frage, ob ein teures Modell Aufgaben erledigt, die ein günstigeres ebenfalls bewältigen könnte. Nutzung nach Kontext zeigt, welche Systemfunktion die Kosten verursacht.
- Kosten pro Nutzer ist eine Tabelle mit den Spalten Nutzer, Anfragen, Erfolge, Fehler, Token, Kosten und Ø Zeit. Ein Nutzer mit unverhältnismäßig hohem Anteil stellt meist viele Fragen hintereinander. Ohne Daten erscheint Keine Nutzungsdaten für Benutzer vorhanden.
- Letzte Anfragen enthält die Spalten Modell, Kontext, Token, Kosten, Zeit, Status und Erstellt. Status und Kontext werden unverändert aus der Datenbank angezeigt, also auf Englisch.
- Das Augensymbol (Details anzeigen) öffnet das Fenster Details der KI-Anfrage mit Modell, Kontext, Antwortzeit und Kosten sowie darunter Eingabe-Token, Ausgabe-Token und Alle Token. Wenn die Inhalte gespeichert wurden, erscheinen zusätzlich die Bereiche System-Prompt, Benutzer-Prompt und KI-Antwort. Andernfalls steht dort Vollständige Anfrage-/Antwortdetails für diese Anfrage nicht verfügbar. Schließe das Fenster mit Schließen.
- Für diesen Bericht ist keine 2FA-Bestätigung erforderlich – er ist schreibgeschützt.
Wenn der Bildschirm leer ist
- Die Meldung Keine KI-Nutzungsdaten mit dem Text Die KI-Nutzungsstatistiken erscheinen hier, sobald du KI-Funktionen nutzt. und der Schaltfläche KI-Integration einrichten bedeutet meist einfach, dass es im ausgewählten Zeitraum keine Anfragen gab.
- Wenn das Laden der Daten fehlschlägt, zeigt der Bericht eine eigene rote Meldung, statt einen leeren Bericht vorzutäuschen. Prüfe dann die Verbindung sowie Lesen für das Modul Berichte und die Feldberechtigung KI-Nutzung.
Was der Bildschirm zeigt
- Gesamtkennzahlen – Anzahl der Anfragen, Token und Kosten.
- Tagesdiagramme – Anfragen, Token und Kosten im Zeitverlauf.
- Aufteilung nach Modellen – wie viele Kosten auf jedes Modell entfallen.
- Nutzertabelle – wer wie viel verbraucht hat.
- Letzte Anfragen – mit einer Detailansicht einzelner Anfragen.
Verfügbar sind 7, 30 oder 90 Tage, das laufende Jahr oder ein benutzerdefinierter Zeitraum. Standardmäßig werden 30 Tage angezeigt.
Wofür der Bericht in der Praxis dient
- Kostenkontrolle. Die Aufteilung nach Modellen zeigt, ob ein teures Modell Aufgaben erledigt, die ein günstigeres übernehmen könnte.
- Missbrauch erkennen. Ein unverhältnismäßig hoher Anteil einer Person deutet meist auf viele Fragen hintereinander oder Automatisierungen über ein Benutzerkonto hin.
- Begrenzungen begründen. Das Ratenlimit gilt gemeinsam für das Unternehmen. Ein sehr aktiver Nutzer verlangsamt also die anderen (Assistent konfigurieren – Integration, Modell, Prompts und Kosten).
Die Daten werden laufend berechnet
Der Bericht wird nicht zwischengespeichert – die Zahlen sind beim Öffnen aktuell. Bei einem langen Zeitraum kann er langsamer laden als Logistikberichte.
Woher die Kosten stammen
Zu jeder Antwort des Assistenten werden Token und die vom Anbieter gemeldeten Kosten gespeichert. Meldet eine ältere oder nur teilweise kompatible Integration keine Kosten, verwendet das System eine lokale Schätzung und kennzeichnet sie in der Kachel Gesamtkosten (Assistent konfigurieren – Integration, Modell, Prompts und Kosten).
Achtung: Auch eine abgebrochene Frage kann Kosten verursachen. Wenn das Modell die Antwort vor dem Abbruch bereits berechnet hat, wurde die Gebühr erhoben, obwohl niemand die Antwort gesehen hat (Einschränkungen des Assistenten und häufige Missverständnisse).
Möchtest du NOXTI mit deinen Bestellungen kennenlernen? Wir zeigen dir NOXTI mit deinen Vertriebskanälen und deinem Lager.
Präsentation vereinbaren