Zużycie AI — ile kosztuje i kto korzysta
Zapytania, tokeny i koszt w rozbiciu na dni, modele i użytkowników. Do tego lista ostatnich zapytań z podglądem każdego z osobna.
Raport Użycie odpowiada na trzy pytania: ile zapytań, ile tokenów, ile to kosztowało.
Krok po kroku
Otwarcie raportu i ustawienie zakresu
- W menu bocznym, pod nagłówkiem Pulpit, rozwiń Raporty → AI i wybierz Użycie. Pozycja wymaga uprawnienia do raportu Użycie AI (grupa Report w uprawnieniach do pól).
- Ekran nosi tytuł Statystyki użycia AI i podtytuł Monitoruj wykorzystanie i koszty integracji AI. Ikona informacji obok tytułu wypisuje, co dokładnie się liczy.
- Ustaw Zakres dat: Ostatnie 7 dni, Ostatnie 30 dni (domyślny), Ostatnie 90 dni, Ten rok albo Własny. Przy Własny pojawiają się pola Od i Do.
- Zawęź wynik listą Model (domyślnie Wszystkie modele) i listą Kontekst (Wszystkie konteksty).
- Przycisk Odśwież przelicza dane. Raport nie jest buforowany, więc przy szerokim zakresie dat potrafi się ładować dłużej. Obok przycisku widać dokładny zakres oraz liczbę dni, które weszły do raportu. Wszystkie wykresy i tabele reagują na ten sam zakres, model i kontekst.
Znalezienie, na co i przez kogo idą pieniądze
- Zacznij od sześciu kafelków u góry: Zapytania, Skuteczność, Tokeny, Całkowity koszt, Śr. czas, Błędy. Kwoty są podawane w dolarach. Pod kosztem raport zaznacza, czy dostawca podał rzeczywistą opłatę, czy kwota jest estymacją ze starszych danych. Skuteczność jest liczona dla zakończonych zapytań, a Błędy obejmują także timeouty.
- Wykresy Zapytania dziennie, Tokeny dziennie i Koszt dzienny pokazują, czy koszt rośnie równomiernie, czy skokowo.
- Użycie wg modelu odpowiada na pytanie, czy drogi model nie obsługuje zadań, które poradziłby sobie tańszy. Użycie wg kontekstu mówi, która funkcja systemu go zużywa.
- Koszt na użytkownika to tabela z kolumnami Użytkownik, Zapytania, Sukces, Błędy, Tokeny, Koszt, Śr. czas. Jeden użytkownik z nieproporcjonalnym udziałem to zwykle pytania seriami. Gdy nie ma danych, widnieje Brak danych o użyciu przez użytkowników.
- Ostatnie zapytania ma kolumny Model, Kontekst, Tokeny, Koszt, Czas, Status, Utworzone. Status i Kontekst są pokazywane surowymi wartościami z bazy, po angielsku.
- Ikona oka (Zobacz szczegóły) otwiera okno Szczegóły zapytania AI: Model, Kontekst, Czas odpowiedzi, Koszt, a niżej Tokeny wejściowe, Tokeny wyjściowe i Wszystkie tokeny. Jeśli treści zostały zapisane, dochodzą sekcje Prompt systemowy, Prompt użytkownika i Odpowiedź AI; jeśli nie — Pełne szczegóły zapytania/odpowiedzi niedostępne dla tego zapytania. Zamknij przyciskiem Zamknij.
- Raport nie wymaga potwierdzenia 2FA — jest wyłącznie do odczytu.
Gdy ekran jest pusty
- Komunikat Brak danych użycia AI z tekstem Statystyki użycia AI pojawią się tutaj po rozpoczęciu korzystania z funkcji AI. i przyciskiem Skonfiguruj integrację AI oznacza zwykle po prostu brak zapytań w wybranym okresie.
- Gdy pobranie danych się nie powiedzie, raport pokazuje osobny czerwony komunikat zamiast udawać pusty wynik. Sprawdź wtedy połączenie oraz czy rola ma Odczyt na module Raporty i uprawnienie do pola Użycie AI.
Co jest na ekranie
- Wskaźniki zbiorcze — liczba zapytań, tokenów i koszt.
- Wykresy dzienne — zapytania, tokeny i koszt w czasie.
- Podział na modele — który model zużywa ile.
- Tabela użytkowników — kto ile wykorzystał.
- Ostatnie zapytania — z podglądem pojedynczego zapytania.
Zakresy: 7, 30 i 90 dni, bieżący rok albo zakres własny. Domyślnie 30 dni.
Do czego to realnie służy
- Kontrola kosztu. Podział na modele pokazuje, czy drogi model nie jest używany do zadań, które obsłużyłby tańszy.
- Wykrywanie nadużyć. Jedna osoba z nieproporcjonalnym udziałem zwykle oznacza pytania seriami albo automatyzację na koncie użytkownika.
- Uzasadnienie limitów. Limit tempa jest wspólny dla firmy, więc jeden intensywny użytkownik spowalnia pozostałych (Konfiguracja asystenta — integracja, model, prompty, koszty).
Dane są liczone na bieżąco
Ten raport nie jest buforowany — liczby są aktualne w chwili otwarcia. Przy dużym zakresie dat może się otwierać wolniej niż raporty logistyczne.
Skąd biorą się koszty
Przy każdej odpowiedzi asystenta zapisywane są tokeny oraz koszt zwrócony przez dostawcę. Jeśli starsza lub zgodna tylko częściowo integracja nie poda kosztu, system używa lokalnej estymacji i oznacza ją w kafelku Całkowity koszt (Konfiguracja asystenta — integracja, model, prompty, koszty).
Uwaga: przerwane pytanie też potrafi kosztować. Jeśli model zdążył policzyć odpowiedź przed przerwaniem, opłata została naliczona, mimo że odpowiedzi nikt nie zobaczył (Ograniczenia asystenta i najczęstsze nieporozumienia).
Chcesz zobaczyć to na swoich zamówieniach? Pokażemy NOXTI na Twoich kanałach sprzedaży i Twoim magazynie.
Umów prezentację