Monitorare i consumi PaaS
8.4.5 Report sui Consumi
La sezione Report sui Consumi del pannello di amministrazione ti offre un monitoraggio dettagliato del consumo di risorse della tua piattaforma PaaS. Questa funzionalità ti consente di analizzare i consumi, ottimizzare le prestazioni e gestire efficacemente i costi operativi.
Panoramica della sezione
I Report sui Consumi ti offrono un quadro completo dei consumi della piattaforma attraverso:
Monitoraggio in tempo reale dei consumi per utente e Agente;
Analisi dettagliata dell'utilizzo delle API e dei modelli IA;
Gestione dei periodi per analisi basate sul tempo;
Esportazione dei dati per analisi esterne avanzate.
Struttura dei report
La sezione è organizzata in due schede principali:
Consumi per Agente: analisi dei consumi per singolo Agente e utente;
Consumi per chiave: monitoraggio dei consumi delle chiavi API.
Controlli di navigazione
Periodo di riferimento
Puoi personalizzare il periodo di tempo mostrato nei report:
Navigazione temporale: usa le frecce per spostarti tra periodi precedenti e successivi;
Mese corrente: fai clic per visualizzare rapidamente i dati di questo mese;
Periodo personalizzato: seleziona intervalli specifici (ad es. 01/07/2025 - 01/08/2025).
Funzionalita aggiuntive
Esporta CSV: scarica i dati in formato CSV per analisi esterne;
Aggiornamento dati: i report si aggiornano automaticamente con i dati sui consumi piu recenti.
Scheda Consumi per Agente
Colonne della tabella
La tabella dei consumi per Agente mostra le seguenti metriche:
Utenti > Agente: il proprietario dell'Agente;
Prompt Tokens: numero di token utilizzati nelle richieste;
Completion Tokens: numero di token generati nelle risposte;
Token Totali: somma totale dei token utilizzati;
Chat valide: numero di conversazioni completate;
Chat con Pensiero Profondo: sessioni che hanno utilizzato la memoria avanzata;
Risposte IA: numero di risposte generate dall'IA;
Risposte IA (Non conteggiate): risposte generate con modelli personalizzati;
Risposte IA con PP: risposte con Pensiero Profondo;
Risposte IA con PP (Non conteggiate): risposte con Pensiero Profondo generate con modelli personalizzati;
Documenti importati: numero di documenti elaborati;
Documenti importati (Non conteggiati): documenti elaborati con modelli personalizzati;
Media di token per messaggio: consumo medio di token per interazione.
Esempio di dati
example.user
Prompt Tokens: 14.516;
Completion Tokens: 1.780;
Token totali: 16.296;
Chat valide: 6;
Chat con Pensiero Profondo: 2;
Risposte IA: 5;
Risposte IA (Non conteggiate): 2;
Risposte IA con PP: 2;
Documenti importati: 0 p;
Media di token per messaggio: 1.810,67.
dev.user
Prompt Tokens: 2.199.180;
Completion Tokens: 30.361;
Token totali: 2.229.541;
Chat valide: 20;
Chat con Pensiero Profondo: 1;
Risposte IA: 35;
Risposte IA (Non conteggiate): 0;
Risposte IA con PP: 1.
Scheda Consumi per chiave
Colonne della tabella
La tabella dei consumi per chiave API mostra:
Chiave: identificativo mascherato della chiave API utilizzata;
Prompt Tokens: token utilizzati nelle richieste;
Token di completamento: token generati nelle risposte;
Token totali: consumo totale di token per la chiave.
Esempio di dati
Provider-ModelA-Config
Configurazione: Provider-Q&A-Processing
Chiave: 7640860******o5I
Modello: chat-model-version
Token del prompt: 128,530;
Token di completamento: 6,148;
Token totali: 134,678.
Provider-ModelB-Config
Configurazione: Provider-ImportExport-Processing
Chiave: 7640860******o5I
Modello: processing-model-version
Token del prompt: [dati disponibili nel report].
Metriche monitorate
Indicatori principali
1. Account amministratori (solo tenant)
Numero di amministratori attivi;
Limite massimo consentito.
2. Agenti conversazionali
Numero di Agenti attivi per utente e tenant;
Limite massimo consentito;
Pulsante "Mostra elenco Agenti" per visualizzare l'elenco completo.
3. Chat valide
Numero di conversazioni completate per utente e tenant;
Limite applicabile quando configurato.
4. Risposte generate da IA
Numero totale di risposte generate per utente e tenant;
Limite massimo consentito;
Risposte IA non conteggiate: risposte generate con modelli personalizzati.
5. Documenti importati
Numero di pagine importate per utente e tenant;
Limite massimo consentito;
Pagine non conteggiate: pagine elaborate con modelli personalizzati.
Uso dei modelli personalizzati
Consumi non conteggiati
Quando utilizzi modelli linguistici personalizzati con le tue chiavi API:
Risposte generate: non vengono conteggiate nel limite standard;
Pagine importate: non vengono conteggiate nel limite standard;
Visualizzazione separata: questi consumi appaiono come "non conteggiati".
💡 Importante: i limiti di Agente e delle chat valide per utente e tenant non sono influenzati dall'utilizzo delle tue chiavi API.
Interpretazione dei dati
Analisi dei consumi
Per ogni metrica viene mostrato:
Valore di consumo: utilizzo effettivo rispetto ai limiti della piattaforma;
Limite massimo: soglia configurata per ogni voce (quando presente);
Consumi non conteggiati: utilizzo con modelli personalizzati.
Indicatori di performance
Media token per messaggio: efficienza delle conversazioni;
Rapporto Prompt/Completion: bilanciamento tra richieste e risposte;
Utilizzo del Pensiero Profondo: adozione delle funzionalità avanzate.
Ottimizzazione dei consumi
Strategie di efficienza
Monitora regolarmente i modelli di utilizzo per identificare anomalie;
Analizza la media dei token per messaggio per ottimizzare l'efficienza;
Bilancia l'utilizzo tra modelli standard e personalizzati;
Esporta periodicamente i dati per analisi avanzate.
Gestione dei costi
Utilizza modelli personalizzati per ridurre i consumi conteggiati;
Ottimizza le conversazioni per ridurre il consumo di token;
Monitora l'utilizzo delle funzionalità premium;
Pianifica la crescita in base alle tendenze di consumo.
Best practice
Esporta regolarmente i dati in CSV per analisi dettagliate;
Confronta i consumi in diversi periodi per individuare le tendenze;
Identifica gli utenti con consumi insoliti per un'ottimizzazione mirata;
Documenta i modelli di utilizzo per la pianificazione futura;
Configura avvisi personalizzati per le soglie critiche di consumo.
La sezione Report sui consumi ti fornisce gli strumenti necessari per una gestione efficiente e consapevole delle risorse della tua piattaforma PaaS, consentendoti di ottimizzare costi e prestazioni sulla base di dati accurati e aggiornati.
Ultimo aggiornamento