Provider e modelli di IA generativa
AIsuru supporta diversi provider di IA (OpenAI, Anthropic, Mistral) con modelli linguistici di varie dimensioni e capacità. Scegli quello più adatto alle tue esigenze di prestazioni, budget e funzionalità. Questa guida ti aiuterà a orientarti tra le opzioni disponibili e a prendere una decisione informata.
Panoramica dei provider
AIsuru si integra con diversi provider di IA generativa:
OpenAI: usa la tua chiave API per accedere ai modelli GPT (inclusi quelli sottoposti a fine-tuning);
Anthropic: usa la tua chiave API per accedere a tutti i modelli Claude;
Mistral: usa la tua chiave API per accedere a tutti i modelli;
Microsoft Azure (Azure OpenAI): usa la tua chiave API per accedere ai modelli GPT di OpenAI tramite Azure;
Amazon Bedrock (AWS Anthropic): usa la tua chiave API per accedere ai modelli Claude tramite Amazon Bedrock;
Google Vertex AI (Vertex Anthropic): usa la tua chiave API per accedere ai modelli Claude tramite Google Vertex AI;
LLM compatibili con OpenAI (Personalizzato): connettiti a provider personalizzati o server locali compatibili con il protocollo OpenAI.
Panoramica dei modelli
Attualmente, tutti gli utenti di AIsuru possono accedere ai modelli più recenti di:
Vertex Anthropic
claude-3-7-sonnet-20250219
Grande
200,000
Vertex Anthropic
Claude 4.5 Sonnet
Grande
200,000 o 1M
Vertex Anthropic
Claude 4.6 Sonnet
Grande
1M
Vertex Anthropic
claude-haiku-4-5-20251001
Piccolo
200,000
Mistral
mistral-large-2407
Grande
128,000
OpenAI
gpt-4o
Grande
128,000
OpenAI
gpt-4o-mini
Piccolo
128,000
OpenAI
gpt-5
Grande
128,000
OpenAI
GPT-5.3 istant
Grande
128,000
OpenAI (serie GPT);
Anthropic (Claude Haiku e Sonnet);
Mistral (Piccolo e Grande).
Modelli di ragionamento
Alcuni modelli dispongono di capacità di ragionamento avanzate. Questi modelli mostrano il loro processo di ragionamento solo nella scheda "Conversazioni" per impostazione predefinita.
Questo comportamento predefinito è progettato per proteggere informazioni sensibili: il processo di ragionamento può esporre dati interni, logiche di elaborazione o contenuti che non dovrebbero essere visibili agli utenti finali.
Puoi rendere visibile il ragionamento agli utenti finali modificando il tuo layout di condivisione.
A volte, i provider preferiscono non mostrare il ragionamento stesso, quindi potrebbe essere nascosto anche se dovrebbe essere mostrato secondo le impostazioni del layout dei tuoi Agenti.
Che cos'è il contesto
Il contesto rappresenta il numero massimo di token che possono essere utilizzati in ogni richiesta (o domanda) inviata al modello linguistico. Per semplificare: 1 token equivale approssimativamente a 4 caratteri in inglese. Può essere personalizzato solo per il provider Custom.
Come scegliere un modello
La scelta del modello linguistico dipende da diversi fattori. Questa pagina fornisce alcune indicazioni generali, ma dovrai testare diversi modelli con il tuo Agente: è l'unico modo per assicurarti che si comporti correttamente in tutti i tuoi casi d'uso.
Ecco come scegliere il modello giusto per ogni configurazione.
Configurazione di D&R e Gruppi di Esperti
Per le interazioni con gli utenti, considera quanto segue:
Complessità della risposta:
Risposte complesse e dettagliate: modelli grandi;
Risposte semplici e dirette: modelli piccoli.
Budget:
Budget limitato: preferisci modelli piccoli;
Budget flessibile: puoi optare per modelli grandi.
Velocità di risposta:
Risposte immediate: modelli piccoli;
Maggiore accuratezza: modelli grandi.
Capacità di ragionamento: per attività che richiedono un ragionamento complesso, usa modelli con capacità di ragionamento.
Configurazione di importazione/esportazione
Per l'importazione di documenti, considera:
Complessità dei documenti:
Documenti non strutturati: dovrai usare modelli più grandi;
Documenti ben strutturati: i modelli piccoli offrono risultati eccellenti.
Volume di documenti: se devi importare un gran numero di documenti, potresti usare un modello piccolo per contenere i costi.
Configurazione del Pensiero Profondo
Per gestire la memoria delle conversazioni, consigliamo sempre di utilizzare un modello grande con capacità di ragionamento. La generazione e la visualizzazione delle risposte agli utenti potrebbero richiedere più tempo.
Ultimo aggiornamento