> For clean Markdown of any page, append .md to the page URL.
> For a complete documentation index, see https://docs.userbot.ai/llms.txt.
> For AI client integration (Claude Code, Cursor, etc.), connect to the MCP server at https://docs.userbot.ai/_mcp/server.

# Come si contano i crediti

Il credito è l'unità con cui Userbot misura l'uso dell'AI. Serve a mettere sullo
stesso metro modelli che costano molto diversamente l'uno dall'altro, così un
budget vale uguale per chi scrive email e per chi analizza bilanci.

Questa pagina dice cos'è un credito, quanto pesa ciascun modello e come nasce il
conto di una singola risposta.

## Cos'è un credito

Un credito misura **quanto lavoro ha fatto il modello**, non quanti messaggi hai
scritto. Due richieste lunghe uguali possono costare l'una molte volte l'altra, a
seconda del modello che risponde e di quanto testo si porta dietro.

È una misura proporzionale al costo reale del modello: un modello che costa il
doppio pesa il doppio in crediti. Per questo il credito è utile a confrontare,
fra due modelli o fra due modi di fare la stessa richiesta, più che a essere
convertito in qualcos'altro. Il consumo **oltre** l'incluso, pagato con il
credito prepagato, ha in più un margine gestito da Userbot, come dice anche la
pagina **Fatturazione**.

## Come si calcola una risposta

Ogni scambio con l'AI si misura in **token**: pezzi di parola, all'incirca
4 caratteri l'uno. Ce ne sono due tipi, e pesano in modo diverso:

* i token in **entrata** sono tutto quello che il modello legge: la tua domanda,
  la conversazione precedente, gli allegati, i brani trovati nei documenti, le
  istruzioni dell'area di lavoro;
* i token in **uscita** sono la risposta che scrive.

**I due tipi si contano separatamente, e l'uscita costa parecchie volte
l'entrata.** È il fatto che cambia tutti i consigli pratici: una domanda lunga
costa molto meno di una risposta lunga.

A parità di token totali, chiedere un riassunto di 20 pagine costa una frazione
di quello che costa farsi scrivere 20 pagine. Sullo stesso modello, diecimila
token di entrata e mille di uscita costano meno della metà di mille di entrata e
diecimila di uscita, anche se il testo mosso è lo stesso.

## Quanto pesa ciascun modello

Non c'è un listino fisso. Il peso di un modello segue il prezzo che il fornitore
applica in quel momento, quindi può cambiare nel tempo. Lo leggi nel catalogo in
[Gestire i modelli](/modelli-admin): accanto a ogni nome c'è un badge come
**5×**, che dice quanto pesa quel modello rispetto al modello di riserva per la
stessa quantità di testo. Il filtro **Consumo** raggruppa i modelli in **Basso**,
**Medio** e **Alto**.

![I modelli di un fornitore nel catalogo: accanto a ciascun nome il badge che dice quante volte pesa rispetto al modello di riserva, GPT-OSS a 1x](/_fern-img/501c9ca9cc1d83b7111e942e446a953c210236cf9cf37e87df8c861523c6e285.webp)

Fra il modello di riserva e quelli di punta ci sono ordini di grandezza: la
stessa risposta scritta da un modello di punta invece che da **GPT-OSS** consuma
moltissimi crediti in più. È il motivo per cui **Auto** conviene quasi sempre.

I modelli aggiunti da voi non hanno un prezzo letto dal fornitore: per loro vale
il **Costo stimato · USD / 1M token** che avete indicato quando li avete creati.

## Le finestre del budget

Ogni posto include un budget mensile, diviso in finestre più corte perché non si
esaurisca il primo giorno: la settimana vale un quarto del mese, la sessione di
5 ore vale un terzo della settimana. Quanto vale l'incluso dipende dalla fascia
del posto, e non va calcolato a mano: ogni persona vede le proprie due barre in
**Impostazioni › Il tuo utilizzo**, e chi amministra vede il consumo di tutti in
[Membri](/membri), nella colonna **Utilizzo**.

![Le due barre di una persona: sessione corrente e utilizzo settimanale, ciascuna con la percentuale consumata e l'ora o il giorno in cui riparte da zero](/_fern-img/5b849355afebb36d06d0f9cfd3abd6bb6144b2680aeeb22c56a50af66e46151b.webp)

La settimana è quella di calendario: si azzera **ogni lunedì**. La sessione
parte con il primo messaggio e dura 5 ore, poi riparte da zero al messaggio
successivo.

Quando una delle due finestre si esaurisce, le risposte passano al modello
economico fino all'azzeramento. Il consumo su quel modello **non ricarica il
contatore**, e lo stesso vale per la compattazione automatica della cronologia
delle chat lunghe: dopo il passaggio si continua a lavorare senza intaccare altro
budget.

> **Info**
>
> Con l'**utilizzo extra** acceso le due finestre non contano più: quello che
> conta è il totale del mese rispetto all'incluso più il tetto di spesa della
> persona. Se chi amministra imposta il tetto della persona a giorno o a
> settimana, conta solo la spesa extra in quel periodo. Chi lavora a raffica non
> viene fermato a metà settimana, ma la spesa oltre l'incluso finisce sul
> credito prepagato. Vedi [Limiti di spesa e credito](/spesa).

## Cosa farne

* **Il modello pesa più della lunghezza.** Spostare il traffico quotidiano su un
  modello economico rende più di qualunque disciplina sui prompt.
* **Le risposte lunghe sono la voce cara.** Chiedere «in dieci righe» non è una
  questione di stile: è la leva principale sul consumo.
* **Gli allegati entrano in ogni messaggio successivo.** Un documento incollato
  in chat viene riletto a ogni turno. Se serve spesso, mettilo nella **Libreria**
  e fallo cercare: entrano solo i brani pertinenti.

Il consumo che ogni persona vede per sé sta in [Quanto sto consumando](/consumi); il quadro dell'area di lavoro in [Limiti di spesa e credito](/spesa).