> For clean Markdown of any page, append .md to the page URL.
> For a complete documentation index, see https://docs.userbot.ai/llms.txt.
> For AI client integration (Claude Code, Cursor, etc.), connect to the MCP server at https://docs.userbot.ai/_mcp/server.

# Formati e limiti

Pagina di riferimento. Se stai cercando di capire perché un file non si carica o
non compare nelle risposte, la risposta è quasi certamente qui.

Se ti serve il dettaglio estensione per estensione (anteprima, allegato in chat,
come viene letta, cosa fare quando non funziona) è tutto in
[Riferimento dei formati](/riferimento-formati).

## Formati che puoi caricare nella Libreria

Userbot accetta **18** estensioni da cui sa estrarre testo, più le immagini. Le
prime sono tutte indicizzabili: messe in una base di conoscenza diventano
ricercabili e citabili. Le immagini si conservano e si aprono in anteprima, ma
non vengono indicizzate, nemmeno dentro una base di conoscenza.

| Gruppo           | Estensioni                                                                     |
| ---------------- | ------------------------------------------------------------------------------ |
| Documenti        | `pdf`, `docx`, `dotx`                                                          |
| Testo e dati     | `txt`, `md`, `csv`, `json`, `jira`, `log`, `html`, `htm`, `xml`, `yml`, `yaml` |
| Presentazioni    | `pptx`, `potx`                                                                 |
| Fogli di calcolo | `xls`, `xlsx`                                                                  |
| Immagini         | `png`, `jpg`, `jpeg`, `webp`, `gif` (si conservano, non si indicizzano)        |

Ritrovi lo stesso elenco dentro il prodotto: nella **Libreria**, l'icona **?**
accanto a **File recenti** apre il riquadro **Formati supportati**, con i gruppi
e i limiti di caricamento. Lo stesso riquadro compare in una base di conoscenza
ancora vuota.

`dotx` e `potx` sono i modelli di Word e PowerPoint: si leggono come un `docx`
e un `pptx`. `.jira` non è un file che prepari tu: nasce quando l'AI cerca fra
le vostre issue con la [Conoscenza aziendale](/conoscenza-aziendale) e salva
nella Libreria l'issue che ha usato. Da lì in poi si comporta come un file di
testo, con un'anteprima dedicata che mostra assegnatario, priorità, stato e
commenti.

Se trascini un file di un formato diverso, compare un avviso con il suo nome e
quel file non viene caricato. Gli altri file dello stesso gruppo, se sono in un
formato accettato, vengono caricati.

## Il testo deve già essere nel file

È la regola che spiega più errori di tutte le altre messe insieme.

Userbot legge il **livello di testo** del documento. Non esegue alcun
riconoscimento ottico: non guarda le pagine come immagini e non prova a
interpretarle. Un PDF che è la scansione di un contratto, o la foto di una
pagina, per Userbot è un file senza testo dentro.

Cosa succede in pratica, dentro una base di conoscenza:

| Il file è…                                                          | Lo stato diventa                  | Cosa fare                                                                                                             |
| ------------------------------------------------------------------- | --------------------------------- | --------------------------------------------------------------------------------------------------------------------- |
| Un PDF fatto di pagine scansionate                                  | **Vuoto**                         | Riesporta il documento dal programma di origine, oppure passalo per un riconoscimento ottico e carica quella versione |
| Un documento in cui il dato sta solo in un'immagine o in un grafico | Indicizzato, ma quel dato non c'è | Scrivi il dato anche nel testo, o in una didascalia                                                                   |
| Una presentazione fatta solo di immagini                            | **Non indicizzato**               | Aggiungi il testo nelle diapositive, non solo nelle immagini                                                          |
| Un foglio di calcolo senza dati                                     | **Non indicizzato**               | Controlla di aver caricato il file giusto                                                                             |

> **Info**
>
> Vale anche per le immagini incorporate in un documento che per il resto è
> regolare. Un manuale con il testo corretto e gli schemi in figura viene
> indicizzato: il testo si trova, quello che è scritto dentro gli schemi no.

## Dimensioni

| Limite                                     | Valore    |
| ------------------------------------------ | --------- |
| Dimensione massima per file nella Libreria | **25 MB** |
| File in una cartella                       | **120**   |
| File in una base di conoscenza             | **1000**  |
| Allegato in chat, immagini e PDF           | **10 MB** |
| Allegato in chat, tutti gli altri formati  | **25 MB** |

Se un allegato in chat supera il limite, compare un avviso con il nome del file
e il limite che si applica.

Un PDF sopra i 25 MB è quasi sempre una scansione ad alta risoluzione.
Riesportalo a qualità inferiore, oppure dividilo per capitoli: ottieni anche
citazioni più leggibili.

## Cosa non si carica nella Libreria

| Formato                                                       | Cosa fare                                                                                              |
| ------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------ |
| File di codice: `.js`, `.py`, `.sql` e simili                 | Non si caricano. Se il contenuto ti serve, incollalo in un `.txt` o in un `.md`                        |
| `.doc`, `.xlsm`, `.ppt`, `.pps` e altri formati Office datati | Riapri e salva nel formato moderno: `.docx`, `.xlsx`, `.pptx`. Un `.ppt` si accetta solo come template |
| `.pages`, `.numbers`, `.key`                                  | Esporta in PDF o nel formato Office corrispondente                                                     |
| Audio: `.mp3`, `.wav`, `.m4a`                                 | Non supportato. Serve una trascrizione, da caricare come testo                                         |
| Video: `.mp4`, `.mov`                                         | Non supportato                                                                                         |
| Archivi: `.zip`, `.rar`, `.7z`                                | Estraili e carica i file che ti servono                                                                |
| Immagini vettoriali e di progetto: `.svg`, `.dwg`, `.psd`     | Non supportato. Esporta in PDF se ti serve il contenuto                                                |

I file protetti da password sono un caso a parte: si caricano, perché
l'estensione è accettata, ma Userbot non riesce ad aprirli e in una base di
conoscenza vanno in **Errore**. Togli la password e ricarica.

## Come vengono letti i formati particolari

**PDF.** Viene estratto il testo pagina per pagina e unito in un flusso unico.
Le citazioni riportano **il documento**, non la pagina: apri il file e cerchi il
punto. Tabelle e colonne complesse possono perdere l'allineamento originale.

**Presentazioni.** Per `pptx` e `potx` viene estratto il testo delle
**diapositive**, nell'ordine in cui stanno nel file. Le note del relatore non vengono lette: se un'informazione
sta solo lì, per l'AI non esiste. Portala nella diapositiva, o in un documento a
parte.

**Fogli di calcolo.** La conversione avviene **foglio per foglio**, e di ogni
cella esce il **valore calcolato**, non la formula. Le righe vengono divise in
blocchi da circa cinquanta, con l'intestazione ripetuta in ogni blocco, così un
passaggio recuperato resta leggibile anche fuori contesto. L'anteprima dentro
Userbot mostra le prime **500 righe**.

Una riga singola troppo grande, come una cella con dentro mezza relazione, non
entra in nessun blocco e **fa fallire l'indicizzazione di tutto il file**, non
solo di quella riga. Se un foglio va in **Errore** senza motivo apparente, cerca
la cella più lunga.

Se il tuo obiettivo è fare calcoli su un foglio, come somme, medie o incroci,
non caricarlo in una base di conoscenza: allegalo alla chat e usa l'analisi dei
dati, che i conti li esegue davvero. Si allegano sia i fogli Excel sia i `.csv`.
→ [Analizzare dati e creare grafici](/analisi-dati)

**Testo e dati.** `txt`, `md`, `json`, `xml`, `yml`, `yaml`, `html`, `htm`, `log`
e `csv` si leggono così come sono. Quattro di questi, `log`, `xml`, `yml` e
`yaml`, si caricano e si indicizzano ma **non hanno anteprima**: la scheda del
file non si apre, e per leggerli devi scaricarli.

## Quando il caricamento va in errore

Un PDF protetto da password, un file corrotto, un documento troncato a metà
dallo scaricamento: Userbot non li distingue fra loro. Lo stato diventa
**Errore** e nel messaggio trovi il motivo tecnico riportato dalla libreria che
ha provato ad aprirlo, tagliato dopo i primi caratteri. Non è pensato per essere
letto da te.

Il rimedio è quasi sempre lo stesso: riapri il file sul tuo computer, salvalo di
nuovo, togliendo la password se c'è, e ricaricalo.

## Limiti che non riguardano i file

Consumi, quote e limiti di utilizzo dell'area di lavoro sono un'altra cosa e
stanno altrove: [Formati, limiti e quote](/limiti).