Formati e limiti
Cosa puoi caricare, cosa diventa ricercabile e cosa non è supportato.
Pagina di riferimento. Se stai cercando di capire perché un file non si carica o non compare nelle risposte, la risposta è quasi certamente qui.
Se ti serve il dettaglio estensione per estensione (anteprima, allegato in chat, come viene letta, cosa fare quando non funziona) è tutto in Riferimento dei formati.
Formati che puoi caricare nella Libreria
Userbot accetta 18 estensioni da cui sa estrarre testo, più le immagini. Le prime sono tutte indicizzabili: messe in una base di conoscenza diventano ricercabili e citabili. Le immagini si conservano e si aprono in anteprima, ma non vengono indicizzate, nemmeno dentro una base di conoscenza.
Ritrovi lo stesso elenco dentro il prodotto: nella Libreria, l’icona ? accanto a File recenti apre il riquadro Formati supportati, con i gruppi e i limiti di caricamento. Lo stesso riquadro compare in una base di conoscenza ancora vuota.
dotx e potx sono i modelli di Word e PowerPoint: si leggono come un docx
e un pptx. .jira non è un file che prepari tu: nasce quando l’AI cerca fra
le vostre issue con la Conoscenza aziendale e salva
nella Libreria l’issue che ha usato. Da lì in poi si comporta come un file di
testo, con un’anteprima dedicata che mostra assegnatario, priorità, stato e
commenti.
Se trascini un file di un formato diverso, compare un avviso con il suo nome e quel file non viene caricato. Gli altri file dello stesso gruppo, se sono in un formato accettato, vengono caricati.
Il testo deve già essere nel file
È la regola che spiega più errori di tutte le altre messe insieme.
Userbot legge il livello di testo del documento. Non esegue alcun riconoscimento ottico: non guarda le pagine come immagini e non prova a interpretarle. Un PDF che è la scansione di un contratto, o la foto di una pagina, per Userbot è un file senza testo dentro.
Cosa succede in pratica, dentro una base di conoscenza:
Vale anche per le immagini incorporate in un documento che per il resto è regolare. Un manuale con il testo corretto e gli schemi in figura viene indicizzato: il testo si trova, quello che è scritto dentro gli schemi no.
Dimensioni
Se un allegato in chat supera il limite, compare un avviso con il nome del file e il limite che si applica.
Un PDF sopra i 25 MB è quasi sempre una scansione ad alta risoluzione. Riesportalo a qualità inferiore, oppure dividilo per capitoli: ottieni anche citazioni più leggibili.
Cosa non si carica nella Libreria
I file protetti da password sono un caso a parte: si caricano, perché l’estensione è accettata, ma Userbot non riesce ad aprirli e in una base di conoscenza vanno in Errore. Togli la password e ricarica.
Come vengono letti i formati particolari
PDF. Viene estratto il testo pagina per pagina e unito in un flusso unico. Le citazioni riportano il documento, non la pagina: apri il file e cerchi il punto. Tabelle e colonne complesse possono perdere l’allineamento originale.
Presentazioni. Per pptx e potx viene estratto il testo delle
diapositive, nell’ordine in cui stanno nel file. Le note del relatore non vengono lette: se un’informazione
sta solo lì, per l’AI non esiste. Portala nella diapositiva, o in un documento a
parte.
Fogli di calcolo. La conversione avviene foglio per foglio, e di ogni cella esce il valore calcolato, non la formula. Le righe vengono divise in blocchi da circa cinquanta, con l’intestazione ripetuta in ogni blocco, così un passaggio recuperato resta leggibile anche fuori contesto. L’anteprima dentro Userbot mostra le prime 500 righe.
Una riga singola troppo grande, come una cella con dentro mezza relazione, non entra in nessun blocco e fa fallire l’indicizzazione di tutto il file, non solo di quella riga. Se un foglio va in Errore senza motivo apparente, cerca la cella più lunga.
Se il tuo obiettivo è fare calcoli su un foglio, come somme, medie o incroci,
non caricarlo in una base di conoscenza: allegalo alla chat e usa l’analisi dei
dati, che i conti li esegue davvero. Si allegano sia i fogli Excel sia i .csv.
→ Analizzare dati e creare grafici
Testo e dati. txt, md, json, xml, yml, yaml, html, htm, log
e csv si leggono così come sono. Quattro di questi, log, xml, yml e
yaml, si caricano e si indicizzano ma non hanno anteprima: la scheda del
file non si apre, e per leggerli devi scaricarli.
Quando il caricamento va in errore
Un PDF protetto da password, un file corrotto, un documento troncato a metà dallo scaricamento: Userbot non li distingue fra loro. Lo stato diventa Errore e nel messaggio trovi il motivo tecnico riportato dalla libreria che ha provato ad aprirlo, tagliato dopo i primi caratteri. Non è pensato per essere letto da te.
Il rimedio è quasi sempre lo stesso: riapri il file sul tuo computer, salvalo di nuovo, togliendo la password se c’è, e ricaricalo.
Limiti che non riguardano i file
Consumi, quote e limiti di utilizzo dell’area di lavoro sono un’altra cosa e stanno altrove: Formati, limiti e quote.

