Il chunking è il processo di suddivisione di un contenuto in blocchi più piccoli e semanticamente coerenti, ottimizzati per essere indicizzati e recuperati dai sistemi di intelligenza artificiale.
Un testo spezzato in chunk ben formati (con metadati come titolo, sommario e URL) produce risposte AI più precise e citazioni corrette. I sistemi RAG dipendono fortemente dalla qualità del chunking: è il motivo per cui strumenti come Primary Source pre-calcolano i chunk di ogni contenuto e li espongono tramite endpoint dedicati.
