LearnAI
Modulo 5 · RAG profondo (Pro) · Lezione 1/6
← Al catalogo
Compito

Chunking: come tagliare i documenti

Cosa c'è di sbagliato in questo suddivisione e come posso risolverlo? Restituisce JSON {"problem": "problema", "fix": "come risolvere"}.

Sblocca l'accesso per inviare soluzioni per la revisione istantanea dell'intelligenza artificiale.Inizia gratuitamente
La base di un RAG di qualità
💡 Un pezzo di teoria

RAG inizia tagliando i documenti in pezzi (chunk): è impossibile contestualizzare l'intero database (è costoso e non si adatta). Nel modo in cui lo tagli, verrà trovato. I pezzi troppo grandi offuscano il significato e bruciano i token; quelli troppo piccoli perdono il contesto (un pezzo di frase senza supporto). Buona pratica: tagliare lungo i confini semantici (paragrafi, sezioni) e non alla cieca in base ai caratteri, e aggiungere una sovrapposizione (sovrapposizione) in modo che l'idea all'incrocio di due blocchi non vada persa. I metadati (fonte, sezione) sono allegati a ciascun blocco per filtraggio e riferimenti. Il cattivo suddivisione in blocchi è il motivo principale per cui "RAG non trova l'ovvio".

Come viene valutato · superamento 70

  • 1JSON valido senza testo attorno30%
  • 2Ci sono i campi problem e fix35%
  • 3100 caratteri perdono il contesto; tagliato secondo il significato + sovrapposizione35%
Il tuo suggerimentoClaude ⌄