Cosa c'è di sbagliato in questo suddivisione e come posso risolverlo? Restituisce JSON {"problem": "problema", "fix": "come risolvere"}.
RAG inizia tagliando i documenti in pezzi (chunk): è impossibile contestualizzare l'intero database (è costoso e non si adatta). Nel modo in cui lo tagli, verrà trovato. I pezzi troppo grandi offuscano il significato e bruciano i token; quelli troppo piccoli perdono il contesto (un pezzo di frase senza supporto). Buona pratica: tagliare lungo i confini semantici (paragrafi, sezioni) e non alla cieca in base ai caratteri, e aggiungere una sovrapposizione (sovrapposizione) in modo che l'idea all'incrocio di due blocchi non vada persa. I metadati (fonte, sezione) sono allegati a ciascun blocco per filtraggio e riferimenti. Il cattivo suddivisione in blocchi è il motivo principale per cui "RAG non trova l'ovvio".