Imagem de fundo

Em pipelines de Inteligência Artificial (IA) Generativa com...

Em pipelines de Inteligência Artificial (IA) Generativa com RAG (Retrieval-Augmented Generation), durante a preparação do corpus para indexação e recuperação, o chunking de documentos consiste em


A

resumir documentos, para reduzir o texto antes da geração de embeddings.


B

extrair e padronizar metadados, para filtrar resultados antes da busca vetorial.


C

normalizar texto e remover duplicatas, para melhorar a qualidade do corpus.


D

quantizar vetores de embeddings, para reduzir o armazenamento no índice vetorial.


E

dividir textos longos em segmentos menores, para indexação e recuperação.