

Seu próximo nível começa aqui
Seu desenvolvimento não pode ter limites. Garanta sua Assinatura Ilimitada e libere uma preparação completa com os melhores professores do Brasil.
Em pipelines de Inteligência Artificial (IA) Generativa com RAG (Retrieval-Augmented Generation), durante a preparação do corpus para indexação e recuperação, o chunking de documentos consiste em
resumir documentos, para reduzir o texto antes da geração de embeddings.
extrair e padronizar metadados, para filtrar resultados antes da busca vetorial.
normalizar texto e remover duplicatas, para melhorar a qualidade do corpus.
quantizar vetores de embeddings, para reduzir o armazenamento no índice vetorial.
dividir textos longos em segmentos menores, para indexação e recuperação.