RAG (Generación Aumentada por Recuperación, del inglés Retrieval-Augmented Generation) — técnica que combina la recuperación de información de una base de datos o fuente externa con la generación de texto de un modelo de lenguaje (LLM). En lugar de que el modelo responda solo con lo que sabe de su entrenamiento, consulta primero una base de conocimiento (como una base de datos vectorial) para obtener información relevante y luego genera la respuesta basándose en ella. Es la base de los chatbots que responden sobre documentación propia, FAQs o historial de la empresa.