Diferencias entre la RAG y el perfeccionamiento del modelo

Copiar URL

Tanto la RAG como el perfeccionamiento tienen como objetivo mejorar los modelos de lenguaje de gran tamaño (LLM). La RAG lo hace sin modificar el LLM fundamental, mientras que el perfeccionamiento requiere ajustar los pesos y los parámetros del LLM. A menudo, puedes personalizar el modelo usando el perfeccionamiento y la arquitectura RAG a la vez.

Descubre Red Hat AI

Un LLM es un tipo de inteligencia artificial que utiliza técnicas de machine learning (aprendizaje automático) para comprender y producir lenguaje humano. Estos modelos de machine learning pueden generar, resumir, traducir, reescribir, clasificar, categorizar y analizar texto, y mucho más. En las empresas, estos modelos suelen usarse para crear un sistema de preguntas y respuestas, como un chatbot.

Los modelos base de los LLM se entrenan con conocimientos generales para respaldar una amplia gama de casos prácticos. Sin embargo, es probable que no dispongan del conocimiento específico de un área que es exclusivo de tu empresa. La RAG y el perfeccionamiento son dos formas de ajustar tu LLM e incorporarle los datos que necesita para producir los resultados que deseas.

Por ejemplo, supongamos que estás desarrollando un chatbot para que interactúe con los clientes. En este escenario, el chatbot representa tu empresa, por lo que querrás que actúe como un empleado de alto rendimiento y que comprenda los matices de tu empresa, como los productos que vendes y las políticas que aplicas. De la misma manera en que capacitarías a un empleado proporcionándole documentos para estudiar y guiones para seguir, debes entrenar a un chatbot mediante el uso de la RAG y el perfeccionamiento para aprovechar la base de conocimientos con la que llega. 

Recursos de Red Hat

La RAG permite complementar los datos que se encuentran en los LLM con información que proviene de fuentes de tu preferencia, ya sean repositorios de datos, conjuntos de textos o documentación. Las herramientas como Docling ayudan con este proceso de conversión. Después de recuperar los datos, las arquitecturas de RAG los procesan en el contexto de un LLM y generan una respuesta basada en las fuentes combinadas.

La RAG es ideal para complementar tu modelo con información que se actualiza de forma periódica. Si creas una vía de comunicación entre el LLM y las fuentes externas elegidas, obtendrás resultados mucho más precisos. Además, como puedes diseñar la RAG para que cite su fuente, resulta sencillo comprender el modo en que se formula un determinado resultado, lo que aporta más transparencia y genera confianza.

Volvamos a nuestro ejemplo: si tuvieras que diseñar un chatbot que respondiera a preguntas como "¿cuál es tu política de devoluciones?", podrías usar una arquitectura RAG. Podrías conectar el LLM a un documento que detalle la política de devoluciones de la empresa e indicar al chatbot que extraiga información de allí, e incluso indicarle que cite su fuente y proporcione el enlace para que el usuario lo pueda leer. Asimismo, si el documento sobre la política de devoluciones cambiara, el modelo de RAG extraería la información más reciente y se la comunicaría al usuario.

Obtén más información sobre la RAG

 

Casos prácticos de la RAG

La RAG permite obtener y organizar la información de una manera que simplifique la interacción de las personas con los datos. Con una arquitectura RAG, los modelos pueden buscar información y brindar contexto a partir de fuentes de datos locales y de la nube. Esto significa que se pueden usar datos externos, documentos internos e, incluso, feeds de redes sociales para responder preguntas, proporcionar contexto y aportar información para la toma de decisiones.

Por ejemplo, puedes crear una arquitectura RAG que proporcione respuestas específicas con respecto a las políticas, los procedimientos y la documentación de tu empresa. Esto ahorra tiempo que, de otro modo, se dedicaría a buscar e interpretar un documento de forma manual.

Descubre el uso de la RAG en la ingeniería de softwarePágina disponible en Inglés (Español no está disponible)

Piensa en el perfeccionamiento como una forma de comunicar tu intención al LLM para que adapte su resultado en función de tus objetivos. Es un proceso que implica entrenar más un modelo que ya se entrenó con la ayuda de un conjunto de datos más pequeño y específico, para que pueda realizar tareas de un área determinada de manera más eficaz. Estos datos de entrenamiento adicionales se integran en la arquitectura del modelo.

La adaptación de bajo rango (LoRA) y la adaptación de bajo rango cuantificada (QLoRA) son técnicas de perfeccionamiento eficiente de los parámetros (PEFT) que ayudan a los usuarios a optimizar los costos y los recursos informáticos. 

Volvamos a nuestro ejemplo del chatbot. Supongamos que deseas que el chatbot interactúe con pacientes en un contexto médico. Es importante que el modelo comprenda la terminología médica relacionada con tu trabajo. Con las técnicas de perfeccionamiento, puedes asegurarte de que cuando un paciente le pregunte al chatbot sobre los "servicios de fisio", este entenderá que se refiere a "servicios de terapia física" y lo dirigirá a los recursos adecuados.

Casos prácticos del perfeccionamiento

El perfeccionamiento es ideal para entrenar los modelos a fin de que interpreten la información a la que tienen acceso. Por ejemplo, puedes entrenar un modelo para que comprenda los matices y la terminología de tu sector específico, como las siglas y los valores de la empresa.

El perfeccionamiento también es útil para las tareas de clasificación de imágenes. Por ejemplo, si trabajas con imágenes de resonancia magnética (IRM), con el perfeccionamiento puedes entrenar tu modelo de inteligencia artificial predictiva para que identifique anomalías.

Descubre los casos prácticos de la inteligencia artificial predictiva

El perfeccionamiento también puede ayudar a que tu empresa adopte el tono correcto cuando se comunica con los demás, especialmente en el contexto de soporte al cliente. Te permite entrenar un chatbot para que analice las opiniones o las emociones de las personas con las que interactúa, Además, puedes entrenar el modelo de inteligencia artificial generativa para que responda de una manera que le sea útil al usuario y, a la vez, refleje los valores de la empresa.

Descubre los casos prácticos de la IA generativa

Si comprendes las diferencias entre la RAG y el perfeccionamiento, podrás tomar decisiones estratégicas sobre los recursos de inteligencia artificial que debes implementar para satisfacer tus necesidades. Estas son algunas preguntas básicas que debes tener en cuenta:

¿Cuáles son las habilidades de tu equipo?

La personalización de un modelo con la RAG requiere habilidades de codificación y arquitectura. En comparación con los métodos tradicionales de perfeccionamiento, la RAG proporciona una manera más accesible y sencilla de obtener comentarios, solucionar problemas y corregir aplicaciones. Para perfeccionar un modelo, se necesita experiencia en el procesamiento del lenguaje natural (NLP), el deep learning (aprendizaje profundo), la configuración de modelos, el reprocesamiento de los datos y la evaluación. Por eso, puede demandar más tiempo y habilidades técnicas.

¿Tus datos son estáticos o dinámicos?

Con el perfeccionamiento, el modelo aprende patrones comunes que no cambian con el tiempo. Debido a que se basa en instantáneas estáticas de los conjuntos de datos de entrenamiento, es posible que la información quede obsoleta y que sea necesario repetir el entrenamiento. Por el contrario, con la RAG se indica al LLM que recupere información específica de las fuentes elegidas de manera inmediata. Esto significa que el modelo extrae los datos más actualizados para informar la aplicación, lo que permite que los resultados sean precisos y relevantes.

¿Cuál es tu presupuesto?

La RAG suele ser más rentable que el perfeccionamiento. Para implementar una arquitectura RAG, debes diseñar sistemas de canales que conecten los datos con el LLM. Este enfoque ahorra costos porque utiliza los datos que ya posees para brindar información al LLM. Esto contrasta con la gran cantidad de recursos que requiere el perfeccionamiento para realizar el etiquetado de datos especializado y la gran potencia informática que se necesita para el entrenamiento repetido de los modelos.

Si bien el perfeccionamiento siempre se ha considerado la opción más costosa, ciertas tecnologías, como el vLLM, permiten atenuar el problema. El vLLM es un servidor y un motor de inferencia que mejora la rentabilidad de la distribución de los modelos perfeccionados. 

Obtén más información sobre vLLM

Red Hat® AI está diseñada para realizar inferencias rápidas, flexibles y eficientes a través de su servidor con vLLM . Conecta los modelos a tus datos de manera confiable para unificar la personalización y el desarrollo de agentes especializados en una sola plataforma. Nuestros productos están diseñados con una base open source y te brindan el control total de los flujos de trabajo de inteligencia artificial en cualquier escala. 

La cartera de productos de Red Hat AI incluye Red Hat AI Inference, una stack de inferencias que proporciona el control operativo para ejecutar cualquier modelo en cualquier acelerador en toda la nube híbrida. Obtén inferencias rápidas, eficientes y rentables a gran escala. 

Descubre Red Hat AI

Blog oficial de Red Hat: últimas novedades sobre la automatización empresarial, la nube híbrida, la inteligencia artificial y mucho más.

Más información sobre nuestro ecosistema de clientes, socios y comunidades y las últimas novedades sobre la automatización empresarial, la nube híbrida, la inteligencia artificial y mucho más.

Todas las versiones de prueba de los productos de Red Hat

Con las versiones de prueba gratuitas de nuestros productos, podrás adquirir experiencia práctica, prepararte para obtener una certificación o evaluar las soluciones para saber si son adecuadas para tu empresa.

Más información

¿Qué es PyTorch?

PyTorch es una biblioteca de software open source con la que los desarrolladores pueden combinar distintos elementos de código para crear un "cerebro" de inteligencia artificial que aprenda a identificar patrones en los datos.

Todo sobre AIOps

AIOps (inteligencia artificial para las operaciones de TI) es un enfoque para automatizar las operaciones de TI con el machine learning (aprendizaje automático) y otras técnicas avanzadas de inteligencia artificial.

¿Qué es el machine learning?

El machine learning (aprendizaje automático) es la técnica que consiste en entrenar a una computadora para que encuentre patrones, realice predicciones y aprenda de la experiencia sin una programación explícita.

IA/ML: lecturas recomendadas