ChatGPT es el chatbot IA más conocido del planeta, pero existen muchos otros generadores de texto mediante Inteligencia Artificial. En realidad, ChatGPT no es más que el “cascarón” donde se esconde el verdadero cerebro de la máquina que es el Modelo de Lenguaje Extenso que utiliza la aplicación.
En el caso de la versión gratuita de ChatGPT, el Modelo de Lenguaje Extenso o Gran Modelo de Lenguaje (ambos términos significan lo mismo) que se utiliza actualmente es GPT-3.5, pero no es el único. Otras aplicaciones de chat con Inteligencia Artificial también emplean su propio modelo, como puede ser el caso, por ejemplo, de Google Bard y su nuevo modelo Gemini.
¿Qué es un LLM o Gran Modelo de Lenguaje?
Los Grandes Modelos de Lenguaje o Lenguajes de Modelo Extensos (Large Languaje Models o LLM, del inglés) son sistemas avanzados de Inteligencia Artificial que han sido diseñados para comprender el lenguaje humano y generar texto en consonancia.
Para ello utilizan arquitecturas de redes neuronales que intentan imitar el comportamiento de un cerebro humano. Estos modelos han sido entrenados con millones de datos, principalmente extraídos de internet, lo que les permite entender el contexto que le plantea el usuario y desarrollar respuestas coherentes y razonadas.
Los Grandes Modelos de Lenguaje (LLM) más destacados del momento
A la hora de hablar de un LLM hay varios aspectos que debemos tener en cuenta, como el tamaño de los parámetros con los que ha sido entrenado (el modelo LlaMA 2, por ejemplo, ha sido entrenado con más de dos trillones de datos) o el proceso que ha seguido dicho entrenamiento (leyendo información de libros, páginas web, asimilando gramática, vocabulario y estilos de escritura, etc.)
Además de eso, también hay que considerar sus capacidades en el campo del lenguaje (no es lo mismo un LLM que es capaz de mantener una conversación fluida, a un LLM que solo puede responder preguntas, traducir textos o programar código), su nivel de interactividad con el usuario y otros detalles como su especialización en determinadas tareas.
GPT-4 Turbo
GPT-4 Turbo es el modelo de lenguaje extenso (LLM) más potente presentado hasta la fecha por OpenAI, los creadores de ChatGPT. Esta versión mejorada de GPT-4 ya es capaz de trabajar con datos actualizados a 2023, permite introducir “prompts” o preguntas más largas de hasta 300 páginas, y también ofrece un menor consumo de tokens que mejoran consumo de recursos.
Por ahora GPT-4 Turbo solo está disponible para los usuarios suscritos a ChatGPT Plus, aunque Microsoft anunció que dentro de poco también podremos usar GPT-4 Turbo gratis desde la aplicación de Copilot.
Gemini
Gemini es el nuevo Gran Modelo de Lenguaje desarrollado por Google. A día de hoy es el modelo que utiliza la IA del chatbot de Google Bard, en sustitución del anterior modelo, PaLM 2.
Gemini está disponible en 3 versiones:
- Gemini Nano: este es el modelo menos potente que se utilizará en dispositivos móviles. Funciona sin conexión a la nube.
- Gemini Pro: el modelo de potencia intermedia que ya está disponible en Google Bard en algunos países.
- Gemini Ultra: la versión ‘Gemini’ más potente, diseñada para competir con GPT-4 Turbo. Todavía está en fase beta y no saldrá al mercado hasta 2024.
Gemini es una IA multimodal que acepta entradas de texto, imágenes y voz.
GPT-4
GPT-4 es la versión mejorada de GPT 3.5. Este es el modelo que utilizan ahora mismo la IA de Copilot y el Chat de Bing, y se puede usar de forma gratuita.
Utiliza un sistema multimodal, lo que significa que puede leer y entender tanto texto como imágenes. También es capaz de entregar respuestas mucho más precisas y su grado de “alucinaciones” (es decir, datos inexactos o falsos) es considerablemente menor respecto a versiones anteriores del modelo GPT.
Claude 2
Claude 2 es el LLM desarrollado por Anthropic, empresa fundada por antiguos trabajadores de OpenAI. Se trata de una IA de uso gratuito por lo que compite en la misma liga que la versión estándar de ChatGPT, pero con una ventaja: sus datos están actualizados hasta principios de 2023.
Claude 2 también es capaz de aceptar entradas de texto de más de 100 páginas, algo que GPT-3.5 todavía no puede hacer. En general se comporta bien ante las solicitudes del usuario, pero todavía está en fase beta y sufre algunas alucinaciones, especialmente cuando le pedimos que analice noticias ocurridas recientemente.
GPT-3.5
Este es el gran modelo de lenguaje que encontramos detrás de la versión ‘estándar’ gratuita de ChatGPT. Solo nos podemos comunicar con él mediante texto, y maneja datos actualizados únicamente hasta 2021.
Aunque GPT-3.5 de vez en cuando sufre alucinaciones, en líneas generales se comporta bastante bien en todos los ámbitos (con algún que otro tropiezo). Puede mantener una conversación fluida, responder a preguntas del usuario y hasta es capaz de programar.
LlaMA 2
LlaMA 2 es el modelo de lenguaje extenso desarrollado por Meta AI, y es un LLM de código abierto. Ha sido diseñado principalmente para trabajar en entornos educativos y de aprendizaje de idiomas, y puede realizar diferentes tareas como la resolución de preguntas, comprensión del lenguaje natural y comprensión lectora.
El modelo de LlaMA puede utilizarse para realizar resúmenes atractivos y crear contenido interactivo en plataformas educativas, aunque ahora también es capaz de programar.
Actualmente hay dos variantes de este modelo que destacan por encima del resto: LlaMA Chat (que funciona de manera similar a ChatGPT) y LlaMA Code (un asistente IA que te ayuda a programar). Al ser de código abierto se puede usar libremente y de forma gratuita.
Amazon Q
Amazon Q es la IA generativa de Amazon que acaba de ser presentada este mismo mes de diciembre. Se trata de un LLM orientado a AWS, y podríamos decir que es algo así como un ChatGPT para empresas.
Los negocios que utilicen los servicios de Amazon pueden realizar consultas y la IA responderá aportando soluciones teniendo en cuenta la información corporativa de la empresa, los datos y la experiencia de años de uso de la arquitectura AWS.
Por ejemplo, si tenemos una tienda online podemos preguntarle cuales son los productos que más problemas están generando, pedirle que identifique la documentación que está obsoleta y necesita actualizarse, o que organice una reunión teniendo en cuenta la agenda de todos los participantes, entre muchas otras cosas.

Phi-2
Phi-2 es un modelo de lenguaje desarrollado por Microsoft y está diseñado para funcionar en dispositivos móviles o en un ordenador portátil. Phi-2 no es un LLM sino un SLM o “Small Language Model”.
De todas formas, esto no quiere decir que sea un modelo ‘pequeño’. Desde Microsoft aseguran que este modelo con 2,7 billones de parámetros ya ha superado en capacidades a otros modelos como LlaMA 2, o su competidor más directo, el propio Gemini Nano.
Cabe destacar que Phi-2, al menos por ahora, solo está disponible para fines de investigación y no hay una versión comercial a la vista.
Falcon 180B
Falcon es un Gran Modelo de Lenguaje desarrollado por el Technology Innovation Institute, y destaca por haber sido entrenado con un set de datos de gran calidad, que incluye una mezcla de texto y código, así como una amplia gama de diferentes idiomas y dialectos.
Su nuevo modelo Falcon 1080B ha sido entrenado con 180 billones de parámetros, y cuenta con licencia Apache 2.0 de código abierto, disponible tanto para investigación como para uso comercial.
Este es un buen modelo de lenguaje para aquellos que buscan una IA capaz de expresarse con fluidez en idiomas como el inglés, el alemán, el español y el francés, aunque también se defiende bastante bien en italiano, portugués, polaco, holandés, romaní, checo y sueco.
Cohere
Cohere es uno de los modelos que mejor exactitud ofrece en sus respuestas. El producto ha sido desarrollado por antiguos trabajadores de Google que participaron en el equipo de Google Brain, y está principalmente orientado a empresas.
La IA de Cohere cuenta con varios modelos disponibles, desde los más pequeños entrenados con 6 billones de parámetros, hasta modelos más extensos entrenados con 52 billones de parámetros.
Como decimos, se trata de una herramienta utilizada por compañías (Oracle, Jasper, Notion…) para ofrecer servicios de IA en su plataforma, aunque también podemos probar su chatbot Cohere Coral, que está accesible de forma gratuita.
Quizá también te interese:
- 10 cursos online gratuitos sobre IA impartidos por Google
- Cómo usar Gemini Pro, la nueva IA de Google Bard, desde España
- Brave presenta su propio chatbot IA centrado en la privacidad
¡Nos leemos en el siguiente post!




