IA Local
Introduce el código de acceso de la sesión
Introduce el código de acceso de la sesión
Código incorrecto.
Modelo de IA local de Alibaba, QWEN3 4B, ejecutándose en el ordenador Mac de la formadora
Todo ocurre en este mismo equipo: tu pregunta nunca sale a Internet ni pasa por ningún servicio de IA externo. FastAPI reenvía tu pregunta a Ollama, que ejecuta el modelo Qwen3 4B en local y devuelve la respuesta.
¿Por qué a veces tarda? Qwen3 4B es un modelo pequeño que "piensa en voz alta" antes de responder: hace un borrador, se autocorrige y a veces reescribe la respuesta entera una o dos veces — puedes verlo en directo en el panel de razonamiento. Al ser un modelo de solo 4.000 millones de parámetros ejecutándose en un ordenador normal (sin la potencia de los grandes modelos en la nube), ese proceso puede tardar de segundos a un par de minutos según la pregunta.
Qwen3 es una familia de modelos de lenguaje de código abierto desarrollada por Alibaba Cloud (equipo Qwen), publicada con licencia abierta (Apache 2.0) que permite descargarla y ejecutarla libremente en tu propio equipo, como en esta demo.
La familia incluye varios tamaños, desde 600 millones hasta más de 200.000 millones de parámetros. Esta demo usa la variante más pequeña, Qwen3 4B (4.000 millones de parámetros) — justo la que permite que el modelo funcione en un portátil normal, sin necesitar un servidor con GPU dedicada.
Qwen3 es un modelo "híbrido": puede razonar paso a paso antes de responder (el modo "thinking" que ves en el panel de razonamiento) o responder de forma directa. Al ser el modelo más pequeño de la familia, su razonamiento tiende a ser más largo e irregular que el de las versiones grandes — es la causa principal de la variabilidad en los tiempos de respuesta de esta demo.
Este modelo piensa en voz alta antes de responder: borrador → autocrítica → respuesta final. Es normal que dé vueltas.