
3118. Modelos locales de IA
Descripción del Episodio
Hoy vemos qué son los modelos locales gratuitos de IA, cómo instalarlos en nuestro ordenador, y qué podemos esperar de ellos.
Pero antes, recordemos que en Boluda.com tenéis cursos para emprendedores, marketing online, desarrollo web, y todo lo que necesitáis para vuestro negocio online. Estamos en pleno curso de Codex para todo en el que estamos aprendiendo a conectar Codex con aplicaciones, servicios y plataformas reales para consultar información, crear contenido, ejecutar acciones y automatizar flujos de trabajo mediante lenguaje natural. ¡A por él!
Ahora sí, vamos al lío. Cada vez más personas se preguntan si es posible usar inteligencia artificial en local, sin depender de OpenAI, Anthropic o cualquier otro proveedor externo. La respuesta corta es sí. Se puede. Pero la respuesta larga es bastante más interesante, porque aunque tiene ventajas evidentes, también implica ciertas limitaciones que conviene conocer antes de lanzarse a ello.
Cuando hablamos de IA local no nos referimos simplemente a descargar ChatGPT en nuestro ordenador y olvidarnos de las cuotas mensuales. La realidad es que necesitamos varias piezas trabajando juntas. Por un lado está el modelo, que sería el cerebro. Por otro, el runtime, que actúa como sistema nervioso y permite que ese cerebro funcione. Y finalmente tenemos el agente, que es el encargado de interactuar con nosotros, acceder a archivos, ejecutar tareas o trabajar con código.
Entre los modelos locales más conocidos encontramos Gemma, Llama, Qwen, Mistral, DeepSeek, GLM o Kimi. Todos ellos pueden descargarse y ejecutarse localmente, ya sea en nuestro ordenador o en un servidor propio. Para gestionarlos suele utilizarse un runtime como Ollama, que se ha convertido en una de las opciones más populares por su sencillez y compatibilidad.
El flujo habitual es bastante simple. Yo hablo con un agente como OpenCode. Este agente se comunica con el runtime, por ejemplo Ollama, y este a su vez consulta el modelo que tenga instalado. Es una arquitectura diferente a la que usamos cuando trabajamos con ChatGPT, Claude o Gemini, donde toda esa infraestructura ya viene preparada por el proveedor.
Ahora bien, el gran punto a tener en cuenta es el hardware. Los modelos pequeños pueden funcionar en equipos relativamente normales, pero a medida que aumentamos el tamaño y la capacidad del modelo, también crecen las necesidades de memoria y potencia gráfica. Los modelos más avanzados pueden requerir cantidades importantes de RAM y GPUs potentes para ofrecer una experiencia fluida. De lo contrario, las respuestas pueden tardar bastante en llegar.
A cambio obtenemos ventajas muy interesantes. La primera es la privacidad, ya que los datos no salen de nuestra máquina. También ganamos control total sobre el modelo, la configuración y la infraestructura. Además, podemos trabajar incluso sin conexión a Internet y evitamos depender de APIs externas o de cambios en las políticas de terceros. Y, por supuesto, no pagamos por tokens, ya que toda la computación se realiza con nuestros propios recursos.
Sin embargo, no todo son ventajas. Necesitamos instalar, configurar y mantener todo el entorno. También debemos asumir el coste del hardware o de un servidor suficientemente potente. Y aunque los modelos locales han mejorado muchísimo durante los últimos meses, los modelos más pequeños todavía suelen estar por detrás de los grandes modelos comerciales cuando hablamos de programación compleja o tareas especialmente exigentes.
Por eso considero que la IA local tiene mucho sentido para quienes valoran especialmente la privacidad, quieren experimentar, aprender cómo funciona toda la infraestructura o ya disponen de equipos potentes. También puede encajar muy bien en automatizaciones sencillas o proyectos donde la velocidad no sea crítica. En cambio, si buscáis la máxima calidad posible, la mayor comodidad y respuestas inmediatas, probablemente seguiréis obteniendo mejores resultados utilizando servicios como ChatGPT, Claude o Codex.
Si queréis empezar a trastear hoy mismo, una combinación muy razonable es utilizar Ollama como runtime, Gemma o Qwen en una versión pequeña como modelo y OpenCode como agente. Es una forma sencilla de entender cómo funciona todo este ecosistema y de comprobar por vosotros mismos hasta dónde ha llegado la inteligencia artificial local.
Mi sensación es que estamos en un momento muy interesante. Los modelos locales mejoran cada mes, requieren menos recursos que antes y se acercan progresivamente al rendimiento de los grandes modelos comerciales. Quizás todavía no son la opción ideal para todo el mundo, pero sí representan una alternativa cada vez más viable.
Y si esta tendencia continúa, no me extrañaría que dentro de unos años trabajar con IA local fuera algo tan habitual como instalar cualquier otra aplicación en nuestro ordenador. :)
Como siempre, muchas gracias a todos por vuestras valoraciones de cinco estrellas en Apple Podcasts y Spotify, suscribiros a los cursos para emprendedores y por estar ahí, al otro lado. Como siempre digo, sin vosotros, esto no sería lo que es. Sin vosotros esto simplemente, no sería.
Nos escuchamos mañana con más marketing online. Como siempre, a las 07:07. Hasta entonces… ¡Muy buenos días!
Episodios Recientes

Más podcasts de Sociedad y Cultura
Ver toda la categoría →
We!
By shows
<p>The #1 U.S. How To podcast for emotional growth, WE is a movement for reconnection—heart to heart, soul to soul. Hosted by Joe Mittiga, WE explores emotional healing, mental health, personal growth, relationships, and spiritual awakening in a world that feels increasingly disconnected. Each episode reveals why you feel the way you do—and the emotional, mental, and spiritual growth that leads to healing, peace, purpose, and deeper human connection. Through honest conversations and real-life experiences, WE helps you better understand yourself, others, and your place in a changing world. Healing doesn't happen alone. It happens when we remember WE. <br><br></p><p>Visit <a href="http://www.wepodcast.global"><b>www.WEPodcast.global</b></a> to learn more<br><br></p><p>Download my books free at <a href="http://www.joemittiga.com"><b>www.JoeMittiga.com</b></a>.<br><br></p><p><b>Voices of WE</b></p><p><em>Healing humanity, one story at a time.</em></p>

The Permanent Questions With David Brooks
By shows
What makes us human? How can I find purpose in life? How can my relationship survive a rough patch? What do I say to a friend who’s suffering? Does any of this mean anything at all? It’s easy to lose sight of fundamental human concerns amid the churn of the news cycle and the demands of every day. Each week on The Permanent Questions, host David Brooks seeks to return them to our attention through thoughtful conversation with the world’s deepest thinkers.

Simulacro
By shows
Marcos Oliveira, uno de los padres de la inteligencia artificial, desaparece de forma misteriosa en Canarias y lo único que saben es que iba buscando una puerta. El escritor Santiago Álvarez recorre la última ruta que hizo el científico para intentar resolver el misterio pero, cuanto más lo busca, más perdido se encuentra en un laberinto entre la realidad y la simulación.<br /><br />Simulacro es un thriller psicológico especulativo creado por <b>Julio Rojas</b> (autor de 'Caso 63') y protagonizado por Isak Férriz, Mónica López y Alberto San Juan.<br /><br />Producido por El Extraordinario para Turismo de Islas Canarias y financiada con fondos Next Generation de la Unión Europea.

Cisne Rojo
By shows
<p>Sara es la principal accionista de Summer-Petersen, una importante compañía de servicios financieros. Es la ejecutiva más agresiva. La que no tiene miedo. Si se trata de negocios, la información es poder y Sara ve lo que otros no ven. Hasta hoy. Este lunes, reaparece en su vida Miranda Celis, una analista de grandes datos y experta en predicciones basadas en algoritmos. A partir de una sola llamada, Miranda conectará recuerdos del pasado con el anuncio de trágicos e irreversibles eventos futuros. Si Sara piensa que todo es estable, que las personas que ama, que la ciudad que habita, y que todo lo que la rodea estará mañana, hoy Sara deberá pensar otra vez.</p><p> </p><p>Protagonizada por Blanca Lewin e Ignacia Baeza. Creada y escrita por Julio Rojas, el creador de Caso 63. Producida por <a href="http://emisorpodcasting.com/" rel="noopener noreferrer" target="_blank">Emisorpodcasting.com</a></p>

Franco Escamilla Canal Oficial
By shows
¡Bienvenidos al canal oficial de Franco Escamilla! Suscríbete para escuchar un nuevo episodio cada día. Martes: La Mesa Reñoña Miércoles: Los Amos Del Universo Jueves: Toy Aburrido Viernes: Psico y Psico Domingo: Cabareteando Recuerda que no tengo otro canal de audio, no aceptes imitaciones.

Café Francés ~ Aprende francés!
By shows
<p>Café Francés es el rincón preferido de hispanohablantes para aprender francés de forma estructurada y paso a paso. </p><p><br></p><p>Aprenderás frases útiles, diálogos reales, vocabulario esencial, gramática y todo sobre la cultura, costumbres y vida en Francia. Cada episodio se conecta con el anterior e incluye ejercicios practicos. </p><p><br></p><p>Además, tú también formas parte de esta aventura! Conversa conmigo y propon nuevos temas en las redes sociales. Juntos creamos una comunidad apasionada por el idioma y la cultura francesa. </p><p><br></p><p>Bienvenue à Café Francés – on y va !</p><p><br></p><p>Sébas</p>

La Cultureta
By shows
Rubén Amón, Rosa Belmonte, Guillermo Altares, Isabel Vázquez JF León y Sergio del Molino hablan sobre cine, música, libros, series y mucho más...

Espías: clave secreta
By shows
Hay guerras que no aparecen en los libros de historia. Se libran en silencio, en los despachos más discretos y en las calles más concurridas. Sus protagonistas no llevan uniforme. Sus victorias no se celebran. Y sus derrotas, a veces, cambian el mundo. Espías: Clave Secreta es un podcast de Vicente Vallés sobre los hombres y mujeres que operaron en la sombra durante el siglo XX. Topos que pasaron décadas infiltrados en el corazón del enemigo. Operaciones diseñadas para engañar a ejércitos enteros. Traiciones que costaron miles de vidas. Y espías que, en secreto, evitaron una guerra nuclear. Cada episodio, un caso y cada caso una historia que parece imposible y que, sin embargo, ocurrió. Créditos Dirección y guion: Vicente Vallés y Cristina de Juan Narración: Vicente Vallés Diseño de sonido: Andrés Moraleda Una producción de Onda Cero Podcast y Antena 3 Noticias