21 junio 2026

¿El fin de la Inteligencia Artificial en la nube?

Ayer me encontré con un video que se llamaba ¿El fin de la IA en la nube? lo vi cuidadosamente y la verdad es que no entendí absolutamente nada, lo volví a ver y lo mismo, es como si el tipo estuviese hablando en chino.

Entonces me di cuenta que, pese a que estoy usando bastante IA -principalmente a Gemini- no tengo la menor idea de como funciona, ni siquiera en su nivel más general. 

Por esas cosas de la vida tuve que aprender a usar criptografía hace años sin tener idea de cómo funcionaba y eso me molestaba mucho, hasta que me puse a estudiar el asunto y -aunque no soy un experto en el tema- aprendí todo lo más importante como para poder usarlo bien.

La cosa es que volví a ver el maldito video y como otra vez no entendí nada, se me ocurrió preguntarle a la propia IA de Gemini para que me aclarara la cosa, así es que le pregunté:

Estaba viendo sobre hardware de AMD y Nvidia que permite usar modelos de IA "localmente" ¿con eso podría usar Gemini sin estar conectado a Internet? ¿Cómo es eso posible? La respuesta fue:

"¡Es una excelente pregunta! Es genial ver que estás explorando el hardware actual, porque el salto tecnológico en los últimos años ha sido enorme (...)

No es posible usar la versión completa de Gemini en forma local, sin estar conectado a Internet : "El Gemini que usas habitualmente (como esta versión con la que estás hablando) es un Modelo de Lenguaje Grande (LLM) colosal.

El tamaño importa: Estos modelos tienen cientos de miles de millones de parámetros. Para que te hagas una idea, ejecutarlos requiere servidores gigantescos en la nube con múltiples tarjetas gráficas industriales trabajando en paralelo y consumiendo miles de vatios de energía. Una PC de escritorio, por más potente que sea su tarjeta AMD o Nvidia, no tiene la memoria RAM ni la capacidad de almacenamiento para procesar semejante monstruo.

Existe una excepción móvil: Google desarrolló una variante extremadamente recortada llamada Gemini Nano, diseñada específicamente para correr de forma local y sin internet en algunos teléfonos móviles modernos (como los Pixel o ciertos Samsung). Sin embargo, está muy limitada a tareas básicas como resumir textos cortos o respuestas inteligentes, y no está disponible para computadoras de escritorio".

Mi siguiente duda fue: Entonces, ¿para qué sirve el hardware de AMD y Nvidia con IA local? (lo que el tipo del video aseguraba que era "el fin de la IA en la nube") la respuesta fue:

"Cuando AMD (con sus procesadores Ryzen con IA o tarjetas Radeon) y Nvidia (con sus tarjetas RTX y los núcleos Tensor) promocionan la "IA local", se refieren a dos cosas:

1. Ejecutar Modelos de Código Abierto (Open Source)
Aunque no puedas correr Gemini, sí puedes correr otros modelos de IA excelentes y completamente gratis en tu PC sin tocar internet. Existen modelos diseñados específicamente para ser compactos pero muy eficientes. Algunos de los más conocidos son:

Llama (de Meta/Facebook)
Mistral / Mixtral
Gemma (que es, curiosamente, un modelo de código abierto creado por Google, hermano menor de Gemini).

Para usarlos de forma local y privada, la gente utiliza programas gratuitos y muy fáciles de instalar como Ollama, LM Studio o la herramienta ChatRTX de Nvidia.

2. Aceleración de tareas cotidianas
Tener este hardware en tu PC permite que ciertos programas de software tradicionales funcionen de manera inteligente y ultra rápida sin enviar datos a la nube:

Edición de foto y video: Funciones en Photoshop o Premiere como borrar objetos de fondo al instante, mejorar la resolución de una imagen vieja (Upscaling) o aislar la voz en un audio con ruido de fondo.

Videojuegos (Nvidia DLSS / AMD FSR): Usar IA para "inventar" píxeles y fotogramas en tiempo real, haciendo que un juego se vea en 4K y corra fluido aunque la tarjeta gráfica esté haciendo la mitad del esfuerzo tradicional".

Hace unos años esto era impensable, pero hoy es posible gracias a dos factores: Nuevo hardware especializado para IA y compresión inteligente de los modelos. Entonces pregunté:

Habitualmente uso IA para buscar y resumir información que está muy dispersa en Internet ¿entiendo que para eso no me serviría una IA en modo local? La respuesta fue

"Comprendes perfectamente. Para ese flujo de trabajo en específico, una IA local no te serviría de mucho y se quedaría muy corta en comparación con lo que estás acostumbrado a hacer.

La razón es muy sencilla: las IA locales están completamente desconectadas de la red. Aquí te detallo por qué para tu caso es imprescindible seguir usando la nube:

1. El problema del acceso a la información en tiempo real
Cuando usas una IA en la nube para buscar y resumir, el sistema no solo depende de lo que "sabe", sino que tiene la capacidad de salir a internet, rastrear docenas de páginas web, leer noticias de ayer o de hace cinco minutos, comparar las fuentes y armarte un resumen limpio.

Una IA local solo sabe lo que se incluyó en su archivo de entrenamiento. Si se entrenó en 2025, no tiene la más mínima idea de lo que pasó hoy. No puede hacer clic en un enlace ni "navegar" para buscar información dispersa.

2. La capacidad de procesamiento de texto (Context Window)
Buscar en múltiples sitios web y resumirlos implica procesar una cantidad enorme de texto (miles o decenas de miles de palabras a la vez).

Las IA en la nube cuentan con memorias de contexto gigantescas sostenidas por supercomputadoras, lo que les permite "leer" libros enteros o decenas de artículos largos simultáneamente para extraer lo importante.

Las IA locales están limitadas por la memoria RAM o VRAM (de la tarjeta de video) de tu PC. Si le introduces demasiada información de golpe para que la resuma, el sistema se quedará sin memoria ("Out of Memory") o empezará a olvidar los primeros párrafos que leyó.

La única excepción: Resumir archivos que tú ya descargaste
El único escenario donde una IA local te serviría para resumir es si tú haces el trabajo previo de buscar y descargar la información.

Si descargas tres o cuatro documentos PDF largos, carpetas de texto o manuales pesados a tu disco duro, puedes usar herramientas locales (como ChatRTX de Nvidia o Ollama) para apuntar la IA hacia esa carpeta. Ahí la IA local leerá tus archivos privados y te armará resúmenes de forma 100% privada, rápida y sin gastar internet.

En conclusión: Para investigación, rastreo de datos dispersos en la web y actualidad, las IA conectadas a la nube (como Gemini o el buscador con IA) siguen siendo imbatibles. La IA local es maravillosa para la privacidad y para trabajar con material que ya tienes en tu poder, pero no para "explorar" el mundo exterior."

Enseguida pensé en la aplicación -o como le llamen- NotebookLM de Google y pregunté 

¿El modo local de estas IA funcionaría como los cuadernos de NotebookLM? La respuesta fue

"¡Exactamente! Has dado en el clavo con la analogía perfecta. El concepto es exactamente el mismo, pero con una diferencia clave en "dónde" ocurre la magia.

Si usas herramientas locales como ChatRTX de Nvidia o programas conectados a modelos locales (como LM Studio o AnythingLLM), el funcionamiento es idéntico al de los cuadernos de NotebookLM"

¿Qué mejor que aprender sobre la IA usando la IA?
Resulta que de esta conversación cortita aprendí algunas cosas fundamentales sobre la diferencia entre usar modelos de lenguaje que están en la nube y modelos que pueden usarse almacenados localmente, sin conexión a Internet.

Cualquier modelo local es muchísimo menos poderoso que uno que funciona en la nube, por definición, y si bien puede servir para procesar imágenes, mejorar videojuegos y tal vez escribir código y cosas así, pero nada más. Para cualquier necesidad sofisticada es necesario usar el modelo en la nube,

Y ahora entiendo mejor de que se trata la IA normal y los modelos de código abierto como esos "fabulosos" modelos chinos que supuestamente van a terminar con todos los demás. 

Eso es pura propaganda, el video que vi es mentiroso de principio a fin, porque trata de vender una bicicleta como si fuese un auto de Fórmula 1, pura desinformación, y está repleto de videos que aseguran lo mismo en Youtube, es una campaña .

Con razón me quebraba la cabeza cada vez que veía algún video sobre todos estos "revolucionarios inventos que van a dejar obsoleta a toda la industria", pensando cómo diablos sería posible lo que ofrecen.

Resulta que no es posible, es mentira, propaganda, porque la IA en modo local es un pequeñísimo subconjunto de lo que es la verdadera IA, que necesariamente debe estar en la nube, por la cantidad de recursos que necesita. 

Yo pensaba que en la política era donde se mentía de la manera más descarada, pero en tecnología se está haciendo lo mismo. Como es tan grande la danza de millones en torno a tecnologías nuevas -la mayoría son puro humo- es necesario tener a un ejército de mentirosos inundando las redes.

Ha pasado con la energía fotovoltaica, con los autos eléctricos y ahora con la Inteligencia Artificial ¡no hay salud!

P.D. Keiko Fujimori presidente del Perú. Abelardo de la Espriella en Colombia, José Antonio Kast en Chile, Rodrigo Paz en Bolivia, Javier Miley en Argentina, Daniel Noboa en Ecuador ¿quien sigue? Yo espero que Luis Ignacio da Silva y Claudia Sheimbaun sean los próximos descabezados, con esos dos me conformo.

13 comentarios:

  1. trata de correr openclaw en tu pc, es tedioso , pero si manejas linux sera pan comido, es bueno, atte Pedro

    ResponderBorrar
    Respuestas
    1. Hola Pedro yantas lunas! por lo que he visto el openclaw es una especie de asistente personal para los chat y cosas así, claro es una aplicación especial para funcionar en modo local pero aunque trabaja de manera muy inteligente no es muy IA que digamos.

      Yo lo conozco solo por reseñas porque nunca me acostumbré a usar asistentes, ni siquiera uso el calendario o el Outlook, menos la agenda. Si tengo que recordar alguna cosa la anoto en una libretita de taquigrafía que tengo ¡super moderno jaja!

      Borrar
  2. La última noticia que escuché del tema: Anthropic - pero las otras empresas harìan lo mismo - compra grandes lotes de libros viejos, stocks que las cadenas de librerìas no pueden colocar ya, los despanzurran y scanean, todo para entrenar la IA. Les interesa que sean viejos para que no haya temas de propiedad intelectual reclamables. La IA vendrá nutrida de literatura como la decimonónica o los clásicos, pues.
    Gran alegría que el batracio de Petro se haya terminado y de su legado, nada. Uls

    ResponderBorrar
    Respuestas
    1. ¿Sera cierto que están escaneando libros? Yo pensé que eso lo podían hacer de manera masiva solo los mormones, que tienen cientos de miles de "voluntarios" por todo el mundo, tal vez un par de millones...

      Escanear es un trabajo lento y tedioso que requiere de mucha mano de obra, incluso con esas máquinas que dan vuelta las páginas automáticamente, son muchas horas.hombre. Yo creo que todas las obras clásicas ya están en Internet (proyecto Gutemberg, The Internet Archive y sitios así) pero quien lo sabe, están pasando cosas tan locas que todo es posible. Vivimos en la Dimensión Desconocida.

      ¡BATRACIO! Que buen sobrenombre, es cuestión de mirarlo, un verdadero sapo. Ahora le toca al corrupto Lula, con Sheinbaum tengo menos esperanzas, no tengo mucha fe en el criterio del electorado mexicano, pero ojalá que despierten de una vez.

      Borrar
  3. Esperemos que Vance y Rubio no dejen que tu admirado Trump se olvide de Cuba , o todo empezara rapidamente de nuevo. Queda poco de aca a noviembre, despues es una incognita, los gringos son mas raros que culebra con orejas.

    ResponderBorrar
    Respuestas
    1. No creo que mi admirado Trump pueda hacer mucho por Cuba, pero no veo ninguna posibilidad que el régimen castrista resucite, hoy es un zombie, un hombre muerto caminando y va a caer independientemente de lo que haga o deje de hacer Trump, que dicho sea de paso, lo único que parece capaz es de hablar estupideces.

      Borrar
  4. Una cosa que odio de la IA es que sus respuestas sean tan salameras. “¡Excelente pregunta!”, “¡Diste en el clavo!”, “¡Eso lo aclara todo!” y otras por el estilo me dan alergia.

    Habremos dado un gran paso adelante cuando la IA comience a dar respuestas tipo “No es así”, “Eso es incorrecto” o un buen “Pero cómo se te ocurre tamaña estupidez” ;-)

    Saludos,
    El Triministro.

    ResponderBorrar
    Respuestas
    1. Eso es imposible por diseño, acuérdate que los modelos de lenguaje compiten por popularidad, eso determina en buena parte la cuota de mercado que agarran así es que son entrenados para ser extremadamente amables, sobajeros y jamás discutir o llevar la contra. Muchas veces nos olvidamos que todo esto es en el fondo un gugantesco negocio, la IA es siempre diseñada para complacer.

      Borrar
    2. Hablaba más en broma que en serio, pero es verdad que la lisonja me molesta y me hace desconfiar, tanto en la IA como con cualquier persona. La percibo como falsedad, así que sospecho que hay segundas intenciones.

      Cuando me sobajean mucho, automáticamente me toco el bolsillo, para ver si mi billetera sigue ahí…

      Saludos,
      El Triministro.

      Borrar
    3. "no es un bug, es una característica" :D :D

      Borrar
  5. Buen artículo, el vídeo que le recomiendo a todos es el de Nate Gentile, creo explica todo y fácil: https://www.youtube.com/watch?v=FdZ8LKiJBhQ al final hace 3 años la potencia de un LLM dependia de la cantidad de información entrenada, ahora es más complicado.

    Y sobre OpenClaw y los agentes, creo que esta es la verdadera revolución de la IA, eso si tambien la limitación al usar API y su debido coste y correrla en un servidor. Tambien N. Gentile tiene 2 buenos vídeos sobre el tema: https://www.youtube.com/watch?v=_wAHiARD9GI y https://www.youtube.com/watch?v=OcvvmdwpPMA

    ResponderBorrar
  6. Don Tomás,
    ¿Qué opina de la visión de "Mark" que salió ayer... sobre la IA?
    "Mark"

    ResponderBorrar
    Respuestas
    1. Le di un vistazo. Hay que tomar con pinzas lo que dice la gente de Meta, Musk, Google y demás sobre "el futuro". Yo prefiero ni leerlos en realidad, porque son partes incumbentes y tienen gigantescos intereses en el asunto

      Borrar

"Send me a postcard, drop me a line
Stating point of view
Indicate precisely what you mean to say
Yours sincerely, wasting away
Give me your answer, fill in a form
Mine for evermore
Will you still need me, will you still feed me
When I'm sixty-four"