¡Hola! Te escribe Lalo.

Esta semana pasó algo raro. En tres días salieron tres modelos de IA de primer nivel. El martes, xAI soltó Grok 4.5. El miércoles, OpenAI abrió su nueva familia GPT-5.6, que trae tres modelos adentro: Sol, Terra y Luna. Y Anthropic estiró unos días más el acceso a Fable 5, su modelo más potente. Todo en la misma semana.

En Espacio llevamos días probando Fable 5 y, sinceramente, nos ha volado la cabeza. Pero aquí está el detalle que me hizo escribir este newsletter: ninguno de los tres le gana a los otros en todo. Cada uno gana en algo y pierde en otra cosa. Grok es el más barato. GPT-5.6 es rapidísimo y gasta poco. Fable es de los más capaces, pero cuesta caro y el acceso está racionado. Se acabó el “mejor modelo” único.

Entonces la pregunta cambió. Dejó de ser “cuál es el más inteligente” y pasó a ser “cuál me conviene a mí, según lo que hago y lo que quiero gastar”. Hoy te explico qué salió esta semana, por qué de repente todos hablan de precio, y al final te dejo una guía de cuál usar según a lo que te dedicas.

En el newsletter de hoy encontrarás:
💸 Por qué ahora la pelea es por precio, no por potencia
🚀 Los tres modelos que salieron esta semana (y qué hace cada uno)
🖥️ La otra corriente: correr la IA en tu propia máquina
🌎 El acceso a la IA se volvió tema político
🧭 Qué modelo usar según a lo que te dedicas

🔥 La noticia del día

💸 Por qué ahora la pelea es por precio, no por potencia

Durante un par de años, la conversación era una tabla de posiciones. Quién saca el número más alto en tal prueba. Ese juego se está enfriando, y vale la pena entender por qué.

Los modelos cobran por token. Un token es un pedacito de texto, más o menos una sílaba o una palabra corta. Cada vez que le pides algo a un modelo, lee tokens (tu pregunta) y escribe tokens (su respuesta), y pagas por los dos lados. Aquí está el truco: dos modelos pueden resolver la misma tarea, pero uno gasta cuatro veces más tokens que el otro para llegar al mismo lado. El caro no siempre es el que da mejor resultado. A veces es solo el que habla de más.

Un ejemplo concreto de esta semana. En una prueba de programación real (SWE-Bench Pro), Grok 4.5 resolvió cada tarea con unos 15,954 tokens de salida en promedio. Opus 4.8 gastó 67,020 para el mismo trabajo. Más de cuatro veces. Si corres IA a volumen, esa diferencia se convierte en dinero de verdad al final del mes.

Por eso el pitch de todos cambió. Sam Altman le dijo a CNBC que GPT-5.6 Sol es 54% más eficiente en tokens para tareas de programación, y lo resumió en una frase que se le va a quedar a la industria: cada empresa ya está pensando en cuánto gasta y qué recibe a cambio. Ese es el terreno donde se está peleando ahora. No en quién es medio punto más listo, sino en cuánto cuesta terminar el trabajo.

🚀 Los tres modelos que salieron esta semana (y qué hace cada uno)

GPT-5.6, la familia de OpenAI. Lo primero que confunde son los nombres. El número (5.6) es la generación. Sol, Terra y Luna son tres niveles distintos dentro de esa generación, ordenados por costo y velocidad. Sol es el más capaz y caro ($5 por millón de tokens de entrada, $30 de salida). Terra queda en medio ($2.50 y $15). Luna es el más barato y veloz ($1 y $6). La idea es que no mandes todo al modelo caro: usas el que la tarea necesita.

En números, OpenAI presume que Sol le gana a Fable 5 por 13.1 puntos en una prueba de trabajo profesional (Agents’ Last Exam), y que Terra y Luna superan a Fable a una fracción del costo. Pero hay que leer la tabla completa, porque en las propias mediciones de OpenAI, Claude sigue arriba en varias. En programación de repositorio (SWE-Bench Pro), Fable 5 saca cerca de 80% y Sol 64.6%. En el índice general de inteligencia también gana Claude por poco. Traducción: Sol es buenísimo en tareas de agente, velocidad y eficiencia, y Claude sigue liderando en código pesado y trabajo de conocimiento. Depende de para qué.

Grok 4.5, de xAI. Elon Musk lo vendió como un modelo “clase Opus”, pero más rápido, más eficiente y más barato. Ojo con eso, porque él mismo aclaró después que es “roughly comparable to Opus 4.7”, no que le gane al Opus actual. Las mediciones independientes lo confirman: Artificial Analysis lo pone en el lugar #4 de su índice de inteligencia, detrás de Fable 5, GPT-5.5 y Opus 4.8. El verdadero argumento de Grok no es que sea el más listo. Es el precio, $2 y $6 por millón de tokens, y que gasta pocos tokens por tarea. Lo entrenaron junto con Cursor, el editor de código, así que apunta directo a developers. Un detalle: al lanzamiento no llegó a la Unión Europea por temas de regulación.

Fable 5, de Anthropic. Es el modelo más potente del momento en trabajo de conocimiento y razonamiento largo, y está un escalón arriba de la línea Opus. El problema es el acceso. Salió en junio, lo pausaron el 12 de junio por controles de exportación de Estados Unidos, y volvió el 1 de julio. Esta semana Anthropic estiró el acceso incluido en los planes de pago hasta el 12 de julio. Después de eso, seguir usándolo cuesta créditos a $10 por millón de tokens de entrada y $50 de salida, la tarifa más cara que Anthropic ha publicado. Potencia sí, pero con reloj y con precio.

🖥️ La otra corriente: correr la IA en tu propia máquina

Mientras las tres grandes pelean por quién es más eficiente, hay un movimiento creciendo por debajo. Esta semana, Ollama levantó $65 millones de Benchmark, una de las firmas de inversión más respetadas de tech. Ollama es una herramienta de código abierto que te deja descargar y correr modelos (como Llama o Mistral) directo en tu computadora. Sin pagar APIs, sin mandar tus datos a la nube de nadie, sin depender de estar conectado. Ya roza los 9 millones de usuarios.

En esa misma familia está Mistral AI, la empresa francesa que arrancó en 2023 con modelos de pesos abiertos que cualquiera puede usar y adaptar. Es la apuesta europea más seria frente a OpenAI.

Lo interesante no es el monto ni la nacionalidad. Es lo que señala. Hay cada vez más developers y empresas que no quieren depender de OpenAI, Google o Anthropic para cada consulta. La IA local, la que corre en tu propio hardware, está dejando de ser una curiosidad técnica para volverse una opción real. Cuando Benchmark le pone $65 millones a una herramienta de código abierto con esa tracción, es porque huele que ahí va a pasar algo.

Instagram post

🌎 El acceso a la IA se volvió tema político

Antes, la única pregunta era qué tan bueno es el modelo. Ahora hay otra igual de importante: ¿puedes usarlo?

Esta semana Alibaba habría clasificado a Claude Code, el asistente de programación de Anthropic, como software de alto riesgo, y estaría prohibiendo su uso interno. La razón oficial no está confirmada, pero en medio de las tensiones entre China y Estados Unidos, la lectura es bastante clara. Las grandes tecnológicas chinas están eligiendo qué herramientas occidentales toleran y cuáles bloquean.

Del otro lado pasa algo parecido. El lanzamiento de GPT-5.6 no fue libre desde el día uno. OpenAI lo abrió primero a un grupo chico de socios de confianza, a petición del gobierno de Estados Unidos, y Altman contó que trabajaron con Comercio, Tesoro y el director nacional de ciberseguridad en el proceso de aprobación. Grok, ya lo dije, tampoco llegó a Europa por regulación. Y Fable estuvo un par de semanas fuera de línea por controles de exportación.

Hay una capa más, la de la confianza con tus datos. Meta lanzó Muse Image, su nuevo generador de imágenes, y de entrada varios usuarios están rechazando que la empresa use sus fotos para entrenar el modelo. Elegir herramienta ya no es solo mirar qué tan capaz es. Es también geografía, regulación y qué tanto confías en quién la hace.

🧭 Qué modelo usar según a lo que te dedicas

Aquí va lo práctico. No hay respuesta única, pero sí hay lógica.

Si programas para vivir, depende del tipo de código. Para trabajo pesado de repositorio, Fable 5 y los Opus de Claude siguen arriba. Para tareas de agente y terminal, GPT-5.6 Sol es de lo más fuerte. Y si el costo te importa (a casi todos nos importa), Grok 4.5 da una relación precio-rendimiento difícil de ignorar, sobre todo si ya trabajas en Cursor. A volumen alto, los tokens baratos ganan.

Si llevas un negocio u operas un equipo, el error caro es mandar todo al modelo más potente. No lo necesitas para la mayoría de las cosas. Terra, Luna o Grok resuelven el día a día bien y barato. Guarda el modelo caro (Fable, o Sol Pro) para lo verdaderamente difícil. La habilidad nueva no es escoger un modelo, es enrutar: barato para casi todo, caro solo para lo que lo amerita.

Si haces marketing o creas contenido, los modelos de gama media te sobran para escribir, resumir y editar. GPT-5.6 mejoró bastante en armar presentaciones y documentos con buen formato. Para imágenes hay opciones nuevas como Muse Image, aunque ahí ya viste el tema de los datos, así que decide con cuidado.

Si analizas datos o trabajas en finanzas, quieres razonamiento largo y trabajo de conocimiento. Ahí Claude lidera varias de las pruebas, y GPT-5.6 Sol es una alternativa rápida y sólida. Prueba los dos con tus propios casos antes de casarte con uno.

Y si te importa la privacidad o el presupuesto es apretado, la IA local es tu amiga. Con Ollama corres Mistral o Llama en tu propia máquina, tus datos no salen de ahí y no pagas por consulta. El costo es que no vas a tener la potencia de los modelos de frontera y necesitas hardware decente. Para muchas tareas, alcanza y sobra.

Mi consejo, y es lo que hacemos en Espacio: no te cases con una marca. Escoge según la tarea, prueba con tus propios casos y vuelve a revisar en un mes, porque para entonces ya cambió otra vez. xAI ya dijo que planea sacar un modelo nuevo cada mes hasta que termine el año. Esto no se va a calmar.

Fuentes

📺 Antes de que te vayas

Antes de que te vayas, dime si te pasa esto. Yo tenía el calendario en un lado, el correo en otro, los pendientes en una libreta y los hábitos que quería mejorar en otra app más. Todo regado. Me harté y construí una sola aplicación donde tengo todo junto.

Lo grabé en el episodio #001 de Mejorando mi vida con IA, el primero de una serie donde uso IA para resolver cosas reales del día a día. Si te gusta, síguenos y déjale un like, que apenas es el capítulo uno y vienen más.

Eso es todo por hoy.

Seguir leyendo