← SCRAM AI Lab

Comunidad

Esta semana en IA #41: Claude Opus 5, Gemini 3.6 Flash y la batalla del tier de volumen

Edición #41 (24 jul 2026): Anthropic lanzó Claude Opus 5 —casi Fable 5 (la frontera) a la mitad o un tercio del costo, al precio de Opus 4.8— el mismo día que Google sacó Gemini 3.6 Flash como workhorse multimodal. OpenAI liberó GPT-5.6 Sol y retiró GPT-4.5, y la frontera abierta suma a Kimi K2.7, DeepSeek V4 Pro y MiniMax M3. Patrón de julio: la batalla no es por el modelo más potente, sino por el mejor costo/capacidad del tier de volumen.

July 25, 2026

100 lecturas

Esta semana en IA #41: Claude Opus 5, Gemini 3.6 Flash y la batalla del tier de volumen

El titular de la semana

Julio 2026 no se está decidiendo por el modelo más potente, sino por el mejor costo/capacidad. Anthropic lanzó Claude Opus 5 —casi Fable 5, la frontera, a la mitad o un tercio del costo, al precio de Opus 4.8— el mismo 24 de julio que Google sacó Gemini 3.6 Flash como workhorse multimodal. OpenAI liberó GPT-5.6 Sol y retiró GPT-4.5. Y la frontera abierta suma a Kimi K2.7, DeepSeek V4 Pro y MiniMax M3. Cuatro frentes, una misma dirección: quien ofrezca la mejor inteligencia por dólar gana el default del stack.

Anthropic — Claude Opus 5

  • Claude Opus 5 (24 jul, oficial): disponible ese día, default en Claude Max y el más fuerte en Claude Pro. API claude-opus-5 + modo Fast (~2.5x velocidad, 2x precio).
  • Casi Fable 5 a precio Opus: a 0.5% del pico de Fable 5 en CursorBench 3.2 a la mitad del costo; supera a Fable 5 en OSWorld 2.0 a un tercio del costo. Mismo precio que Opus 4.8 ($5/$25 por M tokens) pero más del doble de rendimiento en coding.
  • Reordena el router: la mayoría del tráfico frontera migra de Fable 5 a Opus 5; Fable 5 se reserva para el caso estrecho donde ese último 0.5% sí importa.
  • El modelo más alineado de Anthropic hasta la fecha (2.3 en comportamiento desalineado, el más bajo). Betas: cambio de herramientas a mitad de conversación y fallbacks automáticos en la API.

Google — Gemini 3.6 Flash

  • Gemini 3.6 Flash (21 jul): ~12% más rápido que 3.5 Flash, workhorse para coding, conocimiento y multimodal. Llegó junto a 3.5 Flash-Lite y una variante 3.5 Flash Cyber sólo para gobierno.
  • El Pro se retrasa: el flagship 3.5 Pro sigue en testing; Google ya anticipó Gemini 4 en preentrenamiento.

OpenAI — GPT-5.6 Sol + limpieza de catálogo

  • GPT-5.6 Sol (9 jul): mejoras en coding, research, ciencia, estilo de respuesta y calidad, según las notas de versión oficiales.
  • GPT-4.5 deprecado (26 jun): las conversaciones existentes continúan con GPT-5.5, el default actual de ChatGPT.
  • ChatGPT for Small Business (21 jul): nuevo programa de OpenAI para adopción de IA en PyMEs.

La frontera abierta

  • Ranking open-source julio 2026: GLM-5.2, Kimi K2.7 Code, DeepSeek V4 Pro y MiniMax M3 lideran los pesos abiertos, empatando o superando a cerrados en benchmarks clave.
  • Qwen-Audio-3.0-TTS Plus (Alibaba, 20 jul): la familia Qwen avanza en audio/TTS. Kimi K3 se anticipa como próximo flagship abierto.

La conclusión para quien construye

Si trabajas con IA en producción, el 24 de julio de 2026 deja una lección clara: la batalla del default se libra en costo/capacidad, no en inteligencia bruta. Opus 5 colapsa la distancia entre frontera y tier de trabajo sin subir el precio; Google dobla la apuesta al Flash; OpenAI itera el default y limpia catálogo. Para tu router, mide de nuevo cada tier con tus cargas — Opus 5 para la frontera cotidiana, Gemini 3.6 Flash para multimodal de volumen, GLM-5.2 para contexto masivo — y reserva Fable 5 / el Pro (cuando salga) sólo para lo que de verdad lo necesite.

digest
comunidad
semanal
gemini-3-6-flash
gpt-5-6-sol
glm-5-2
fable-5

Artículos relacionados

Así construimos los chatbots de SCRAM: 4 agentes, un solo cerebro

Radiografía técnica de nuestro propio stack: el bot de ventas del sitio, los dos agentes de soporte y el agente de WhatsApp con voz corren sobre un mismo módulo NestJS con identidades intercambiables, RAG sobre pgvector, herramientas que leen el ERP vivo y un juez LLM que califica cada conversación. Cómo lo construimos, qué reglas nos costaron aprender y por qué creemos que es un ejemplo de cómo se integra IA correctamente desde Latinoamérica.

El EU AI Act ya se aplica: multas de 3% y qué hacer si tu chatbot toca Europa

Desde el 2 de agosto de 2026 la AI Office europea tiene poderes plenos de enforcement sobre modelos GPAI: documentación técnica, evaluaciones, mitigación de riesgo y multas de hasta €15M o 3% del revenue global. Anthropic ya respondió con watermarks invisibles en todos sus outputs. Guía práctica de qué cambia para quien opera chatbots, agentes o APIs de IA que tocan usuarios europeos — incluso desde LatAm.

Esta semana en IA #42: la IA entra en su era regulada

Edición #42 (19 ago 2026): el 2 de agosto se activó el enforcement del EU AI Act para modelos GPAI —multas de hasta €15M o 3% del revenue global— y Anthropic respondió con watermarks invisibles en todos sus outputs. OpenAI previó Ultrafast mode (14x velocidad) para GPT-5.6 Sol, Google convirtió a Gemini en agente autónomo que llama negocios por ti, y la frontera abierta sumó a Kimi K3 (1M de contexto) y GLM-5.3. Agosto no va de modelos nuevos: va de operar IA bajo reglas reales.

← Volver a SCRAM AI Lab