← SCRAM AI Lab

Comunidad

Esta semana en IA #45: Opus 5.5, Sonnet 5.5, GPT-6.1 Sol y Gemini 4 Argon, todos en tres semanas

Edición #45: cuatro modelos en nueve días y tres laboratorios con el mismo precio, $2/$10. Además: dots de OpenAI, Claude Marketplace y mods en Claude Code.

October 6, 2026

14 lecturas

Esta semana en IA #45: Opus 5.5, Sonnet 5.5, GPT-6.1 Sol y Gemini 4 Argon, todos en tres semanas

El titular de estas tres semanas

Entre el 22 y el 30 de septiembre salieron cuatro modelos de frontera: Claude Opus 5.5, Claude Sonnet 5.5, GPT-6.1 Sol y Gemini 4 Argon. Lo que más importa para quien paga la factura no es ningún benchmark, sino una coincidencia: Anthropic, OpenAI y Google pusieron su modelo de trabajo diario en el mismo precio, $2 por millón de tokens de entrada y $10 de salida. A principios de septiembre de 2026 ese nivel de capacidad costaba entre dos y cinco veces más. Esta edición cubre del 15 de septiembre al 6 de octubre, porque desde la edición #44, del 14 de septiembre, no habíamos publicado digest.

¿Cuánto cuestan los modelos nuevos?

Sonnet 5.5, GPT-6.1 Sol y Gemini 4 Argon (este con precio de introducción) cuestan $2 por millón de tokens de entrada y $10 de salida; Opus 5.5 cuesta $4 y $20. La diferencia real está en la caché y en cuándo sube el precio de Argon. Precios por millón de tokens, tomados de las páginas oficiales de Anthropic, OpenAI y Google:

ModeloFechaEntrada (USD/M)Caché (USD/M)Salida (USD/M)
Claude Sonnet 5.528 sep$2$0.20$10
GPT-6.1 Sol29 sep$2$0.10$10
Gemini 4 Argon (introducción)30 sep$295% menos que la entrada$10
Claude Opus 5.522 sep$4$0.20$20
Gemini 4 Argon (después de la introducción)Sin fecha$4—$20
GPT-6 Astra (referencia)4 sep$10$1$50

Ojo con dos letras chicas. Argon todavía no está abierto a todos: hoy lo usan defensores de ciberseguridad aprobados y después llegará a clientes de pago de la API. Y el precio de introducción de Argon sube al doble sin fecha anunciada, igual que pasó con Gemini 3.8 Flash.

Anthropic: dos modelos y un mercado

  • Claude Opus 5.5 (22 sep): $4/$20, 40% menos que Opus 5 en cargas típicas según Anthropic, 1M de contexto y 128K de salida. Terminal-Bench 4.0 sube de 52.3% a 66.4%. El pensamiento adaptativo ya no se puede apagar. Lo analizamos en Opus 5.5 y Sonnet 5.5: qué cambia.
  • Claude Sonnet 5.5 (28 sep): $2/$10 y 70.6% en Terminal-Bench 4.0, por encima de Opus 5.5. Es el nuevo modelo Sonnet por defecto en la API.
  • Sonnet 4.5 se retira el 30 de noviembre, según las notas de versión. Si tienes integraciones con claude-sonnet-4-5-20250929, ya tienes fecha.
  • Claude Marketplace (23 sep): más de 2,000 conectores y plugins, agentes de terceros y consultoras, y la opción de pagarlos con el gasto ya comprometido con Anthropic (anuncio).
  • Cowork y el chat ahora son un solo Claude (16 sep), con Claude Docs y Claude Slides dentro de la conversación; y Projects se rediseñó el 17 de septiembre: un coordinador reparte el trabajo en hilos paralelos con memoria compartida, en beta para Pro y Max.
  • Claude for Government llegó a disponibilidad general el 30 de septiembre, y el 28 NVIDIA presentó con Anthropic su Open Agent Safety Platform: credenciales en bóveda que el agente nunca ve y OpenShell, de código abierto bajo Apache 2.0, para empezar con permisos mínimos.
  • Claude Frontier Academy (2 oct): $100 millones para formar 10,000 ingenieros de despliegue antes de terminar 2027. Las primeras cohortes son en San Francisco, Nueva York y Londres, por nominación (Anthropic). Para Latinoamérica todavía no hay fecha.

¿Qué presentó OpenAI en DevDay?

El 29 de septiembre OpenAI presentó en DevDay un modelo de trabajo diario a $2/$10, agentes que trabajan todo el día dentro de ChatGPT, una velocidad premium para Astra y uso de computadora en su API de agentes. Los anuncios que afectan a una empresa:

  • GPT-6.1 Sol: $2/$10 en la API, con caché a $0.10, una quinta parte del precio de Astra (changelog oficial).
  • Dots: agentes que corren todo el día dentro de ChatGPT, con su propia computadora y navegador en la nube y acceso a más de 4,000 apps. Solo en Pro y Business Premium; el primero va incluido en el plan, reporta BetaNews.
  • Ultrafast para GPT-6 Astra: $60 de entrada y $300 de salida por millón, seis veces el precio normal.
  • Uso de computadora en la Agents API: los agentes trabajan en un navegador alojado por OpenAI y tu aplicación aprueba los sitios y los inicios de sesión.
  • OpenAI dijo que por ahora no lanzará GPT-6.1 Astra, citando preocupaciones de seguridad, según The Next Web.

Dos datos que no salieron en el escenario: el 22 de septiembre llegaron GPT-6 Sol y GPT-6 Luna a la API, y el 5 de octubre las organizaciones elegibles ya pueden aceptar el acuerdo HIPAA (BAA) desde la configuración de la plataforma. Más detalle en nuestro resumen de DevDay.

Google: Argon y menos modelos gratis

  • Gemini 4 Argon (30 sep): primer modelo de la familia Gemini 4, con 1 millón de tokens de salida (antes 64K) y 77.9% en DeepSWE v1.1. Lo explicamos en Gemini 4 Argon: qué es y quién lo puede usar.
  • Desde el 9 de octubre, quien use la app de Gemini sin suscripción solo tendrá Flash-Lite; AI Plus pierde Pro; AI Pro gana Deep Think, reporta 9to5Google. La app sumará niveles de esfuerzo bajo, medio y alto por modelo.

Claude Code: de 2.1.272 a 2.1.291

Veinte versiones en tres semanas. Lo que conviene saber, según el changelog oficial:

  • 2.1.277 (18 sep): si un proyecto no tiene CLAUDE.md, lee AGENTS.md.
  • 2.1.280 (22 sep): Opus 5.5 es el Opus por defecto, y los planes Pro y Team Standard pasan de Sonnet a Opus como modelo por defecto.
  • 2.1.283 (25 sep): deniedModels y availableModelsMatch para que un modelo nuevo no entre sin que el administrador lo apruebe.
  • 2.1.285 (29 sep): allowedProviders limita a qué proveedores de API se puede conectar una máquina.
  • 2.1.287 (1 oct): llegan los mods, funciones en TypeScript que cambian cómo se comporta Claude Code. Le dedicamos un artículo.

La frontera abierta

El 17 de septiembre el CAISI del NIST publicó su evaluación de GLM-5.3 de Z.ai: es el modelo abierto con más capacidad ofensiva en ciberseguridad hasta hoy, pero va unos cuatro meses detrás de los modelos de Estados Unidos. En SEC-Bench Pro resolvió 40.4% de las tareas, contra 90.2% del mejor modelo estadounidense (NIST).

En SCRAM

Este mes pusimos a trabajar a la IA en tres lugares de la operación: una recepcionista de voz en el conmutador de la oficina, seguimientos comerciales que se registran solos a partir de las cotizaciones del ERP y un freno que pausa un envío de correo cuando la entregabilidad se cae. Lo contamos con cifras en tres cosas que la IA ya hace sola en SCRAM.

Agenda

FechaQué pasa
9 octLa app de Gemini gratuita queda solo con Flash-Lite
30 novAnthropic retira Claude Sonnet 4.5
Sin fechaGemini 4 Argon para clientes de pago de la API y AI Ultra

Qué haríamos en tu lugar

Si hoy pagas Opus 5 o Sonnet 5 para trabajo de volumen, prueba Sonnet 5.5 esta semana: cuesta menos y, según Anthropic, rinde más que Sonnet 5 y en terminal incluso más que Opus 5.5. Antes de cambiar de modelo, revisa los cambios de API (el pensamiento ya no se apaga igual y algunos valores de tool_choice devuelven error). Y si tu empresa ya tiene tres proveedores con el mismo precio, la pregunta dejó de ser cuál es más barato: es cuál se equivoca menos en tus tareas. Eso solo se responde midiendo con tus datos, como explicamos en cómo evaluamos un modelo nuevo.

digest
anthropic
claude
openai
gpt-6
google
gemini
claude-code
precios
open-weight
← Volver a SCRAM AI Lab