SCRAM AI Lab

Patrones reales de
Claude Code
para devs en producción

Hub editorial en español sobre Claude, Gemini, GPT y GLM — y el stack que de verdad usamos: MCPs, pgvector, multi-modelo routing, observability. Sin tutoriales 101. Solo patrones que aguantan en producción.

0

categorías

0+

herramientas

0+

artículos

scram_ai_lab — neural_engine

LIVE — SCRAM AI Engine

GLM-5.2 (Z.ai): 1M tokens de contexto sin pérdida para agentes de coding//

Claude Fable 5 redeploy global con salvaguardas reforzadas de ciberseguridad//

Claude Mythos: el modelo más potente de Anthropic, un salto de capacidad//

Claude Sonnet 5 es ahora el modelo por defecto de Anthropic//

Claude Opus 4.1 retirado el 15 de junio — migra a la generación 5//

Claude Code: filesystem isolation + session resume para sesiones largas//

GLM-4.6 (Z.ai): 357B open-weight que rivaliza con modelos cerrados//

Sakana Fugu orquesta modelos frontera como un solo foundation model//

Modelos abiertos (DeepSeek V4, Qwen 3.7, GLM-4.6) cierran la brecha//

NVIDIA Vera Rubin: 10x menos costo de inferencia vs Blackwell//

MCP, estándar de facto: OpenAI, Google y Mistral lo soportan//

GLM-5.2 (Z.ai): 1M tokens de contexto sin pérdida para agentes de coding//

Claude Fable 5 redeploy global con salvaguardas reforzadas de ciberseguridad//

Claude Mythos: el modelo más potente de Anthropic, un salto de capacidad//

Claude Sonnet 5 es ahora el modelo por defecto de Anthropic//

Claude Opus 4.1 retirado el 15 de junio — migra a la generación 5//

Claude Code: filesystem isolation + session resume para sesiones largas//

GLM-4.6 (Z.ai): 357B open-weight que rivaliza con modelos cerrados//

Sakana Fugu orquesta modelos frontera como un solo foundation model//

Modelos abiertos (DeepSeek V4, Qwen 3.7, GLM-4.6) cierran la brecha//

NVIDIA Vera Rubin: 10x menos costo de inferencia vs Blackwell//

MCP, estándar de facto: OpenAI, Google y Mistral lo soportan//

// edición #41 · 24 Jul 2026 · 8 min

Esta semana en IA

Claude Opus 5, Gemini 3.6 Flash y la batalla del tier de volumen

Esta semana: Anthropic lanzó Claude Opus 5 —casi Fable 5 (la frontera) a la mitad o un tercio del costo, al precio de Opus 4.8— el mismo día que Google sacó Gemini 3.6 Flash como workhorse multimodal. OpenAI liberó GPT-5.6 Sol y retiró GPT-4.5. Y la frontera abierta suma a Kimi K2.7, DeepSeek V4 Pro y MiniMax M3. La conclusión: julio no se decide por el modelo más potente, sino por el mejor costo/capacidad.

  • Claude Opus 5 (24 jul, oficial): casi Fable 5 a mitad/tercio de costo, +2x coding vs Opus 4.8, al mismo precio

  • Gemini 3.6 Flash (Google, 21 jul): ~12% más rápido, workhorse para coding/conocimiento/multimodal

  • GPT-5.6 Sol (OpenAI, 9 jul): mejoras en coding, research y ciencia; GPT-4.5 fue retirado (26 jun)

  • Open weight: Kimi K2.7 Code, DeepSeek V4 Pro y MiniMax M3 cierran la brecha con los cerrados

  • Patrón de julio: la batalla del default se libra en costo/capacidad, no en inteligencia bruta

Todos

Últimos artículos

cargando artículos...

// Lo que estamos leyendo

Links curados, sin las cinco páginas de SEO antes del contenido

anthropic.com

Claude Fable 5 — la generación 5 llega global

Tras meses de acceso restringido, Fable 5 se redeployó con salvaguardas reforzadas. Lo relevante no es el hype: un modelo con esta autonomía exige gobernanza real antes de ver producción.

claude

z.ai

GLM-5.2: Built for Long-Horizon Tasks

1M tokens de contexto sin pérdida y dos niveles de thinking. El caso real: codebases enormes en una sola pasada. Si tu carga es coding de larga duración, GLM compite de tú a tú con los cerrados.

glm

claude.com

Introducing dynamic workflows in Claude Code

Claude escribe el script de orquestación y un runtime corre cientos de subagentes en background. El contexto solo guarda la respuesta final — ese es el truco.

agents

blog.google

Gemini 3: el modelo de IA más reciente de Google

Gemini 3 + el rebranding de Vertex AI a Gemini Enterprise Agent Platform. Google dejó de vender modelos y empezó a vender la plataforma de agentes.

gemini

modelcontextprotocol.io

MCP — adopción multi-vendor

OpenAI, Google y Mistral ya lo soportan. Si construyes MCPs hoy, son portables a cualquier cliente — incluido GLM. Esta es la decisión de arquitectura que sí importa.

mcp

// Categorías

Cinco frentes, una sola disciplina

Cubrimos exactamente lo que usamos en producción todos los días. Si no lo corremos sobre 94 contenedores en GCP, no entra al lab.

Claude Code & Agentes

Skills, MCPs, hooks, multiagent

  • Skill design + hooks que sustituyen 80% de validaciones
  • MCPs propios: cuándo construir vs adoptar
  • Multiagent orchestration y dreaming memory
  • Routines: workflows programados por evento o cron

Multi-modelo & Routing

Claude · Gemini · GPT · GLM en producción

  • Tier-based AI router (cost-aware fallback)
  • GLM-5.2 de Z.ai: cuándo un modelo open-weight de 1M gana
  • Defensa contra prompt injection — scoring
  • Circuit breaker + retry exponencial para LLMs

AI-Native SaaS

Next + Nest + Prisma + pgvector

  • pgvector para RAG en producción mexicana
  • NL-to-SQL con Prisma — patrón 2-pass
  • Lead scoring por factores ponderados sin ML pesado
  • AI nudges automáticos sobre datos del CRM
🇲🇽

Integraciones México

Bind ERP · GLPI · INEGI · SAT

  • Bind ERP como MCP server — caso AWALAB
  • INEGI BIE/DENUE para context grounding
  • Migración Mautic → CRM propio sin downtime
  • RPA REPSE/IMSS con Playwright undetected

Infra & Observability

Docker · Grafana · Loki · OTel

  • Soft limits en GCP — por qué nunca hard limits
  • Loki + Grafana para logs de chatbot
  • OpenTelemetry tracing para pipelines LLM
  • Traefik v2.10 con auto-renewal para 94 containers

// Novedades del ecosistema IA

Lo que se movió esta semana en IA — sin spam de marketing

Releases, papers y movimientos que sí importan para construir con IA en producción. Cuatro ecosistemas, mismo criterio editorial: si no cambia cómo armas tu stack mañana, no entra.

Releases de Claude Code, modelos y la plataforma Anthropic.

Opus 5

24 Jul 2026

Inteligencia casi Fable 5 a precio de Opus

Claude Opus 5 llegó el 24 de julio al mismo precio que Opus 4.8 ($5/$25 por M tokens). Queda a 0.5% del pico de Fable 5 en CursorBench a la mitad del costo y supera a Fable 5 en OSWorld a un tercio. Reordena el router: la frontera cotidiana migra de Fable 5 a Opus 5.

Modelo

1 Jul 2026

Claude Fable 5 redeploy global

Tras meses de acceso restringido por preocupaciones de ciberseguridad, Anthropic redeployó Fable 5 a nivel global con salvaguardas reforzadas. La generación 5 consolida el salto hacia modelos agénticos de mayor autonomía.

Frontera

Jun 2026

Claude Mythos: el modelo más potente de Anthropic

La familia Mythos representa un «step change» en capacidad según Anthropic — el modelo más capaz que han construido. Tras revisión regulatoria y una versión «safe», llegó a empresas seleccionadas.

Default

Jun 2026

Claude Sonnet 5 es el modelo por defecto

Sonnet 5 reemplaza a la generación 4.x como default: más rápido y barato que Opus. Hay reportes de un trade-off de eficiencia de tokens en casos agénticos — conviene medir antes de escalar.

Deprecación

15 Jun 2026

Claude Opus 4.1 retirado

Opus 4.1 fue dado de baja el 15 de junio de 2026. Quien opera sobre la 4.x debe migrar a la generación 5 (Fable 5 / Sonnet 5) o sostenerse en Opus 4.7/4.8 mientras dure la ventana.

Claude Code

Jul 2026

Filesystem isolation + session resume

Claude Code estrenó filesystem isolation controls, mejor performance en sesiones largas y un session resume más robusto. Pensado para agentes que sostienen trabajo de varias horas.