← SCRAM AI Lab
El ranking open-weight se reordenó en tres semanas: Kimi K3 (Moonshot, 27 jul) lidera como todo-terreno con 2.8T de parámetros, 1M de contexto y 88.3 en Terminal-Bench 2.1; Z.ai lanzó GLM-5.3 el 14 de agosto con post-training escalado; y DeepSeek V4-Flash queda a 2.3 puntos de Opus 4.8 costando $0.14/$0.28 por millón de tokens. Análisis de cuál conviene según tu carga — y qué licencia trae cada uno.
August 19, 2026
24 lecturas

Entre el 27 de julio y el 14 de agosto de 2026, la frontera open-weight cambió de líder dos veces. El estado al 19 de agosto: Kimi K3 es el mejor todo-terreno abierto, GLM-5.2/5.3 el más fuerte bajo licencia MIT plana, y DeepSeek V4-Flash el piso de costo para API hosteada.
Z.ai publicó GLM-5.3 el 14 de agosto: la misma base que GLM-5.2 con post-training escalado. La familia GLM mantiene sus dos cartas fuertes: 1M de contexto sin pérdida (desde 5.2) y agentes de coding de larga duración. GLM-5.2 sigue siendo el modelo más fuerte bajo licencia MIT plana (62.1% SWE-bench Pro) — sin gates comerciales de ningún tipo, lo que importa si tu asesoría legal es alérgica a licencias custom.
Para quien necesita correr en una sola GPU, Qwen3.6-27B alcanza 77.2% en benchmarks de coding con un modelo denso de 27B — el mejor ratio capacidad/VRAM del momento para inferencia local seria.
La conversación de 2025 era "¿los abiertos alcanzarán a los cerrados?". La de agosto 2026 es otra: a qué costo por token quieres capacidad casi-frontera, y con qué licencia. Para presupuesto y soberanía de datos, el cómputo propio no solo compite — en varias cargas ya gana.
Artículos relacionados
GLM-5.2: la apuesta de Z.ai por 1M de contexto para agentes de coding
Z.ai lanzó GLM-5.2 el 13 de junio de 2026: contexto extendido de 200K a 1M tokens sin pérdida y dos niveles de thinking effort. Pensado para codebases enormes en una sola pasada. Aquí qué cambia para quien enruta varios modelos en producción.
Sakana Fugu: orquestar modelos frontera como un solo modelo
Sakana AI lanzó Fugu (jun 2026): un foundation model que enruta cada tarea al mejor LLM de un pool intercambiable. Fugu Ultra rivaliza con Fable 5. Qué cambia para quien construye sistemas multi-modelo.
RPA REPSE/IMSS con Playwright + undetected-chromedriver
Los portales SAT/IMSS detectan headless browsers. Combinación ganadora: undetected-chromedriver para Python + Playwright para flow control. 2captcha y nunca almacenar credenciales del cliente.