El Pulso del 4 de julio de 2026
Las señales que entraron en el radar, ordenadas con sus fuentes y contexto para entender qué cambió.
El guion de audio está listo; la voz se publicará cuando termine la generación.
Preview de GPT-5.6 Sol y nuevo esquema de tiers (Sol / Terra / Luna)
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Esto es más grande que un salto de modelo. OpenAI está rearmando el catálogo alrededor de tiers de capacidad pensados para durar, y además empuja el framing de “ultra mode” y subagentes, salvaguardas cibernéticas más fuertes y un proceso de lanzamiento gradual con mirada gubernamental.
GeneBench-Pro: el nuevo benchmark de OpenAI para juicio científico, no solo coding
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Es oro upstream porque apunta a dónde los labs creen que está el próximo foso competitivo: análisis científico desordenado, con mucho juicio y horizonte largo. El benchmark también da una narrativa limpia: los benchmarks de coding ya no alcanzan.
Anthropic relanza Claude Fable 5 a nivel global y propone un marco de severidad para jailbreaks
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗La historia interesante no es solo que Fable 5 volvió. Es que Anthropic está tratando de convertir el manejo de jailbreaks en una pelea de estándares entre toda la industria, con Amazon, Microsoft y Google en la mesa.
Claude Sonnet 5: más barato, más agentic y posicionado cerca de la utilidad clase Opus
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Los modelos clase Sonnet se están volviendo el default práctico para trabajo agentic. Si Sonnet 5 está de verdad cerca de Opus 4.8 en tareas desordenadas de tool-use, a menor costo, eso cambia qué deberían desplegar los builders.
Google lanza Nano Banana 2 Lite y Gemini Omni Flash para desarrolladores
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Es una historia upstream muy práctica para creadores: generación de imágenes barata y rápida más edición conversacional de video en un mismo flujo. La dirección de producto es clara: pipelines multimodales, no demos heroicas de un solo modelo.
BuseyBench se consolida como un benchmark creativo raro, pero útil
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Es exactamente el tipo de benchmark que viaja en redes y YouTube porque es visual, se entiende al instante y cruza modelos. Puede volverse un benchmark nativo de creadores, y eso online suele importar más que el rigor académico.
GLM-5.2: el modelo abierto a seguir por coding de horizonte largo y contexto de 1M de tokens
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗La documentación oficial es seca, pero el posicionamiento es claro: contexto de ingeniería a escala de proyecto, tareas largas y workflows desplegables. Este es el vínculo upstream detrás de mucha charla de creadores ahora mismo.
The Compute Index dice que el mercado de IA se parte entre “God Mode” y “Flash Mode”
POR QUÉ ENTRA EN EL RADARAbrir fuente original ↗Es un gran dispositivo de framing para contenido. El claim es que el medio del mercado se está muriendo, mientras los frontier premium y los demonios de velocidad ultra-baratos se separan. Aunque la tesis sea un poco dramática, es pegajosa y fácil de visualizar.