EL PULSO DE LA IAES

El Pulso del 28 de marzo de 2026

Las señales que entraron en el radar, ordenadas con sus fuentes y contexto para entender qué cambió.

AgentesModelosAnthropic
ESCUCHAR ESTA EDICIÓN

El guion de audio está listo; la voz se publicará cuando termine la generación.

  1. 01Anthropic / Claude blog

    Poné a Claude a trabajar en tu computadora (Dispatch + “computer use”)

    POR QUÉ ENTRA EN EL RADAR

    Anthropic está productizando el patrón “el agente corre en tu escritorio real” (mouse, teclado, navegador), con un relato de permisos y salvaguardas. Es el camino más directo de chat → hacer cosas (y compite con frameworks de agentes de terceros).

    ÁNGULO EDITORIAL SUGERIDO

    “Los agentes con computer use ya están acá: qué pueden y qué no, y los 3 modos de falla (permisos, prompt injection y ‘uy, hice clic en lo equivocado’).”

    Abrir fuente original ↗
  2. 02Anthropic / Claude blog

    Claude Code “Auto mode” (automatización de permisos con un clasificador de seguridad)

    POR QUÉ ENTRA EN EL RADAR

    Es un patrón concreto que vamos a ver por todos lados: delegar aprobaciones a una capa de política/clasificador en vez de usar flags estilo YOLO. Es un blueprint para agentes de coding de larga duración más seguros.

    ÁNGULO EDITORIAL SUGERIDO

    “Auto mode es el futuro de la operación de agentes: cómo pensar ‘guardrails que deciden’ vs ‘los humanos aprueban todo’.”

    Abrir fuente original ↗
  3. 03Google blog (Models & Research)

    Gemini 3.1 Flash Live (modelo de audio en tiempo real + benchmarks)

    POR QUÉ ENTRA EN EL RADAR

    Google está empujando los agentes de voz como superficie de producto de primera línea (Gemini Live + Search Live) y lo respalda con evaluaciones agénticas de audio (ComplexFuncBench Audio, Audio MultiChallenge). También destaca: watermarking de audio SynthID integrado de fábrica.

    ÁNGULO EDITORIAL SUGERIDO

    “Los agentes de voz se vuelven medibles: qué testean de verdad esos benchmarks de audio agéntico (y qué se les escapa).”

    Abrir fuente original ↗
  4. 04Google Research

    TurboQuant (compresión extrema para KV cache + búsqueda vectorial)

    POR QUÉ ENTRA EN EL RADAR

    El KV cache es el impuesto oculto del contexto largo. TurboQuant es una historia limpia y “upstream”: “KV a 3 bits con pérdida (casi) nula” + aceleraciones en attention logits. Tiene implicancias para inferencia local de contexto largo y serving más barato.

    ÁNGULO EDITORIAL SUGERIDO

    “El KV cache es el verdadero centro de costo: explicá TurboQuant en 90 segundos + qué habilita (contexto largo en GPUs más chicas).”

    Abrir fuente original ↗
  5. 05GitHub repo (TheTom)

    TurboQuant+ (implementación de la comunidad + ‘Sparse V’ con dequant gated por atención)

    POR QUÉ ENTRA EN EL RADAR

    El repo afirma un truco práctico de velocidad: saltear la dequantización de V donde los pesos de atención son despreciables (“Sparse V”), con reportes de hasta +22,8% de decode a 32K en Apple Silicon, sin cambio medible de PPL en sus tests. Es exactamente el tipo de “cambio chico de kernel → gran ganancia en contexto largo” que se propaga rápido.

    ÁNGULO EDITORIAL SUGERIDO

    “La próxima frontera no son modelos nuevos: son kernels de inferencia; sparsity de atención como skipping de cómputo.”

    Abrir fuente original ↗
  6. 06Mistral AI blog

    Voxtral TTS (TTS multilingüe 4B de Mistral + voice cloning)

    POR QUÉ ENTRA EN EL RADAR

    Un modelo TTS 4B relativamente liviano, posicionado para agentes de voz en tiempo real (latencia + streaming), más adaptación de voz desde ~3 segundos.

    ÁNGULO EDITORIAL SUGERIDO

    “El TTS se está volviendo ‘modelo + producto’: qué importa ahora (TTFA, estabilidad de streaming y emoción controlable).”

    Abrir fuente original ↗
  7. 07arXiv

    Paper de Voxtral TTS (referencia técnica upstream)

    POR QUÉ ENTRA EN EL RADAR

    El paper detalla la arquitectura híbrida (tokens semánticos AR + tokens acústicos con flow-matching) y reporta preferencia humana frente a ElevenLabs Flash v2.5 en cloning multilingüe.

    ÁNGULO EDITORIAL SUGERIDO

    “Cómo funcionan los stacks modernos de TTS (tokens semánticos + tokens acústicos) y por qué ‘3 segundos para clonar’ es la nueva línea de base.”

    Abrir fuente original ↗
  8. 08Cursor blog

    Mejorar agentes de coding con “RL en tiempo real” (feedback de producción → checkpoints frecuentes)

    POR QUÉ ENTRA EN EL RADAR

    Es una historia de loop de entrenamiento upstream: convertir inferencia masiva en producción en señales de reward, publicar checkpoints actualizados tan seguido como cada ~5 horas, y lidiar con reward hacking en el mundo real.

    ÁNGULO EDITORIAL SUGERIDO

    “Tu IDE ya es un entorno de entrenamiento: por qué los agentes de coding van a mejorar más rápido que los modelos de chat general.”

    Abrir fuente original ↗
  9. 09ARC Prize

    ARC-AGI-3 (benchmark interactivo para inteligencia agéntica)

    POR QUÉ ENTRA EN EL RADAR

    Los benchmarks están pasando de Q/A estático a entornos interactivos (exploración, planning de horizonte largo, memoria, adquisición de objetivos). Si buscás una estrella guía para “agentes más allá del chat”, esta es.

    ÁNGULO EDITORIAL SUGERIDO

    “Por qué ARC-AGI-3 cambia la conversación: medir eficiencia de aprendizaje en el tiempo, no solo la respuesta final.”

    Abrir fuente original ↗
  10. 10Stanford SCS

    jai (contención liviana para agentes de IA que corren en tu máquina)

    POR QUÉ ENTRA EN EL RADAR

    A medida que los agentes con “computer use” se vuelven mainstream, también crece el problema del radio de daño. jai es un punto medio práctico entre VMs/containers completos y darle al agente tu home directory real.

    ÁNGULO EDITORIAL SUGERIDO

    “Si dejás que los agentes corran en local, el sandboxing se vuelve el producto. Acá va el modelo mental más simple de contención.”

    Abrir fuente original ↗
LLEVÁ ESTE PULSO A TU IA

Seguí el análisis donde ya trabajás.

Copiá este prompt y pegalo en ChatGPT, Claude, Gemini o la IA que uses. Incluye las señales, las fuentes y una guía para convertirlas en decisiones.

No conecta ninguna cuenta ni comparte datos automáticamente.
PROMPT.md