El Pulso del 19 de abril de 2026
Las señales que entraron en el radar, ordenadas con sus fuentes y contexto para entender qué cambió.
El guion de audio está listo; la voz se publicará cuando termine la generación.
π0.7: un modelo dirigible con capacidades emergentes (modelo fundacional robótico)
POR QUÉ ENTRA EN EL RADAREs una de las afirmaciones más claras “tipo LLM” en robótica: generalización composicional (recombinar habilidades para tareas no vistas) + transferencia entre robots sin fine-tuning por tarea.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La robótica entra en su momento de ‘prompting’: coaching en lenguaje + subobjetivos visuales = tareas nuevas sin demos nuevas.”
Codex para (casi) todo (Codex desktop se convierte en un ‘espacio de trabajo de agentes’)
POR QUÉ ENTRA EN EL RADARLa dirección de producto es clara: computer-use + tareas en segundo plano + plugins + memoria + flujos multi-terminal/archivos → Codex como hub diario del desarrollador.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“El ‘AI IDE’ murió. Empieza el ‘AI OS’: por qué computer-use + tareas en background cambia lo que un solo dev puede shippear.”
La próxima evolución del Agents SDK (harness + ejecución en sandbox)
POR QUÉ ENTRA EN EL RADAREs la capa poco glamurosa que decide si los agentes son juguetes o sistemas de producción: harness estandarizado + sandboxes portables + snapshots/rehidratación.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La confiabilidad de un agente no es un problema de prompts: es un problema de harness. Acá está el stack que está emergiendo (memoria + tools + sandbox).”
Llega Claude Design de Anthropic Labs (diseño → prototipo → handoff)
POR QUÉ ENTRA EN EL RADAREs una apuesta fuerte por el “LLM como colaborador creativo”, con export + handoff (HTML, PDF, PPTX, Canva) y bundles explícitos de handoff hacia Claude Code.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“El pipeline diseño-a-código acaba de ganar una sola interfaz conversacional: prototipá con Claude Design, shippeá con Claude Code.”
Qwen3.6-35B-A3B (pesos abiertos; coding agentic + contexto enorme)
POR QUÉ ENTRA EN EL RADAROtro contendiente serio de pesos abiertos para “coding agent”, explícitamente medido en harnesses de agentes (variantes de SWE-bench, Terminal-Bench 2.0, etc.) y con contexto nativo muy grande.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Si querés algo ‘estilo Claude Code’ en local: qué cambia Qwen3.6, y qué predicen de verdad los benchmarks sobre trabajo real en un repo.”
OpenCode (agente de coding open-source; desktop + TUI)
POR QUÉ ENTRA EN EL RADAREl ecosistema converge en un patrón: multi-agente, agnóstico de proveedor, ejecución con permisos, y una UX real (TUI + desktop). Es el ‘Linux’ de los agentes de coding.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“El ‘Claude Code’ open-source no es un solo proyecto: es una categoría. OpenCode muestra qué se va a commoditizar y qué no.”
GPT‑Rosalind para investigación en ciencias de la vida (razonamiento de frontera en dominio)
POR QUÉ ENTRA EN EL RADARModelos de dominio a medida + acceso confiable + packs de tools. También destaca: el repo público del “Life Sciences research plugin” se posiciona como capa conectora.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La próxima cuña de los modelos de frontera: ‘Rosalinds’ verticales que llegan con tools + gobernanza, no solo con chat.”
Comparaciones anónimas de request-token entre Opus 4.6 y Opus 4.7 (señal práctica de costo/latencia)
POR QUÉ ENTRA EN EL RADARSi estás armando loops de agentes, pequeños cambios en el comportamiento de tokens = grandes cambios de costo/latencia. Este tipo de telemetría del mundo real pesa más que un benchmark de un solo número.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Los benchmarks están bien; el comportamiento de tokens es lo que te mata el presupuesto. Cómo pensar la ‘verbosidad de razonamiento’ como una perilla de producto.”