El Pulso del 25 de mayo de 2026
Las señales que entraron en el radar, ordenadas con sus fuentes y contexto para entender qué cambió.
El guion de audio está listo; la voz se publicará cuando termine la generación.
Constraint Decay: por qué los agentes de código se rompen cuando se acumulan requisitos
POR QUÉ ENTRA EN EL RADAREl paper formaliza un modo de falla que todo el mundo siente: los agentes andan bien con “armame una API” y después colapsan cuando sumás reglas de ORM, convenciones del framework y estructura multiarchivo. Es un marco limpio para medir “backend del mundo real” en vez de tareas de juguete.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Tu agente no se volvió más tonto: se te hicieron más pesadas las restricciones. Acá cómo diseñar prompts y tests para que el agente no decaiga.”
llama.cpp: arreglos de checkpointing para corridas largas de agentes (menos reprocesamiento completo)
POR QUÉ ENTRA EN EL RADAREn coding con agentes locales, la responsividad lo es todo. Este PR apunta a evitar el costo de “forzar el reprocesamiento completo del prompt” creando mejores checkpoints en los bordes de la conversación (especialmente relevante en chats largos y densos de herramientas).
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La razón escondida por la que los agentes locales se sienten ‘lentos’ después de un ‘gracias’: el reprocesamiento del prompt. Acá el camino de fix en llama.cpp.”
Cursor “Composer 2.5”: trucos de entrenamiento para mejor comportamiento de agentes en horizontes largos
POR QUÉ ENTRA EN EL RADARCursor describe RL dirigido con feedback textual (pistas localizadas insertadas justo en el turno malo), más tareas sintéticas más difíciles y entrenamiento para “calibración de esfuerzo” y estilo de comunicación: cosas que los benchmarks normales casi no capturan.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La próxima frontera no es solo ‘más inteligente’: son agentes que se comportan (que no spameen tools, no alucinen tooling, no ignoren el estilo). El feedback textual dirigido es una receta prolija.”
Stable Audio 3.0: generación de audio open-weight con datos licenciados + docs de fine-tuning con LoRA
POR QUÉ ENTRA EN EL RADARPesos abiertos y una historia de licenciamiento usable en comercial (community license + opción enterprise), más generación de longitud variable (minutos) y documentación publicada de entrenamiento LoRA. Es un habilitador real de “creator stack”.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“El audio open-weight está creciendo: generación de minutos + LoRAs + datos licenciados. Acá qué podés construir para intros/outros de YouTube y packs de sfx.”
OpenAI: finanzas personales dentro de ChatGPT (cuentas conectadas)
POR QUÉ ENTRA EN EL RADAREs una dirección fuerte de producto ‘agéntico’: conectar cuentas (vía Plaid), armar dashboards, hacer preguntas ancladas en tus transacciones y guardar “memorias financieras”. También es un pararrayos de privacidad y superficie de ataque.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“La verdadera killer app de los LLM es: tus datos, con seguridad. Hablemos de permisos, límites de memoria y qué puede salir mal.”
DeepSeek Reasonix: agente de coding nativo de DeepSeek, de bajo costo (surgió en HN)
POR QUÉ ENTRA EN EL RADARAunque los detalles en la landing son escasos, la tendencia es clara: los agentes de coding especializados, optimizados por caching y costo (y probablemente por workflows afinados), se multiplican rápido. Esperá un momento de “guerras de agentes de terminal”.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Si estás pagando precios de modelos frontier por loops básicos de agente, estás por tener opciones más baratas. Qué mirar: caching, confiabilidad de tools y contexto a escala de repo.”
Throughput de inferencia local: “1000 TPS en Qwen3.6-27B con V100s” (reality check de batching)
POR QUÉ ENTRA EN EL RADAREste tipo de post revela la brecha entre la sensación de un solo usuario y el throughput de servidor. El titular de 1000 TPS habla de concurrencia/batching; el número de usuario único importa más para la “latencia del agente de coding”.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Dejá de comparar screenshots de TPS. Compará time-to-first-token, latencia de tools y reprocesamiento de cache.”
Nuevo drop open(ish) en HF para coding: MiMo-V2.5-coder (release de comunidad)
POR QUÉ ENTRA EN EL RADARMás variantes “coder” compitiendo en confiabilidad de tool-calling y performance local. Aunque sea de nicho, es otro dato: el ecosistema está optimizando para coding agéntico, no solo para chat.
ÁNGULO EDITORIAL SUGERIDOAbrir fuente original ↗“Cómo evalúo un modelo ‘coder’ nuevo en 30 minutos: tool-calls, calidad de diffs y tests de regresión.”