Notas
Textos cortos sobre la metodología y las decisiones arquitectónicas detrás de los sistemas de IA que entrego — specs, evals, orquestación multi-agente, integración de LLMs y la disciplina de dirigir agentes de codificación.
4 de junio de 2026
La memoria es la nueva superficie de ataque
Todos corren por darle a los agentes memoria de largo plazo: es la mejora obvia. Pero una capacidad duradera es una vulnerabilidad duradera. Una prompt injection es un disparo único que se reinicia; el envenenamiento de memoria (memory poisoning) escribe una sola mentira en el almacenamiento del agente y viaja junto a él en cada sesión futura, para cada usuario, hasta que alguien la purga. Convierte en arma la función misma para la que existe la memoria: aprender del pasado. Acá te explico cómo funciona el ataque que espera, y cómo cercarlo.
- security
- architecture
- agents
4 de junio de 2026
Tus agentes son sin estado. Por eso mueren.
Tu agente termina de principio a fin en tu laptop, así que nunca ves el problema. Producción es un proceso largo de múltiples pasos sobre infraestructura que se reinicia, expira y muere a mitad de camino — y tu agente guardó todo su progreso en memoria. El 'ajuste de cuentas agéntico' de 2026 es el descubrimiento de que la falla no está en el modelo, está en el runtime. El arreglo es viejo y aburrido: durable execution (ejecución durable). Aquí va la versión honesta.
- architecture
- agents
- methodology
4 de junio de 2026
El peldaño de abajo desapareció
Ya están los datos, y son específicos: la IA se comió al junior, no al senior. Las empresas no están despidiendo juniors; simplemente dejaron de contratarlos, en silencio, porque las tareas que hacían los juniors son exactamente lo que ahora hacen los agentes. Parece eficiente. Pero a los seniors no se los contrata, se los cultiva: un senior es un junior que sobrevivió a unos cuantos miles de bugs. Recorta los juniors para ahorrar ahora y estarás matando de hambre al pipeline (cantera) que produce a los seniors de los que dependes. Nos estamos comiendo la semilla.
- careers
- ai-native
- business
4 de junio de 2026
Llegó la factura
Durante dos años el costo de la IA se sintió como un error de redondeo. En 2026 llegó la factura — Uber quemó el presupuesto anual de IA en cuatro meses, Microsoft les quitó Claude Code a sus propios ingenieros, JPMorgan dice que los tokens se están comiendo las ganancias de internet. Esto no es un bache pasajero. La facturación por tokens invierte la economía sobre la que se construyó el software, y el giro cruel es que un agente mejor cuesta más. Esto es lo que realmente cambió, con honestidad.
- business
- ai-native
- agents
4 de junio de 2026
El año en que el agente se volvió el atacante
Hace un año, la seguridad de los agentes era un experimento mental: ¿qué pasa si engañan a tu agente? En 2026 se volvió concreta, de tres maneras: un aficionado usó Claude Code y GPT para vulnerar nueve agencias gubernamentales y 195 millones de registros; una IA llevó adelante una campaña contra 600 firewalls en 55 países sin un humano al volante; y el propio agente interno de Meta filtró datos sensibles sin atacante alguno. La misma primitiva peligrosa, apuntada en tres direcciones. Aquí va el modelo de amenazas honesto.
- security
- agents
4 de junio de 2026
Tokenmaxxing, o cuando la ley de Goodhart viene por la IA
Las empresas querían 'adopción de IA', así que midieron el proxy más fácil — el uso de tokens —, lo pusieron en una tabla de clasificación (leaderboard) y obtuvieron exactamente lo que midieron: gente quemando tokens para escalar en la tabla, no para hacer mejor trabajo. Es una ley de cincuenta años devorando una estrategia recién estrenada, y ahora sale cara dos veces: pagas por los tokens desperdiciados y envenenas la señal que querías. El arreglo también es viejo — mide resultados, no actividad.
- methodology
- business