· Nugawi Intelligence · Estrategia · 3 min read
Tu Agente de IA Funcionaba Ayer. El Modelo Cambió de un Día para Otro.

Tu agente pasó el UAT el viernes. El lunes falló. Nada de tu código cambió — el modelo que lo sostiene sí.
La Dependencia Invisible
Todo agente en producción se apoya en una base que no controla. Anthropic, OpenAI y Google lanzan nuevas versiones de modelos constantemente — e incluso cuando fijas una versión en Amazon Bedrock, sigues expuesto a ventanas de retirada, deriva de comportamiento entre checkpoints y cambios de capacidad que nadie anunció. El endpoint de la API siguió siendo el mismo. La inteligencia detrás se movió.
Fijar una versión del modelo te da tiempo, no inmunidad. Cuando la versión retirada llega a su fin de vida, migras tú — o tu agente lo hace por ti, sin planificar, en el peor momento posible.
Qué se Rompe Primero
Los cambios de modelo no se anuncian como caídas. Llegan como una pudrición lenta:
- Las puntuaciones de evaluación se hunden — el prompt afinado durante semanas de repente rinde peor, y nadie sabe por qué.
- Las llamadas a herramientas se vuelven inestables — las salidas estructuradas derivan; el JSON que se parseaba limpio empieza a fallar en los bordes.
- El tono y el comportamiento de seguridad cambian — el agente se vuelve más locuaz, más cauteloso o extrañamente lacónico. Los usuarios lo notan antes que tus dashboards.
- El coste por ejecución se arrastra — más tokens para llegar a la misma respuesta, inflando silenciosamente tus costes unitarios.
El Manual ante el Cambio de Modelo
Esta es la disciplina operativa que instalamos con cada adopción de Claude. Cuatro movimientos:
- Arnés de evaluación antes de actualizar — una suite congelada de tus tareas reales. Ejecútala contra el modelo candidato antes de que nada salga a producción. Si no tienes evals, no tienes línea base — tienes sensaciones.
- Canario en un flujo de trabajo — enruta un solo proceso de bajo riesgo al nuevo modelo primero. Obsérvalo una semana. Nunca cambies toda la flota de golpe.
- Manual de rollback — el ID del modelo anterior, el interruptor de configuración, la persona de guardia. Escrito, no memorizado.
- Plantilla de comunicación a clientes — tus stakeholders se enteran del cambio por ti, con fechas y efectos esperados — no por su propio dashboard roto.
Por Qué Esto es el Trabajo de Alguien
Los modelos seguirán cambiando — más rápido, no más despacio. La pregunta es si cada cambio es un experimento controlado o una revisión de incidente. Para eso existe exactamente el retainer de Adopción de Claude: alguien vigila el modelo para que tú no tengas que hacerlo.
Reserva un Discovery Sprint — estableceremos la línea base de tus agentes frente a la próxima revisión de Claude antes de que salga.