Tu IA no se rompe con un mensaje de error. Se va desviando poco a poco. En el mensaje uno sigue cada regla que le diste; cincuenta mensajes después, está inventando nombres o datos con la misma confianza que tenía cuando sí acertaba.
El método del canario es una sola línea que agregas a tu prompt de sistema para saber, en tiempo real, cuándo tus instrucciones ya se salieron de la atención del modelo.
1. Por qué las sesiones se degradan
La degradación es silenciosa: no hay aviso, no hay bandera, solo respuestas que se ponen un poco peor en cada turno hasta que ya están mal. Cuatro cosas la causan:
El contexto se llena: los modelos ponen más atención al inicio y al final de la conversación, y menos al medio. Entre más larga la charla, más se hunden tus instrucciones originales en esa zona muerta. Las instrucciones se diluyen: en el mensaje uno tus reglas son casi todo el contexto; para el mensaje cincuenta son un error de redondeo bajo miles de tokens de conversación de tarea, y el modelo les baja peso sin avisar. La atención se reparte: cada respuesta vuelve a leer toda la conversación. Más historial significa menos peso para cada línea individual, incluida la regla que más te importa. Los errores se acumulan: una respuesta equivocada que no atrapas se vuelve parte del historial. El modelo trata su propio error como un hecho establecido y sigue construyendo sobre él.
2. De dónde viene la idea del canario
Los mineros de carbón cargaban canarios enjaulados bajo tierra. Los pájaros caían por el gas tóxico antes de que este llegara a los mineros, así que una jaula silenciosa significaba salir ya. El software le tomó prestado el nombre: un despliegue canario manda un cambio a un grupo pequeño de usuarios primero, para atrapar fallas antes de que le lleguen a todos.
La versión para IA, popularizada en la comunidad de Claude por Peter Steinberger (creador de OpenClaw), es todavía más simple. Agregas una sola regla chiquita a tu prompt de sistema o a tu CLAUDE.md: "Siempre empieza tu respuesta con mi nombre: [tu nombre]". Mientras el modelo lo siga haciendo, la sesión está sana. En el momento que se le olvida, tus instrucciones ya se salieron de su atención, y el resto de tus reglas van a seguir la misma suerte. El canario no te cuesta nada y falla de forma ruidosa.
3. La línea de tiempo de la degradación
La mayoría de las sesiones se degradan siguiendo la misma curva. Después de verla un par de veces, puedes anticiparla antes de que pase.
Mensajes 1 a 15, luna de miel: sigue cada regla, el canario responde siempre. Mensajes 15 a 40, desliz sutil: las respuestas se acortan, una regla de formato se resbala; fácil de pasar por alto. Mensajes 30 a 60, el canario muere: tu regla se cae. Esta es la señal. Mensajes 40 a 80, deriva: adivina con confianza, hace menos preguntas para aclarar. Mensajes 60 en adelante, alucinación: inventa nombres, cita fuentes falsas, con total seguridad y equivocado.
Los rangos se traslapan porque ninguna sesión es idéntica a otra, pero el orden nunca cambia. El canario muere en la etapa tres, lo que te da ventaja antes de las dos etapas que de verdad duelen.
4. Los 7 canarios, elige el que necesites
Cada uno es una sola línea. Ponlo en tus instrucciones y obsérvalo.
NOMBRE prueba si tu prompt de sistema todavía tiene atención, es el default para todo. CIERRE prueba si el modelo sostiene una regla hasta el final de una respuesta larga. FORMATO prueba si tus reglas de estilo siguen firmes. LENGUAJE prueba si el modelo todavía puede evitar sus propias muletillas. ROL prueba si el modelo sigue en personaje. RESTRICCIÓN prueba si los límites duros se siguen respetando. META prueba si el modelo sigue rastreando tus instrucciones en general.
5. Dónde configurarlo
Proyectos de Claude (web, escritorio): en la configuración del proyecto, Instrucciones personalizadas. Aplica a cada chat dentro del proyecto. Claude Code: ponlo en el archivo CLAUDE.md en la raíz de tu proyecto, se carga al inicio de cada sesión. ChatGPT: Configuración, Personalización, Instrucciones personalizadas, el campo de cómo quieres que responda. Cualquier cosa con prompt de sistema: Gemini, Copilot, modelos locales, llamadas directas a la API. Ponlo en el mensaje de sistema.
6. Qué hacer cuando el canario muere
Empieza de cero (la opción por default): una sesión nueva regresa tus instrucciones al inicio de una ventana limpia. En Claude web: chat nuevo. En Claude Code: /clear o /compact. En ChatGPT: chat nuevo.
Recuérdaselo una sola vez: "Se te olvidó mi nombre. Vuelve a leer tus instrucciones y síguelas." Eso te compra unos mensajes más. Si el canario vuelve a morir, deja de recordárselo y reinicia.
Guarda y migra: en una sesión larga de construcción o escritura, pídele al modelo que resuma todo lo importante, abre una sesión nueva, pega el resumen, y vuelve a poner el canario.
7. Corre más de un canario a la vez
Un canario te dice que algo está mal. Dos te dicen qué tan mal. Si tu canario de nombre muere pero tu canario de formato todavía responde, tu prompt se está desvaneciendo, no se ha ido del todo. Si mueren los dos, la sesión ya terminó.
Si tienes un flujo automatizado, conecta la revisión del canario a un reinicio automático y nunca dejes que un modelo a la deriva siga haciendo llamadas por su cuenta.
8. Tres combos listos para copiar y pegar
Los canarios son un aviso temprano, no una autopsia. Ponlo antes de necesitarlo, mantenlo medio vigilado, y cuando se quede callado, toma la señal y empieza limpio.
Llévate esta guía en PDF
Los 7 canarios y los 3 combos, listos para copiar cuando los necesites. Gratis.
Preguntas frecuentes
¿Qué es un canario en el contexto de IA?
Es una sola regla chiquita que agregas a tu prompt de sistema (por ejemplo, "empieza tu respuesta con mi nombre"). Mientras el modelo la siga cumpliendo, tu sesión está sana. En el momento que se le olvida, el resto de tus instrucciones ya se están perdiendo también.
¿En qué momento debo revisar si el canario sigue vivo?
Revísalo cada vez que la conversación se alargue, sobre todo después de 30 a 60 mensajes, que es cuando la mayoría de las sesiones empiezan a perder atención sobre las instrucciones originales.
¿Funciona igual en ChatGPT, Claude y Gemini?
Sí. Cualquier herramienta que use un prompt de sistema o instrucciones personalizadas puede llevar un canario: ChatGPT en Personalización, Claude en Instrucciones del proyecto o CLAUDE.md, y Gemini o cualquier otra IA en el mensaje de sistema.
¿Qué hago cuando el canario "muere"?
Lo más simple es empezar una sesión nueva. También puedes recordarle la instrucción una sola vez para ganar unos mensajes más, o resumir lo importante, abrir un chat nuevo, pegar el resumen y volver a poner el canario.
¿Por qué se degradan las sesiones largas de IA?
Porque el modelo reparte su atención entre todo el historial de la conversación. Entre más larga es la charla, menos peso le queda a tus instrucciones originales, y los errores que no corriges se acumulan como si fueran hechos.
¿Te sirvió esta guía?
Cada semana mando 1 correo de 2 minutos con lo nuevo que estoy probando en IA. Gratis, sin spam.