¿Por qué las respuestas de Claude empeoran? Un modelo mental
Cada conversación larga con Claude parece seguir el mismo arco.
Busca en todas las páginas de la documentación
Cada conversación larga con Claude parece seguir el mismo arco.
Las primeras respuestas se sienten agudas y precisas.
Veinte o treinta mensajes después, las respuestas se sienten más vagas, más lentas para llegar al punto o extrañamente desconectadas de lo que acabas de preguntar.
Nada sobre el modelo cambió a mitad de la conversación.
Lo que cambió es el material sobre el que Claude está razonando, y esta página construye el modelo mental de por qué sucede eso, para que las otras páginas de solución de problemas en esta sección (límites de contexto, citas alucinatorias, recuperación de contexto perdido, deriva de formato, Proyectos vs. chats y límites de tasa) tengan sentido como síntomas específicos de la misma dinámica subyacente.
Claude no tiene una memoria persistente de tu conversación como la tendría una persona.
En cambio, cada respuesta se genera leyendo a través de toda la conversación visible, desde tu primer mensaje en ese chat hasta el último, y produciendo la siguiente respuesta basándose en todo ello.
Este historial completo visible a menudo se denomina ventana de contexto, el conjunto de trabajo de texto que Claude "ve" realmente cuando responde.
Piénsalo como un escritorio.
Al comienzo de una conversación, el escritorio está despejado y es fácil encontrar el único documento que importa.
A medida que la conversación continúa, se acumulan más documentos: preguntas anteriores, respuestas anteriores, texto pegado, tangentes laterales, correcciones y aclaraciones.
Claude tiene que trabajar con toda esa pila cada vez que responde, y un escritorio desordenado lo hace más lento y menos preciso, a pesar de que tu pregunta real pueda ser simple.
Ese desorden es lo que se entiende por hinchazón del contexto: la ventana de contexto se llena con material que fue útil en el momento pero que ya no es relevante para la pregunta actual.
Tres mecanismos específicos se combinan para producir la sensación de que "las respuestas empeoran".
El primero es la hinchazón del contexto en sí.
A medida que una conversación crece, la proporción de material relevante frente a irrelevante cambia, y Claude tiene que decidir implícitamente, turno tras turno, qué partes de un historial mucho más largo siguen importando.
Esa decisión se vuelve más difícil a medida que el historial se vuelve más largo y variado.
El segundo es el problema del hilo obsoleto.
Al principio de una conversación, es posible que hayas establecido un objetivo, un formato o una restricción, y más tarde lo hayas abandonado o cambiado sin decirlo explícitamente.
Claude no tiene una forma fiable de saber que una instrucción anterior ha sido reemplazada silenciosamente, por lo que puede seguir dándole peso, produciendo respuestas que parecen responder a una versión anterior de la conversación.
El tercero es la indicación ambigua, agravada por la longitud de la conversación.
Una indicación corta como "hazlo más corto" o "inténtalo de nuevo" depende completamente de que Claude infiera correctamente a qué se refieren "lo" o "eso".
En una conversación corta, solo hay un referente razonable.
En una larga, puede haber varios candidatos de diferentes puntos del hilo, y pequeñas ambigüedades como esta son exactamente donde las respuestas degradadas tienden a aparecer primero.
Turno 1: "Redacta una actualización del proyecto para mi equipo." -> referente claro
Turno 2: "Hazlo más corto." -> "lo" = la actualización (todavía claro)
...
Turno 40: "Hazlo más corto." -> "lo" = ??? (¿la actualización? ¿la revisión posterior? ¿el resumen que pegaste en el turno 25?)Los tres mecanismos interactúan: un hilo obsoleto se suma a la hinchazón del contexto, y la hinchazón del contexto hace que las referencias ambiguas sean más difíciles de resolver correctamente, por lo que la degradación tiende a acelerarse en lugar de permanecer lineal a medida que una conversación crece.
No todas las conversaciones largas se degradan al mismo ritmo.
Una conversación que se mantiene muy centrada en una tarea en evolución, refinando un solo documento, por ejemplo, tiende a mantenerse mejor que una que salta entre varios temas no relacionados, porque un hilo enfocado tiene menos material genuinamente conflictivo para que Claude lo pondere.
Pegar grandes bloques de material de referencia (artículos largos, transcripciones o código) acelera la hinchazón más rápido que un número equivalente de turnos normales de ida y vuelta, ya que agrega mucho contenido en un solo paso.
Aquí es también donde el modelo que estás utilizando interactúa con el modelo mental.
Claude Opus 4.8 y Claude Sonnet 5 son generalmente más fuertes para mantener hilos relevantes a través de una conversación más larga y desordenada, mientras que Claude Haiku 4.5 está optimizado para la velocidad en tareas más ligeras y autocontenidas, y puede mostrar degradación antes en un hilo largo y errante.
Claude Fable 5 se sitúa junto a estos como una opción distinta en la línea actual, pero la dinámica subyacente de la ventana de contexto descrita aquí se aplica a cualquiera de ellos, ya que es una propiedad de cómo las conversaciones acumulan material, no de un modelo específico.
| Enfoque | Fortaleza | Debilidad | Mejor Ajuste |
|---|---|---|---|
| Continuar en el mismo hilo largo | Sin costo de configuración, el historial completo permanece técnicamente disponible | La calidad se degrada gradualmente a medida que se acumulan la hinchazón y la obsolescencia | Tareas cortas y muy enfocadas que no se ejecutarán durante mucho tiempo |
| Reafirmar el contexto clave y continuar | Elimina el material obsoleto mientras preserva el resumen útil | Requiere que identifiques activamente lo que sigue siendo relevante | Conversaciones de mediana duración que se han desviado pero que vale la pena continuar |
| Iniciar una conversación nueva | Ventana de contexto limpia, retorno más rápido a respuestas agudas | Pierdes la continuidad implícita y debes reafirmar todo lo que necesitas | Conversaciones largas que se han degradado claramente, o una tarea genuinamente nueva |
| Mover el trabajo a un Proyecto | Contexto y archivos persistentes entre sesiones sin reafirmar manualmente cada vez | Agrega sobrecarga de configuración; excesivo para preguntas únicas | Trabajo recurrente o continuo al que volverás en múltiples sesiones |
La conclusión práctica es que "las respuestas empeoraron" rara vez es una razón para seguir insistiendo en el mismo hilo con reformulaciones más elaboradas.
Por lo general, es una señal para podar el contexto reafirmando lo que importa, o para empezar de cero, ambos cubiertos en detalle en los otros artículos de esta sección.
Versiones de Stack: Escrito contra la línea de modelos de Claude actual a partir de ~junio de 2026 - Claude Fable 5, Claude Opus 4.8, Claude Sonnet 5 (el predeterminado) y Claude Haiku 4.5. Los nombres de los modelos, los precios y las características del producto cambian rápidamente; verifica los detalles actuales en platform.claude.com/docs antes de confiar en ellos.
Revisado por Chris St. John·Última actualización: 16 jul 2026