El contexto de 1 M ya está disponible con carácter general para Opus 4.6 y Sonnet 4.6
El precio estándar se aplica ahora a toda la ventana de 1 M para ambos modelos, sin recargo por contexto extendido. Los límites de contenido multimedia se amplían a 600 imágenes o páginas de PDF.
Claude Opus 4.6 y Sonnet 4.6 ya incluyen la ventana de contexto completa de 1 M al precio estándar en la Claude Platform. El precio estándar se aplica en toda la ventana — $5/$25 por millón de tokens para Opus 4.6 y $3/$15 para Sonnet 4.6. No hay multiplicador: una solicitud de 900 000 tokens se factura a la misma tasa por token que una solicitud de 9000.
Novedades con disponibilidad general:
Un precio, ventana de contexto completa. Sin prima por contexto largo.
Límites de velocidad completos en cualquier longitud de contexto. El rendimiento estándar de tu cuenta se aplica en toda la ventana.
6 veces más contenido multimedia por solicitud. Hasta 600 imágenes o páginas de PDF, frente a las 100 anteriores. Disponible ya de forma nativa en Claude Platform, Microsoft Foundry y Google Cloud Vertex AI.
No se requiere encabezado beta. Las solicitudes de más de 200 000 tokens funcionan automáticamente. Si ya estás enviando el encabezado beta, se ignora, así que no es necesario cambiar el código.
El contexto de 1 M ya está incluido en Claude Code para usuarios de Max, Team y Enterprise con Opus 4.6. Las sesiones de Opus 4.6 pueden usar automáticamente la ventana de contexto completa de 1 M, lo que se traduce en menos compresiones de contexto y en que se conserve intacta más parte de la conversación. El contexto 1 M antes requería un uso adicional.
Contexto largo que se mantiene
Un millón de tokens de contexto solo importa si el modelo es capaz de recordar los detalles correctos y razonar a partir de ellos. Opus 4.6 obtiene un 78,3 % en MRCR v2, la puntuación más alta entre los modelos de frontera a esa longitud de contexto.
Claude Opus 4.6 y Sonnet 4.6 mantienen la precisión en toda la ventana de 1 M. La recuperación de contexto largo ha mejorado con cada generación de modelos.
Esto significa que puedes cargar una base de código completa, miles de páginas de contratos o la traza completa de un agente de larga duración (llamadas a herramientas, observaciones, razonamiento intermedio) y usarla directamente. El trabajo de ingeniería, el resumen con pérdida de información y la limpieza de contexto que antes exigía trabajar con contexto largo ya no son necesarios. La conversación completa se mantiene intacta.
“Claude Code puede consumir más de 100.000 tokens buscando en Datadog, Braintrust, bases de datos y el código fuente. Entonces se activa la compactación. Los detalles desaparecen. Acabas depurando en círculos. Con el contexto de 1M, busco, vuelvo a buscar, agrupo casos límite y propongo soluciones, todo en una misma ventana.”
Anton Biryukov, ingeniero de software
“Antes de la ventana de contexto de 1M de Opus 4.6, teníamos que compactar el contexto en cuanto los usuarios cargaban PDF de gran tamaño, conjuntos de datos o imágenes, y perdíamos fidelidad justo en el trabajo que más importaba. Hemos observado una reducción del 15% en los eventos de compactación. Ahora nuestros agentes lo retienen todo y funcionan durante horas sin olvidar lo que leyeron en la primera página.”
Jon Bell, CPO
“Opus 4.6 con ventana de contexto de 1M hizo que nuestro agente Devin Review fuera significativamente más eficaz. Los diffs grandes no cabían en una ventana de contexto de 200K, así que el agente tenía que trocear el contexto, lo que suponía más pasadas y la pérdida de dependencias entre archivos. Con el contexto de 1M, le pasamos el diff completo y obtenemos revisiones de más calidad con un harness más sencillo y con un uso más eficiente de los tokens.”
Adhyyan Sekhsaria, Ingeniero fundador
“Eve utiliza por defecto el contexto de 1M porque los problemas más difíciles de los abogados de demandantes así lo exigen. Ya sea para cotejar una transcripción de declaración de 400 páginas o para descubrir conexiones clave en todo un expediente, la ventana de contexto ampliada nos permite ofrecer respuestas de una calidad sustancialmente superior a la de antes.”
Mauricio Wulfovich, Ingeniero de ML
“El descubrimiento científico exige razonar a la vez sobre literatura de investigación, marcos matemáticos, bases de datos y código de simulación. El contexto de 1M de Claude Opus 4.6 y sus límites ampliados de contenido multimedia permiten a nuestros sistemas agénticos sintetizar cientos de artículos, demostraciones y bases de código en una sola pasada, lo que nos ayuda a acelerar drásticamente la investigación en física fundamental y aplicada.”
Dr. Alex Wissner-Gross, cofundador
“Con el contexto de 1M de Claude, un abogado interno puede reunir en una sola sesión cinco versiones de un acuerdo de colaboración de 100 páginas y ver por fin el arco completo de una negociación. Se acabó saltar de una versión a otra o perder el hilo de lo que cambió hace tres rondas.”
Bardia Pourvakil, Cofundador y CTO
“Los sistemas de producción a gran escala tienen un contexto interminable y los incidentes de producción pueden llegar a ser muy complejos. Con la ventana de contexto de 1M de Claude, podemos mantener a la vista cada entidad, cada señal y cada hipótesis de trabajo, desde la primera alerta hasta la resolución, sin tener que compactar una y otra vez ni sacrificar los matices de estos sistemas.”
Mayank Agarwal, fundador y CTO
“Aumentamos la ventana de contexto de Opus de 200k a 500k y el agente funciona con más eficiencia: de hecho, usa menos tokens en total. Menos sobrecarga y más atención puesta en el objetivo.”
Izzy Miller, responsable de Investigación de IA
“Las tareas reales con hojas de cálculo exigen investigación en profundidad y planes complejos de varios pasos. La ventana de contexto de 1M de Claude nos permite mantener la fidelidad a la tarea y la atención al detalle.”
El contexto de 1 M está disponible ya de forma nativa en Claude Platform, y a través de Amazon Bedrock, Google Cloud Vertex AI y Microsoft Foundry. Los usuarios de Claude Code Max, Team y Enterprise con Opus 4.6 usarán el contexto de 1 M de forma predeterminada y automática.