Anthropic busca liderar el mercado de agentes de IA con Claude Opus 4.6, su modelo más reciente
Anthropic ha presentado Claude Opus 4.6, su modelo de inteligencia artificial (IA) más avanzado hasta la fecha, que se distingue por sus capacidades de codificación mejoradas en comparación con su predecesor. Esta versión trae consigo significativas mejoras en áreas como la planificación, revisión y depuración de código, así como en la extracción de información de grandes volúmenes de datos y en tareas de programación agéntica.
Según la empresa, Claude Opus 4.6 puede aplicar estas habilidades a una variedad de actividades cotidianas. Esto incluye el análisis financiero, la investigación avanzada y la creación, uso y edición de documentos, hojas de cálculo y presentaciones. “En Cowork, donde Claude puede realizar múltiples tareas de forma autónoma, Opus 4.6 pone todas estas habilidades al servicio del usuario”, explicaron los desarrolladores de Anthropic.
Ventana de Contexto Ampliada
Una de las características más notables de Claude Opus 4.6 es su ventana de contexto de hasta un millón de tokens, lo que le permite procesar grandes cantidades de información sin sufrir degradación por longitud. Este problema es común cuando las conversaciones o documentos superan un cierto umbral de tokens, lo que provoca un fenómeno conocido como atención dispersa, en el que la IA pierde coherencia factual e ignora instrucciones iniciales relevantes.
Claude Opus 4.6 es el primer modelo de Anthropic en operar con un contexto de esta magnitud. Además de permitirle analizar volúmenes extensos de datos con un alto nivel de detalle, esta ventaja técnica ayuda a mantener la consistencia lógica y la fidelidad de la información a lo largo de interacciones prolongadas. Así, el modelo puede sostener razonamientos complejos sin perder el hilo de las instrucciones originales, incluso en tareas de larga duración.
Rendimiento en Evaluaciones
En la prueba MRCR v2, diseñada para evaluar la capacidad de los modelos de IA para recuperar información específica oculta en grandes cantidades de texto, Opus 4.6 obtuvo una puntuación del 76%, mientras que Sonnet 4.5 alcanzó solo un 18.5%. “En general, Opus 4.6 es mejor para encontrar información en contextos extensos, razonar después de absorber esos datos y ofrecer capacidades de razonamiento a nivel experto sustancialmente superiores”, señaló el equipo de Anthropic.
En la práctica, esta ventana de contexto ampliada permite a Claude Opus 4.6 gestionar de manera autónoma tareas prolongadas en herramientas como Excel. Esto se logra mediante un procedimiento en el que el modelo planifica sus acciones antes de ejecutarlas. Esta capacidad, conocida como “razonamiento preventivo”, le permite analizar la estructura completa de un libro de Excel y manejar funciones avanzadas como el formato condicional o la validación de datos, asegurando que las reglas lógicas se mantengan consistentes en todas las celdas.



