Get the latest on AI, LLMs & developer tools
New MCP servers, model updates, and guides like this one — delivered weekly.
Qué es
Claude Opus 4.8 es el modelo Opus más reciente de Anthropic disponible de forma general. La documentación oficial lo describe como el modelo más capaz de la compañía para razonamiento complejo, codificación agéntica de largo alcance y trabajo de alta autonomía. En términos sencillos: este lanzamiento está dirigido a tareas donde el modelo debe mantener el estado, utilizar herramientas, inspeccionar su propio trabajo y continuar durante más tiempo que un turno de chat normal.
El ID del modelo es claude-opus-4-8La documentación indica una ventana de contexto de 1M de tokens en la Claude API, Amazon Bedrock y Vertex AI, con una ventana de contexto de 200k tokens en Microsoft Foundry en el lanzamiento. La salida máxima síncrona de la Messages API es de 128k tokens.
Model: Claude Opus 4.8 API ID: claude-opus-4-8 Context: 1M tokens on Claude API, Bedrock, Vertex AI Output: 128k tokens on synchronous Messages API Default effort: high Regular API: $5 input / $25 output per MTok Fast mode: $10 input / $50 output per MTok
Anuncio oficial
El lanzamiento comenzó con la cuenta oficial de Claude en X y la publicación de lanzamiento de Anthropic. La afirmación es específica: Opus 4.8 se basa en Opus 4.7 con un juicio más preciso, mayor honestidad sobre el progreso y la capacidad de trabajar de forma independiente durante más tiempo.
Presentamos Claude Opus 4.8: se basa en Opus 4.7 con un juicio más preciso, mayor honestidad sobre su propio progreso y la capacidad de trabajar de forma independiente durante más tiempo que sus predecesores.
— Claude (@claudeai)28 de mayo de 2026
Disponible hoy al mismo precio. pic.twitter.com/EufxL7T1kb
La publicación de lanzamiento de Anthropic añade tres cambios de producto relacionados: control de esfuerzo en claude.ai y Cowork, flujos de trabajo dinámicos en Claude Code y modo rápido para Opus 4.8. Esto es importante porque el lanzamiento del modelo no es solo un intercambio de puntos de control. Cambia la forma en que los desarrolladores deben establecer el esfuerzo, almacenar prompts en caché y estructurar ejecuciones de agentes más largas.
Tabla de benchmarks
La tarjeta de sistema de Anthropic proporciona la tabla verificada más útil. Los números a continuación se han copiado como hechos de la tarjeta de sistema oficial y deben leerse como evaluaciones previas al despliegue, no como una promesa de que cada carga de trabajo en producción mejorará en el mismo margen.
| Evaluación | Opus 4.8 | Opus 4.7 | Qué observar |
|---|---|---|---|
| SWE-bench Verified | 88.6 | 87.6 | Ligero aumento en problemas reales verificados de GitHub. |
| SWE-bench Pro | 69.2 | 64.3 | El salto destacado en codificación del hilo de ClaudeDevs. |
| Terminal-Bench 2.1 | 74.6 | 66.1 | Mejora significativa en tareas de agentes de línea de comandos. |
| OSWorld-Verified | 83.4 | 82.8 | Pequeña mejora en tareas reales de uso de computadora en Ubuntu. |
| GraphWalks BFS 256K | 85.9 | 76.9 | El recorrido de grafos con contexto largo mejora notablemente. |
| GraphWalks Parents 256K | 99.3 | 93.6 | Resultado sólido en el seguimiento de estado con contexto largo. |
La ficha técnica del sistema también informa que Opus 4.8 ocupa el primer lugar en FrontierSWE tanto en mean@5 como en best@5. Ese benchmark otorga a los agentes 20 horas por tarea, por lo que coincide con el posicionamiento de Anthropic: este lanzamiento es más fuerte cuando el trabajo es largo, complejo y requiere un uso intensivo de herramientas.
Novedades
Para los desarrolladores, los cambios más importantes no son estéticos. Opus 4.8 utiliza por defecto high effort en todas las superficies, admite mensajes de sistema a mitad de la conversación, reduce la longitud mínima de prompt-cache a 1,024 tokens y mantiene las restricciones de Opus 4.7 en torno al muestreo y el pensamiento. Si su solicitud sigue enviando temperature, top_p, top_k o con valores no predeterminados, la Messages API la rechazará.
Los presupuestos de pensamiento extendido manual tampoco son compatibles con Opus 4.8. Utilice el pensamiento adaptativo con thinking: {type: "adaptive"}, y luego controle la profundidad mediante output_config.effort. Anthropic recomienda xhigh para programación y trabajo con agentes, con high como valor predeterminado para la mayoría de las tareas que requieren inteligencia.
client.messages.create({
model: "claude-opus-4-8",
max_tokens: 64000,
thinking: { type: "adaptive" },
output_config: { effort: "xhigh" },
messages: [{ role: "user", content: "Audit this migration plan." }]
})Precios
Los precios regulares de la API de Opus 4.8 no han cambiado respecto a Opus 4.7: $5 por millón de tokens de entrada y $25 por millón de tokens de salida. El modo rápido para Opus 4.8 es más económico que el modo rápido de modelos Opus anteriores: la publicación de lanzamiento indica $10 por millón de tokens de entrada y $50 por millón de tokens de salida.
La interpretación práctica es sencilla. El modo estándar es el predeterminado para trabajos autónomos largos. El modo rápido es para interacciones sensibles a la latencia, depuración en vivo e iteración rápida donde vale la pena pagar más por la velocidad de salida.
Notas de seguridad
The official system card is not pure launch marketing. It says Opus 4.8 improves over Opus 4.7 on most alignment measures and is much less likely to leave flaws in its own code unreported. The launch post summarizes that as roughly four times less likely than Opus 4.7 to let flaws in written code pass unremarked.
La misma tarjeta de sistema también señala una advertencia: Opus 4.8 fue algo menos robusto que Opus 4.7 en varios contextos de inyección de prompts en agentes antes de aplicar salvaguardas adicionales. Anthropic afirma que las salvaguardas implementadas cierran esa brecha en la práctica. Si está creando un agente que lee páginas web, correos electrónicos, tickets o contenido de repositorios que no son de confianza, esta advertencia debe incluirse en su modelo de amenazas.
Quién debería usarlo
Utilice Opus 4.8 principalmente para sesiones largas de programación, refactorizaciones a escala de repositorio, revisiones de código profundas, análisis de documentos profesionales, investigación con múltiples fuentes y bucles de agentes que requieran un plan estable a lo largo de muchas llamadas a herramientas. Utilice Sonnet o Haiku cuando la latencia, el costo o el rendimiento de alto volumen sean más importantes que la máxima calidad de razonamiento.
El veredicto es limitado pero claro: Opus 4.8 no es una categoría de producto nueva y radical. Es un mejor Opus para los ámbitos donde Opus ya era relevante: trabajo de ingeniería complejo, contexto largo y agentes que deben admitir la incertidumbre antes de romper algo.
Notas de migración
- Actualiza la cadena del modelo a
claude-opus-4-8. - Elimina los parámetros de muestreo que no sean los predeterminados si aún los estás pasando.
- Utiliza pensamiento adaptativo, no manual
budget_tokens. - Define el esfuerzo explícitamente para cargas de trabajo en producción.
- Elimina los encabezados beta antiguos de 1M-context en Claude API, Bedrock y Vertex AI.
- Considera el uso de mensajes de sistema a mitad de la conversación para procesos de larga duración.
- Vuelve a establecer la línea base de costo y latencia, ya que los niveles de esfuerzo han cambiado.
FAQ
¿Qué es Claude Opus 4.8?
Claude Opus 4.8 es el modelo Opus más reciente de Anthropic disponible de forma general, lanzado el 28 de mayo de 2026. Anthropic lo posiciona para razonamiento complejo, codificación agente de largo alcance y trabajo de alta autonomía.
¿Cuál es el ID del modelo de API para Claude Opus 4.8?
El ID del modelo de API de Claude es claude-opus-4-8. Anthropic también enumera los IDs de primera parte correspondientes para Vertex AI y Claude Platform en AWS, además de un formato de ID específico para Bedrock.
¿Cuánto cuesta Claude Opus 4.8?
El uso regular de la API no cambia respecto a Opus 4.7: $5 por millón de tokens de entrada y $25 por millón de tokens de salida. El modo rápido para Opus 4.8 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida.
¿Cuál es el mayor cambio para desarrolladores en Opus 4.8?
Los cambios más importantes en la plataforma son el esfuerzo alto por defecto, 1M de contexto por defecto en la Claude API, razonamiento adaptativo, mensajes de sistema a mitad de conversación, mínimos de prompt-cache más bajos y una mejor recuperación de contexto largo.
¿Es Claude Opus 4.8 mejor que Opus 4.7?
Anthropic lo califica como una mejora modesta pero tangible. La ficha técnica del sistema reporta puntuaciones más altas que Opus 4.7 en la mayoría de las evaluaciones de capacidad, incluyendo SWE-bench Pro, Terminal-Bench 2.1 y GraphWalks.
Fuentes oficiales
- Anthropic: Presentamos Claude Opus 4.8
- Anthropic: Tarjeta de sistema de Claude Opus 4.8
- Documentación de Claude: Novedades en Claude Opus 4.8
- Documentación de Claude: Descripción general de los modelos
- Hilo oficial del lanzamiento de Claude en X
- Hilo oficial para desarrolladores de ClaudeDevs en X
Relacionado: la guía de flujos de trabajo dinámicos de Claude Code y la guía de migración de la API de Opus 4.8.
