Релиз модели

Claude Opus 4.8: Что на самом деле выпустила Anthropic

Claude Opus 4.8 был запущен 28 мая 2026 года с улучшенными возможностями агентного кодинга, более высокой честностью в оценке собственной работы, режимом high effort по умолчанию, динамическими рабочими процессами в Claude Code и более дешевым быстрым режимом. Этот разбор основан исключительно на официальных источниках Anthropic и Claude.

Редакционная иллюстрация для Claude Opus 4.8, демонстрирующая панели бенчмарков, дашборды для ревью кода и длительные агентные задачи.

Get the latest on AI, LLMs & developer tools

New MCP servers, model updates, and guides like this one — delivered weekly.

Что это такое

Claude Opus 4.8 — это новейшая общедоступная модель Opus от Anthropic. В официальной документации она описывается как самая мощная модель компании для сложных логических задач, долгосрочного агентного кодинга и автономной работы. Проще говоря: этот релиз предназначен для задач, где модели необходимо сохранять состояние, использовать инструменты, проверять результаты своей работы и продолжать выполнение дольше, чем в рамках обычного диалога.

Идентификатор модели (model ID): claude-opus-4-8В документации указано окно контекста в 1 млн токенов для Claude API, Amazon Bedrock и Vertex AI, а также 200 тыс. токенов для Microsoft Foundry на момент запуска. Максимальный объем вывода синхронного Messages API составляет 128 тыс. токенов.

Model:        Claude Opus 4.8
API ID:       claude-opus-4-8
Context:      1M tokens on Claude API, Bedrock, Vertex AI
Output:       128k tokens on synchronous Messages API
Default effort: high
Regular API:  $5 input / $25 output per MTok
Fast mode:    $10 input / $50 output per MTok

Официальный анонс

Запуск начался с официального аккаунта Claude в X и публикации Anthropic. Утверждение конкретно: Opus 4.8 развивает идеи Opus 4.7, предлагая более точные суждения, большую честность в оценке прогресса и способность дольше работать автономно.

В публикации Anthropic о запуске также упоминаются три сопутствующих изменения продукта: контроль усилий (effort control) в claude.ai и Cowork, динамические рабочие процессы в Claude Code и быстрый режим (fast mode) для Opus 4.8. Это важно, поскольку выпуск модели — не просто замена контрольной точки. Это меняет то, как разработчикам следует настраивать усилия, кэшировать промпты и структурировать длительные запуски агентов.

Таблица бенчмарков

В системной карте Anthropic приведена наиболее полезная проверенная таблица. Приведенные ниже цифры скопированы как факты из официальной системной карты и должны рассматриваться как оценки перед развертыванием, а не как гарантия того, что каждая рабочая нагрузка в продакшене улучшится на ту же величину.

ОценкаOpus 4.8Opus 4.7На что обратить внимание
SWE-bench Verified88.687.6Небольшой прирост на проверенных реальных задачах GitHub.
SWE-bench Pro69.264.3Значительный скачок в качестве кодинга согласно ветке ClaudeDevs.
Terminal-Bench 2.174.666.1Заметный прирост производительности в задачах для агентов командной строки.
OSWorld-Verified83.482.8Небольшой прирост в реальных задачах по использованию компьютера на базе Ubuntu.
GraphWalks BFS 256K85.976.9Существенное улучшение при обходе графов с длинным контекстом.
GraphWalks Parents 256K99.393.6Убедительный результат отслеживания состояния при работе с длинным контекстом.

В системной документации также сообщается, что claude-opus-4-8 занимает первое место в FrontierSWE по метрикам mean@5 и best@5. Этот бенчмарк выделяет агентам по 20 часов на задачу, что соответствует позиционированию Anthropic: этот релиз наиболее эффективен в длительных, сложных и насыщенных использованием инструментов рабочих процессах.

Что изменилось

Для разработчиков самые важные изменения носят не косметический характер. В Opus 4.8 по умолчанию используется high effort на всех поверхностях, поддерживаются системные сообщения в ходе диалога, снижается минимальная длина prompt-cache до 1024 токенов, а также сохраняются ограничения Opus 4.7, касающиеся sampling и thinking. Если ваш запрос по-прежнему отправляет temperature, top_p, top_k или с нестандартными значениями, Messages API отклонит его.

Ручные бюджеты для extended thinking также не поддерживаются в Opus 4.8. Используйте adaptive thinking с thinking: {type: "adaptive"}, а затем управляйте глубиной через output_config.effort. Anthropic рекомендует xhigh для программирования и агентных задач, а high — в качестве значения по умолчанию для большинства задач, требующих высокого уровня интеллекта.

client.messages.create({
  model: "claude-opus-4-8",
  max_tokens: 64000,
  thinking: { type: "adaptive" },
  output_config: { effort: "xhigh" },
  messages: [{ role: "user", content: "Audit this migration plan." }]
})

Ценообразование

Стандартные цены на API Opus 4.8 не изменились по сравнению с Opus 4.7: $5 за миллион входных токенов и $25 за миллион выходных токенов. Fast mode для Opus 4.8 дешевле, чем fast mode для предыдущих моделей Opus: в анонсе указаны цены $10 за миллион входных токенов и $50 за миллион выходных токенов.

Практический вывод прост. Standard mode является стандартным для длительной автономной работы. Fast mode предназначен для взаимодействия, чувствительного к задержкам, отладки в реальном времени и быстрой итерации, когда переплата за скорость вывода оправдана.

Заметки о безопасности

The official system card is not pure launch marketing. It says Opus 4.8 improves over Opus 4.7 on most alignment measures and is much less likely to leave flaws in its own code unreported. The launch post summarizes that as roughly four times less likely than Opus 4.7 to let flaws in written code pass unremarked.

В той же системной карте (system card) содержится предостережение: Opus 4.8 был несколько менее устойчив, чем Opus 4.7, в ряде контекстов с агентными prompt-injection до внедрения дополнительных мер защиты. Anthropic заявляет, что развернутые средства защиты устраняют этот разрыв на практике. Если вы создаете агента, который считывает ненадежные веб-страницы, электронные письма, тикеты или содержимое репозиториев, это предостережение следует включить в вашу модель угроз.

Кому следует использовать

Используйте Opus 4.8 в первую очередь для длительных сессий программирования, рефакторинга на уровне репозитория, глубокого анализа кода, профессионального анализа документов, исследований с большим количеством источников и агентных циклов, требующих стабильного плана при выполнении множества вызовов инструментов. Используйте Sonnet или Haiku, когда задержка, стоимость или высокая пропускная способность важнее максимального качества рассуждений.

Вердикт краток, но ясен: Opus 4.8 — это не принципиально новая категория продуктов. Это улучшенный Opus для тех областей, где Opus был важен и раньше: сложная инженерная работа, длинный контекст и агенты, которые должны признавать неопределенность, прежде чем что-либо сломать.

Заметки по миграции

  • Обновите строку модели до claude-opus-4-8.
  • Удалите нестандартные параметры сэмплирования, если вы их все еще передаете.
  • Используйте адаптивное мышление вместо ручного budget_tokens.
  • Явно задавайте уровень усилий (effort) для рабочих нагрузок в production.
  • Удалите старые бета-заголовки 1M-context в Claude API, Bedrock и Vertex AI.
  • Рассмотрите возможность использования системных сообщений в середине диалога для длительных процессов.
  • Проведите повторную оценку стоимости и задержки, так как уровни усилий изменились.

FAQ

Что такое Claude Opus 4.8?

Claude Opus 4.8 — это новейшая общедоступная модель Opus от Anthropic, запущенная 28 мая 2026 года. Anthropic позиционирует её как решение для сложных логических задач, долгосрочного агентного программирования и высокоавтономной работы.

Какой API model ID у Claude Opus 4.8?

API model ID для Claude — claude-opus-4-8. Anthropic также указывает соответствующие собственные идентификаторы для Vertex AI и Claude Platform на AWS, а также формат ID, специфичный для Bedrock.

Сколько стоит Claude Opus 4.8?

Стандартные тарифы API не изменились по сравнению с Opus 4.7: $5 за миллион входных токенов и $25 за миллион выходных токенов. Быстрый режим (Fast mode) для Opus 4.8 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов.

Какое самое значимое изменение для разработчиков в Opus 4.8?

Ключевые изменения платформы включают режим high effort по умолчанию, контекстное окно 1M токенов по умолчанию в Claude API, адаптивное мышление (adaptive thinking), системные сообщения в процессе диалога, снижение минимальных порогов для prompt-cache и улучшенное восстановление при работе с длинным контекстом.

Claude Opus 4.8 лучше, чем Opus 4.7?

Anthropic называет это скромным, но ощутимым улучшением. В системной карте (system card) указаны более высокие баллы по сравнению с Opus 4.7 в большинстве оценок возможностей, включая SWE-bench Pro, Terminal-Bench 2.1 и GraphWalks.

Официальные источники

По теме: руководство по динамическим рабочим процессам Claude Code и руководство по миграции API для Opus 4.8.