Anthropic выпустила Claude Opus 4.7: уровень усилий xhigh, бюджеты задач и втрое более детальное зрение

16 апреля Anthropic представила Claude Opus 4.7 по цене $5/$25 за миллион токенов. Появился промежуточный уровень усилий xhigh, публичная бета бюджетов задач и поддержка изображений до 2576 px по длинной стороне.

DB
DBG · по материалам Anthropic Blog
0

16 апреля 2026 года Anthropic выпустила Claude Opus 4.7 — модель доступна в продуктах Claude, напрямую через API под идентификатором claude-opus-4-7, а также в Amazon Bedrock, Google Cloud Vertex AI и Microsoft Foundry. Цена — $5 за миллион входных токенов и $25 за миллион выходных.

Главное для тех, кто гоняет модель в агентных сценариях, — новый уровень усилий xhigh. Раньше между high и max зияла дыра: либо ты экономишь, либо платишь за максимум рассуждений и ждёшь. Теперь ступеней пять — low, medium, high, xhigh, max, — и компромисс между качеством рассуждений и латентностью настраивается точнее. Параллельно в публичную бету вышли бюджеты задач (task budgets): разработчик может подсказать модели, сколько токенов не жалко потратить и как расставить приоритеты внутри длинного прогона.

По цифрам Anthropic, Opus 4.7 берёт 70% на CursorBench против 58% у Opus 4.6, решает втрое больше продакшен-задач на Rakuten-SWE-Bench и допускает на 21% меньше ошибок на OfficeQA Pro. Отдельно подтянули зрение: теперь модель принимает изображения размером до 2576 пикселей по длинной стороне (примерно 3,75 мегапикселя) — более чем втрое больше прежнего лимита.

Что это меняет на практике. Скачок разрешения картинок — это не про красивые демо, а про агентов, которые смотрят на скриншоты: раньше UI-скриншот десктопного разрешения приходилось резать или ужимать до состояния, в котором модель не читала подписи к кнопкам и мелкий текст в таблицах. Теперь один скрин страницы заходит целиком, и сценарии вроде «проверь, что вёрстка не поехала» перестают требовать хитрого тайлинга. Уровень xhigh и бюджеты задач вместе дают то, чего давно не хватало в проде: предсказуемость счёта. Длинный агентный прогон больше не обязан быть лотереей на несколько долларов — верхнюю планку можно задать заранее.

Подводный камень тоже есть. Пять уровней усилий означают, что дефолт перестаёт быть безопасным выбором: одна и та же задача на medium и на xhigh различается и по цене, и по латентности в разы. Если у вас в коде уровень зашит константой «как настроили в прошлом году», самое время прогнать свой эвал-сет и заново подобрать ступень под каждый тип запроса — а не выкручивать всё на максимум «на всякий случай».

Комментарии