Claude Opus 4.7 заметнее всего проявляется не в бенчмарках, а в длинных сессиях: когда агент держит контекст проекта, правила репозитория и несколько итераций правок без «забывания» ограничений.
Агентный режим стал предсказуемее: меньше лишних tool-call'ов, точнее выбор файлов и лучше восстановление после ошибки сборки. Для инженерных задач это снижает количество ручных откатов.
По сравнению с GPT-5.4 Opus сильнее в аккуратном рефакторинге и документировании решений; Gemini 2.5 быстрее на коротких запросах, но чаще «упрощает» архитектуру. Для Hub-разработки и конфигуратора мы используем Opus там, где важна целостность большого diff.
Практический вывод: Opus 4.7 стоит брать для многошаговых задач (миграции, интеграции, review PR), а быстрые правки UI — отдавать более лёгким моделям.