
Сьогодні, 28 вересня 2026, Anthropic випустила Claude Sonnet 5.5. Це друга модель лінійки 5.5 (першим був Opus 5.5). Її позиціонують як швидший і дешевший на задачу варіант для повсякденної роботи, особливо для кодингу та агентних сценаріїв.
Основні характеристики
Параметр | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
Дата релізу | 28 вересня 2026 | 30 червня 2026 | 22 вересня 2026 |
Ціна (input / output) за 1M токенів | $2 / $10 | $2 / $10 | удвічі дорожче за Sonnet 5.5 ($4 / $20) |
Швидкість | 30%+ швидше за Sonnet 5 (за Anthropic) | — | — |
Вартість на задачу | до –30% vs Sonnet 5 (за Anthropic) | — | залежить від задач і рівня effort |
Sonnet 5.5 має контекст 1M токенів і до 128K токенів на вихід. Ціна за токен не змінилася. Знижка до 30% виходить не з нижчого прайсу: за словами Anthropic, модель витрачає менше токенів і робить менше викликів інструментів. Це порівняння з Sonnet 5, а не з Opus.
Порівняння за бенчмарками (дані Anthropic)
Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
FrontierCode 1.1 | 46.2% (Max) / 52.1% (Xhigh) | 42.4% | 54.4% |
OSWorld 2.1 (computer use, partial) | 80.1% | 57.0% | 81.8% |
GDPval-AA (Elo) | 1844 | 1449 | 1846 |
Humanity's Last Exam (з tools) | 64.5% | 54.9% | 67.7% |
Про FrontierCode: на Max Sonnet 5.5 набирає менше, ніж на Xhigh. За поясненням Anthropic, на Max він частіше викликає багатоагентний code-review, що інколи дає таймаути та правки поза межами задачі, а бенчмарк за таке знижує бал.
Що видно з цифр
Стрибок відносно Sonnet 5 дуже великий. Особливо в кодингу (Terminal-Bench з 10.3% до 70.6%) і в роботі з комп'ютером (OSWorld з 57% до 80.1%).
До Opus 5.5 він близько, але не скрізь. На GDPval-AA, OSWorld і CursorBench різниця мінімальна (2 Elo і 1.7–2.3 п.п.). На FrontierCode на Xhigh відставання близько 2 п.п., а на Max понад 8. На Terminal-Bench Sonnet попереду за даними Anthropic.
Де він відстає помітно. Без інструментів на Humanity's Last Exam Sonnet 5.5 програє Opus 5.5 на 7.5 пункту, тож глибоке міркування без пошуку залишається сильною стороною Opus.
Незалежні дані
Artificial Analysis поставила Sonnet 5.5 (max effort) на 56 балів Intelligence Index, лише на 2 бали менше за Opus 5.5 (max), але з найбільшою кількістю output-токенів на задачу з усіх, що вони міряли. Це приблизно 193 тис. токенів на задачу, на 60% більше, ніж в Opus 5.5 чи Sonnet 5 на їхньому max.
Через це виходить парадокс: на індексі AA Sonnet коштує $7.60 за задачу проти $5.98 в Opus, попри вдвічі дешевші токени. У Vals ситуація протилежна: $20.80 за тест проти $32.77 в Opus. Там же Terminal-Bench 4.0 вийшов на користь Opus: 61.62% проти 53.03%. У Artificial Analysis навпаки: 63.6% у Sonnet проти 59.6% в Opus. Тобто "Sonnet швидше й дешевше" залежить від набору задач і рівня effort.
Застереження
Основні цифри це власні заміри Anthropic. Незалежних перевірок ще мало.
Артефакти таблиці: OSWorld 2.1 подано з частковим заліком (partial), а два тести Artificial Analysis (GDPval-AA та AA-Briefcase) проганяли на передрелізній версії з багом. Anthropic очікує, що вплив невеликий і скоріше занижує результат.
Заяви Anthropic про ефективність стосуються насамперед нижчих рівнів effort. За замовчуванням це Medium у Claude Code і застосунках та High на Claude Platform (API).
Висновки
Sonnet 5.5 це сильний апгрейд середнього сегмента. Для рутинного кодингу, роботи з документами та високонавантажених агентів він виглядає розумним стартом. Найкраще працює на Medium/High.
Sonnet 5 тепер виглядає застарілим майже за всіма показниками.
Opus 5.5 лишається кращим вибором для неоднозначних, довгих задач і там, де помилка коштує дорого. Також він сильніший у складному міркуванні.
Рекомендація проста: прожени Sonnet 5.5 на своїх сценаріях на Medium і High, порахуй вартість саме за задачу (а не за токен) і порівняй з Opus 5.5. Тоді видно, чи є сенс переходити.
Haiku 5.5 Anthropic обіцяє випустити протягом найближчих тижнів.
Більше розборів нових моделей і робочих AI-автоматизацій без хайпу: @aibiz_ua