Claude Opus 5 vs Sonnet 5: яку модель обрати для вашої задачі

Оновлено:
Мова: 🇺🇦
Claude Opus 5 vs Sonnet 5: яку модель обрати для вашої задачі

Коротко:

  • Sonnet 5 і Opus 5 — не конкуренти, а дві сходинки однієї лінійки: Sonnet 5 вийшов 30 червня 2026 як "найагентніший Sonnet" за ціною середнього рівня, Opus 5 — 24 липня 2026 як топова модель для щоденного використання.
  • Головна різниця в цифрах: $2/$10 (інтро-ціна до 31 серпня, потім $3/$15) у Sonnet 5 проти фіксованих $5/$25 у Opus 5 — але реальна економія на текстоємних задачах менша за номінальну через оновлений токенізатор Sonnet 5.
  • На SWE-bench Pro розрив суттєвий (79.2% у Opus 5 проти 63.2% у Sonnet 5), а на Terminal-Bench 2.1 Opus 5 випереджає лише на ~9 п.п. (89.1% проти 80.4%).
  • Обидві моделі підтримують Zero Data Retention — на відміну від Fable 5, де 30-денна ретенція обов'язкова.
  • Практична стратегія для production — не "яку обрати назавжди", а routing: Sonnet 5 за замовчуванням, ескалація на Opus 5 для складних чи дорогих у разі помилки випадків.

Зміст

Коротко: у чому головна різниця між Opus 5 і Sonnet 5

Claude Sonnet 5 вийшов 30 червня 2026 року і одразу став дефолтною моделлю на Free і Pro планах — Anthropic прямо назвала його "найагентнішим Sonnet" з дня заснування лінійки (DataCamp). Claude Opus 5 з'явився через три з половиною тижні, 24 липня 2026, і став дефолтною моделлю на Max та найпотужнішою опцією на Pro.

Якщо коротко: Sonnet 5 — це модель, яку ви запускаєте за замовчуванням для більшості щоденних задач, бо вона швидка, дешева і достатньо агентна. Opus 5 — модель, на яку ви ескалуєте, коли задача неоднозначна, дорога в разі помилки, або потребує реального reasoning, а не просто виконання чіткого плану.

Ціна: $5/$25 проти $2/$10

Номінальна різниця в ціні виглядає вражаючою: Sonnet 5 коштує $2 за млн вхідних і $10 за млн вихідних токенів за інтро-тарифом, який діє до 31 серпня 2026 року, після чого підніметься до стандартних $3/$15 (DataCamp). Opus 5 коштує фіксовано $5/$25 — це та сама ціна, що й у Opus 4.8, без інтро-періоду.

МодельВхід ($/1М)Вихід ($/1М)Період дії
Sonnet 5 (інтро)$2.00$10.00до 31.08.2026
Sonnet 5 (стандарт)$3.00$15.00з 01.09.2026
Opus 5$5.00$25.00без змін

За стандартним тарифом (з 1 вересня) Opus 5 коштує приблизно у 1.67 раза дорожче за Sonnet 5 — і за вхідними, і за вихідними токенами. Але ця цифра описує ціну за токен, а не ціну за виконану задачу — а це вже зовсім інша розмова, до якої ми повернемось у розділі про приховану вартість токенізації нижче.

Бенчмарки: де Opus 5 виграє з відчутним відривом, а де розрив мінімальний

Anthropic не публікувала офіційного прямого порівняння Opus 5 і Sonnet 5 — кожен реліз-пост порівнює свою модель з попередником і з Opus 4.8 окремо. Зводимо доступні цифри в одну таблицю, де зіставлення коректне (однакова версія бенчмарку для обох моделей):

БенчмаркSonnet 5Opus 5Різниця
SWE-bench Pro63.2%79.2%+16.0 п.п. на користь Opus 5
SWE-bench Verified72.7%96.0%+23.3 п.п. на користь Opus 5
Terminal-Bench 2.180.4%89.1%+8.7 п.п. на користь Opus 5
GDPval-AA v2 (Elo)16181861+243 на користь Opus 5

Важливо: OSWorld я навмисно не включив у цю таблицю — Sonnet 5 тестували на OSWorld-Verified (81.2%), а Opus 5 на новішій версії OSWorld 2.0 (70.6%). Це різні версії бенчмарку з різною методологією, і пряме зіставлення цифр між ними ввело б в оману — попри те, що номінально цифра Sonnet 5 навіть вища.

Закономірність, яка проглядається: розрив найбільший саме на задачах реального рефакторингу й довгих ланцюжків роботи з чужим кодом (SWE-bench Pro, SWE-bench Verified) — тобто там, де важлива глибина reasoning. На задачах виконання чітко визначених CLI-послідовностей (Terminal-Bench) розрив помітно менший — Sonnet 5 тут дійсно "наздоганяє" Opus рівня, як і обіцяла Anthropic при релізі.

Effort dial в обох моделях: чим відрізняється практичний ефект

Обидві моделі мають регульований рівень "зусилля", але не однаковий діапазон. Sonnet 5 пропонує чотири рівні — low, medium, high, xhigh (MarkTechPost). Opus 5 має п'ять — до них додається ще max. На перший погляд це виглядає як просто "ще один рівень", але практична різниця важливіша: на xhigh Sonnet 5 інколи коштує дорожче за Opus 4.8 за порівнянну якість — тобто верхня межа effort у Sonnet 5 — це та точка, де економічний сенс переходу на Sonnet замість Opus вже втрачається.

Практичний висновок з цього для routing-логіки: якщо ваша задача регулярно потребує xhigh на Sonnet 5, щоб отримати прийнятний результат, — це сигнал переходити на Opus 5 з нижчим рівнем effort (наприклад, medium), а не продовжувати піднімати effort у Sonnet 5. Часто це виявляється і дешевше, і швидше.

Агентні задачі: короткі цикли проти довгих автономних сесій

Sonnet 5 добре тримає короткі, чітко окреслені агентні цикли: п'ятикроковий workflow із зрозумілими інструкціями відпрацює стабільно. Але задача на двадцять кроків з неоднозначними вхідними даними — це вже той сценарій, де Opus 5 безпечніший вибір, оскільки він утримує когерентність на більшій кількості кроків і краще відновлюється після помилок на розтягнутих у часі задачах.

Тут є пряме економічне застереження: довга сесія Opus 5 може коштувати у 2-3 рази більше за аналогічну сесію на Sonnet 5, оскільки агентні воркфлоу швидко "з'їдають" токени незалежно від моделі. Для агентів, що працюють без нагляду людини, це виправдана премія за зниження ризику дорогої помилки. Для коротких контрольованих циклів під наглядом — Sonnet 5 економить бюджет без відчутної втрати якості.

Робота з великим контекстом і кодовою базою

Обидві моделі мають однакове контекстне вікно — 1 млн токенів, достатньо, щоб завантажити цілу кодову базу середнього розміру в один промпт. Формальна рівність тут не означає ідентичну якість роботи з цим обсягом — це радше означає, що розмір вікна більше не є диференціатором між моделями цього покоління Anthropic, на відміну, наприклад, від Gemini 3.6 Flash з лімітом виводу вдвічі меншим за обидві Claude-моделі.

Практична різниця проявляється не в розмірі вікна, а в тому, що відбувається, коли контекст заповнений майже повністю і потрібно ще й активно рефакторити код усередині нього: тут повертаємось до різниці в SWE-bench Pro з розділу вище — Opus 5 стабільніший саме на задачах, де потрібно тримати в увазі багато файлів одночасно.

Швидкість і самоперевірка: чому Opus 5 рідше помиляється, але це коштує часу

Самостійна перевірка власної роботи — фірмова риса Opus 5: модель схильна перевіряти власні висновки, будувати тестові гарнеси, коли немає готового джерела даних для валідації, і сперечатись з інструкціями, які вважає помилковими, замість сліпого виконання. Це напряму пов'язано зі швидкістю: на максимальному рівні effort час до першого токена в Opus 5 сягає 66-68 секунд — глибокий thinking і самоперевірка коштують реального часу очікування.

Sonnet 5 як менша модель за архітектурою природно швидша на порівнянних рівнях effort — це узгоджується із загальною практикою: менша модель означає меншу затримку за той самий рівень "зусилля". Але зворотний бік тієї самої монети — менше вбудованої самоперевірки за замовчуванням. Для задач з чітким критерієм успіху (тест або лінтер, що перевіряє результат) це не критично. Для задач, де немає автоматичної перевірки і результат оцінює лише людина постфактум, звичка Opus 5 перевіряти себе самостійно економить час рев'ю, навіть якщо сама генерація відповіді триває довше.

Прихована вартість токенізації: чому Sonnet 5 не завжди в 1.7 раза дешевший на практиці

Це найменш очевидний, але один із найважливіших нюансів у цьому порівнянні. Sonnet 5 отримав оновлений токенізатор — той самий тип оновлення, що Anthropic вводила в Opus 4.7. Той самий текст тепер може перетворюватись на більшу кількість токенів, ніж раніше — приблизно у 1.0-1.35 раза залежно від типу контенту (DataCamp). Anthropic встановила інтро-ціну так, щоб перехід з Sonnet 4.6 був приблизно нейтральним за вартістю, а не простою знижкою — тобто це усвідомлений компроміс, а не побічний ефект.

Практичний наслідок для порівняння з Opus 5: на текстоємних задачах, які погано токенізуються (щільний природний текст, код з великою кількістю коментарів багатьма мовами, структуровані дані), реальна різниця в ціні між моделями за стандартним тарифом стискається приблизно до 23% замість номінальних 67%, якщо саме інфляція токенізації у Sonnet 5 з'їдає частину номінальної економії. Діапазон інфляції — від 1.0x до 1.35x залежно від вашого контенту, і це емпіричне питання, яке варто перевірити на власних даних, а не покладатись на прайс-лист. Якщо якість рішення на цьому шляху взагалі має значення, премія в 23% виправдати значно легше, ніж номінальні 67%.

Знання cutoff: чотиримісячна різниця (травень 2026 у Opus 5 проти січня 2026 у Sonnet 5)

За зведеними даними незалежних трекерів моделей, Opus 5 має свіжіший knowledge cutoff — травень 2026 — проти січня 2026 у Sonnet 5 (Coursiv). Чотиримісячна різниця логічна з огляду на послідовність релізів: Sonnet 5 навчали і фіксували раніше, Opus 5 вийшов на три з половиною тижні пізніше і встиг захопити свіжіші дані.

Застереження: точні дати knowledge cutoff — це деталь, яку різні незалежні трекери іноді фіксують по-різному залежно від методології, і Anthropic не завжди публікує це прямо в основному релізному пості. Якщо для вашого продукту точність cutoff критична (наприклад, юридичний чи медичний контент, де важлива дата останнього оновлення регуляторної бази), я б рекомендував перевіряти актуальність відповіді моделі окремим запитом, а не покладатись лише на заявлену дату cutoff.

Enterprise-сценарії: комплаєнс, ретенція, надійність на довгих сесіях

Тут хороша новина для обох моделей: і Sonnet 5, і Opus 5 підтримують Zero Data Retention (ZDR) — на відміну від Fable 5, де 30-денна ретенція даних обов'язкова (Coursiv). Тобто вибір між Sonnet 5 і Opus 5 не впливає на цей аспект комплаєнсу — рішення можна приймати виключно з міркувань якості й вартості.

Sonnet 5 постачається з тими самими real-time кіберзахисними класифікаторами за замовчуванням, що й Opus 4.7/4.8, і за передрелізним тестуванням Anthropic безпечніший за Sonnet 4.6: краще відмовляє в шкідливих запитах, стійкіший до prompt injection, з нижчим рівнем галюцинацій і сикофантії (DataCamp). Один організаційний нюанс, про який варто пам'ятати: на деяких Enterprise-планах преміум-місця могли за замовчуванням залишатись прив'язаними до старішої моделі навіть після релізу новішої — перш ніж плутатись, чому команда бачить різні результати, варто перевірити, яка саме модель призначена вашому тарифу за замовчуванням.

Практична стратегія: routing — коли варто автоматично ескалувати з Sonnet 5 на Opus 5

Найпрактичніший підхід для production-систем — не обирати одну модель назавжди, а побудувати routing: Sonnet 5 обробляє основний потік запитів, а частину, яку він сам позначає невпевненою чи не може завершити, автоматично ескалює на Opus 5.

  • Тримайте Sonnet 5 за замовчуванням для добре окреслених задач з чітким критерієм готовності: фіча з acceptance criteria, відомий баг, порівняння за шаблоном, звіт за визначеною структурою.
  • Ескалюйте на Opus 5, коли задача неоднозначна, важко верифікується автоматично, чи коштовна в разі помилки — двадцятикроковий дослідницький агент з нечіткими вхідними даними явно ближче до цієї категорії, ніж до попередньої.
  • Використовуйте effort dial на обох моделях як проміжний важіль перед повною ескалацією — часто підняти effort у Sonnet 5 з low до medium дешевше, ніж одразу переходити на Opus 5.
  • Рахуйте вартість за успішну задачу, а не за токен — саме ця метрика, а не номінальна ціна за мільйон токенів, показує, яка модель насправді ефективніша для конкретного воркфлоу.

Кому підійде Sonnet 5, кому — Opus 5

СитуаціяРекомендація
Високооб'ємна, добре окреслена робота (CRUD-ендпоінти, типові баги, звіти за шаблоном)Sonnet 5
Швидка ітерація, чат-інтерфейси, рутинна генерація кодуSonnet 5
Складний, багатофайловий рефакторинг у великому репозиторіїOpus 5
Довгий автономний агент без нагляду людиниOpus 5
Задача, де ціна помилки висока, а перевірка результату дорога чи неможлива автоматичноOpus 5
Текстоємні задачі з жорстким бюджетом на токенSonnet 5 (з урахуванням поправки на токенізацію)

Підсумкова таблиця

ПараметрSonnet 5Opus 5
Реліз30.06.202624.07.2026
Ціна (стандарт)$3 / $15$5 / $25
Контекст1 млн1 млн
Максимум виводу128 тис.128 тис.
Рівні effort4 (low–xhigh)5 (low–max)
SWE-bench Pro63.2%79.2%
Zero Data RetentionТакТак
Дефолт на планіFree, ProMax (найсильніша опція на Pro)

Висновки

Проаналізувавши доступні бенчмарки й ціноутворення обох моделей, я б не радив сприймати це порівняння як питання "яка модель краща" — вони не конкурують за одне й те саме місце в стеку. Моя практична рекомендація: почніть з Sonnet 5 як дефолту для більшості задач і ввімкніть просту логіку ескалації на Opus 5 там, де Sonnet 5 сам сигналізує невпевненість чи задача явно виходить за межі короткого, добре окресленого циклу.

Два моменти, які я б порадив перевірити самостійно, а не приймати на віру з цієї чи будь-якої іншої статті: реальний коефіцієнт інфляції токенізації на вашому власному контенті (він сильно залежить від мови й структури тексту) і фактичний дефолтний тариф на вашому Enterprise-плані — я вже бачив плутанину в командах, які думали, що працюють з новою моделлю, а насправді преміум-місця все ще були прив'язані до старішої. Ці дві прості перевірки рятують від найпоширеніших помилок при виборі між Sonnet 5 і Opus 5 на практиці.