Claude Opus 5.5 проти GPT-6 Sol і Luna: як змінюється баланс сил в ІІ-моделях
Anthropic і OpenAI майже одночасно оновили свої топові моделі — Claude Opus 5.5 з одного боку та GPT-6 Luna/Sol з іншого. На перший погляд це просто чергова «прокачка версій», але на практиці змінюється і вибір інструментів, і економіка використання ІІ.
Claude Opus 5.5 у спільноті вже називають «однією моделлю на всі випадки життя». Вона обходить Fable 5.1 у бенчмарках, коштує дешевше за попередній Opus 5, краще пише тексти та стабільніше тримає складні завдання. Разом із релізом Anthropic підкрутила й інфраструктуру: ліміти в Claude Code за 5 годин роботи підняли на 20% і додали «banked» скидання ліміту — тобто працювати без відчуття постійної стелі стало простіше.
Автор Ben’s Bites тестував Opus 5.5 на реальних задачах — від редизайну сайту ossean.com і переписування есе з глибшим ресерчем для shortandlongtail.com до оновлення власних бенчмарків detroitbench. Після цього, за його словами, основним робочим агентом став саме Claude Code: багато хто, хто раніше переїхав у Codex, тепер повертається до Claude.
OpenAI відповідає оновленням GPT-6 Luna та GPT-6-Sol, але робить ставку не стільки на стрибок у якості, скільки на ціну. Обидві моделі доступні лише в Codex та ChatGPT Work, у звичайному чаті їх поки немає. Ключовий момент — зниження вартості приблизно вдвічі: Luna коштує $0.10/$0.50 за мільйон вхідних/вихідних токенів, Sol — $2/$10. Розумнішими моделі стали лише помірно, а GPT-6-Sol, за оцінкою автора, помітно поступається новому Opus 5.5.
Ціна, однак, не завжди означає економію. Той самий GPT-6-Sol у довгій задачі — побудувати курс «як Duolingo» для маркетингу — за ~4 години з’їв близько 22% тижневого ліміту на тарифі Codex за $100. GPT-6-Astra, який може керувати Sol як «субагентами», витрачає ліміти ще агресивніше, тож тут доведеться уважно стежити за бюджетом.
Паралельно Anthropic розгортає екосистему навколо Claude: Claude Code cloud sessions вийшли з прев’ю — це фактично віддалений комп’ютер у хмарі, де модель може виконувати завдання без прив’язки до вашого Mac. Для чинних підписників є одноразовий кредит: $100 на плані Pro та $250 на Max, якщо встигнути активувати до 7 жовтня. Плюс дрібні, але приємні речі — наприклад, підтримка кількох акаунтів у мобільному додатку.
Чому це важливо
Для українських команд, фрилансерів і стартапів це оновлення — не просто «нові цифри у версіях», а реальний перегляд робочого стеку ІІ. На мій погляд, зараз варто зробити кілька практичних кроків.
- Перерахувати економіку задач. Якщо ви активно користуєтеся Codex чи ChatGPT Work, нові ціни на GPT-6 Luna/Sol можуть суттєво знизити чек за великі проєкти. Але важливо дивитися не тільки на $/млн токенів, а й на те, як швидко модель «спалює» ліміти на довгих процесах.
- Порівняти якість Opus 5.5 і GPT-6-Sol під свої кейси. Для генерації текстів, досліджень, коду й агентних сценаріїв Claude Opus 5.5 зараз виглядає дуже сильним кандидатом. Раджу зробити невеликий внутрішній бенчмарк на ваших реальних задачах, а не покладатися лише на загальні рейтинги.
- Тестувати хмарні сесії замість локальних машин. Claude Code cloud sessions можуть замінити «вічно відкритий ноутбук» для довгих пайплайнів: парсинг, аналітика, генерація контенту, експерименти з агентами. З урахуванням промо-кредитів це шанс зрозуміти, чи варто переносити частину інфраструктури в такий формат.
- Планувати гібридний стек. Уже очевидно, що «одна модель на все» — не найкраща стратегія. Розумний підхід — комбінувати: дешевші моделі (на кшталт GPT-6 Luna) для рутинних задач із великими обсягами, Opus 5.5 чи GPT-6-Sol — для складних рішень, де важлива якість мислення.
Ринок ІІ-моделей швидко рухається в бік дешевших, але більш «агентних» інструментів. Виграють ті, хто встигне не просто спробувати нові назви, а вбудувати їх у процеси — з чітким розумінням, де саме Claude чи GPT дають вам реальну перевагу.
Джерело: Ben's Bites (https://www.bensbites.com/p/back-to-claude)