23 апреля 2026 г.
GPT-5.5

GPT-5.5
What a week, huh? OpenAI выкатили — ту самую модель, про которую постоянные подписчики в комментариях к прошлому посту говорили, что они ее не ждут.
А зря. По бенчмаркам GPT-5.5 посрамила Opus 4.7:
- Terminal-Bench 2.0 — GPT-5.5 82.7% против 69.4%% у Opus 4.7
- GDPval (реальная рабочая ценность по 44 профессиям): 84.9% vs 80.3% у Opus
- BrowseComp и FrontierMath — тоже в пользу OpenAI
Отдельно про SWE-Bench Pro: формально Opus 4.7 ведёт — 64.3% против 58.6% у GPT-5.5. Но сами Антропики признали, что Opus на части задач этого бенча поймали на запоминании ответов 🤷♂️
Из остального:
- Более токен-эффективна, чем GPT-5.4 — те же задачи с меньшим расходом. Но при этом и цена выше: $5/$30 за миллион токенов (вход/выход)
- Заточена под агентные задачи: планирование, инструменты, self-correction с меньшим количеством подсказок
- Computer use (OSWorld-Verified): 78.7%
Пишут, что модель уже раскатывают для всех, но на момент написания поста у меня в подписке Plus её ещё нет. Всё-таки жду.