Канал

23 апреля 2026 г.

GPT-5.5

GPT-5.5

What a week, huh? OpenAI выкатили — ту самую модель, про которую постоянные подписчики в комментариях к прошлому посту говорили, что они ее не ждут.

А зря. По бенчмаркам GPT-5.5 посрамила Opus 4.7:

- Terminal-Bench 2.0 — GPT-5.5 82.7% против 69.4%% у Opus 4.7
- GDPval (реальная рабочая ценность по 44 профессиям): 84.9% vs 80.3% у Opus
- BrowseComp и FrontierMath — тоже в пользу OpenAI

Отдельно про SWE-Bench Pro: формально Opus 4.7 ведёт — 64.3% против 58.6% у GPT-5.5. Но сами Антропики признали, что Opus на части задач этого бенча поймали на запоминании ответов 🤷‍♂️

Из остального:
- Более токен-эффективна, чем GPT-5.4 — те же задачи с меньшим расходом. Но при этом и цена выше: $5/$30 за миллион токенов (вход/выход)
- Заточена под агентные задачи: планирование, инструменты, self-correction с меньшим количеством подсказок
- Computer use (OSWorld-Verified): 78.7%

Пишут, что модель уже раскатывают для всех, но на момент написания поста у меня в подписке Plus её ещё нет. Всё-таки жду.

@devspotting