Канал

17 июня 2026 г.

Линейный аттеншн все реальнее

Линейный аттеншн все реальнее

Subquadratic опубликовали техрепорт SubQ 1.1 Small с независимыми эвалами от Appen и там все красиво: выбивает 100% в Needle-In-A-Haystack (NIAH) на 1M–2M контексте, 98% на 12M и 89.7% pass@4 на LiveCodeBench.

Я уже писал про них, когда они только появились и после публикации первых независимых бенчмарков. Теперь есть техрепорт, правда все еще без конкретных подробностей про механизм SSA, но кое-что из него уже понятно.

Они взяли существующую открытую модель, заменили dense attention на SSA, а затем дообучили ее на длинных данных. Контекст расширяли стадиями: 262K → 512K → 1M → 2M, используя YaRN; основная часть дообучения была на 1M токенов, немного — на 2M.

Тем не менее остается еще много мутных моментов. Звучат они очень амбициозно и если все правда, то действительно «субагенты больше не нужны» (а заодно RAG и прочие костыли для управления контекстом), но я не исключаю, что на практике получится близко к результатам Kimi Linear.

В общем, ждем доступа и нормальных проверок на реальных задачах.

@devspotting