Все выпуски

Выпуск #5 · 9 сентября 2026 г. · 39:51

AI-агенты: почему лучшие практики противоречат друг другу | ИИ — не новости

Владимир Гриненко Сергей Бережной ИИ-агенты Разработка с ИИ Контекст и промптинг Тестирование и evals

Ведущий, Ведущий · Гриненко про, V & C

Описание

— Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции? — Одна дорогая модель или умный оркестратор и рой дешёвых агентов: как два исследования получили противоположные результаты — и почему оба могут быть правы? — Когда высокий reasoning помогает, а когда модель начинает сомневаться, ходить кругами и просто жечь токены? — Почему AI-разработку почти невозможно нормально забенчмаркать и как работать в мире, где сегодняшняя best practice через две недели может оказаться анти-паттерном? — И заодно: неужели нейронки всё-таки научились шутить?

В выпуске

  • Почему одна и та же нейронка сначала уверенно говорит, что задача не решается, а потом сама чинит её за 20 минут — и почему иногда «сделай хорошо» работает лучше подробной инструкции?
  • Одна дорогая модель или умный оркестратор и рой дешёвых агентов: как два исследования получили противоположные результаты — и почему оба могут быть правы?
  • Когда высокий reasoning помогает, а когда модель начинает сомневаться, ходить кругами и просто жечь токены?
  • Почему AI-разработку почти невозможно нормально забенчмаркать и как работать в мире, где сегодняшняя best practice через две недели может оказаться анти-паттерном?
  • И заодно: неужели нейронки всё-таки научились шутить?

Тайм-коды

00:00 — ИИ — не новости
00:47 — Codex сказал, что это невозможно. А потом взял и сделал
04:14 — 2 миллиарда токенов и борьба за токен-эффективность
07:31 — Одна дорогая модель или дешёвые исполнители?
11:59 — Cursor посчитал то же самое — и получил противоположный результат
14:47 — Как передавать контекст между агентами
19:18 — Умный оркестратор или тупой роутер
25:31 — Когда слишком высокий reasoning только мешает
30:40 — Почему AI-разработку так сложно измерять
35:20 — Нейронки наконец научились шутить?
39:21 — Почему накопленный опыт нужно регулярно ставить под сомнение

Материалы и ссылки

Связанные выпуски

Продолжить тему

Смотреть следующим

Выпуск #1 · 34:25 Сингулярность, graph-loop engineering, 75–75–75

Смотреть и слушать

Там, где вам удобно