31 мая 2026 г.
Материалы к мастер-классу по контекст-инженерии на CodeFest

Материалы к мастер-классу по контекст-инженерии на CodeFest
LLM предсказывает следующий токен и сама по себе больше ничего не может.
Выбираем модель (на 30.05.2026)
* GPT-5.5 — лучшая модель для большинства задач
* Opus 4.8 — самая дорогая, хороша для генерации UI
* Deepseek Pro/Flash — лучшая по соотношению цена/качество
* Qwen3.6-27B / 35B — лучшие модели для локального инференса
Бесплатные модели
* В OpenCode сейчас бесплатно доступны: DeepSeek V4 Flash, MiMo V2.5 и Nemotron 3 Super.
* В OpenRouter (при условии однократного пополнения счета на $10):
Owl Alpha, Nemotron 3 Super, Laguna M.1, gpt-oss-120b, GLM 4.5 Air и другие.
Пиратские аккаунты Gemini на plati.market (на свой страх и риск!).
Обвязка обеспечивает агентный цикл с вызовом инструментов — возможность LLM совершать какие-либо действия (читать и редактировать файлы, вызывать bash-команды, делать http-запросы и т.д.).
Обвязки бывают консольные, десктопные, в виде плагинов к IDE и облачные, но это лишь вопрос предпочтений.
Примеры обвязок: Codex, Claude Code, Antigravity, OpenCode, Pi. Последние две работают из любой географии.
Варианты взаимодействия с агентом
* Сразу задаем промпты для изменения кода — применимо для очень небольших точечных правок
* Используем режим планирования в любимой обвязке
* Spec-Driven development: спека существует только на этапе планирования / спека хранится рядом с кодом / спека — главный источник истины
Фреймворки для Spec-driven development
* OpenSpec
* grill-with-docs
* Superpowers
MCP
* Context7
Хорошие практики
* Вместе с нейронкой составить базовый AGENTS.md и автоматически его актуализировать
* Пусть модель задает уточняющие вопросы и помогает составлять промпты
* Пусть агент сам исследует причины возникающих проблем и формулирует правила на будущее
* Регулярно очищаем контекстное окно
* Разные роли и разные модели на разные задачи
* Добавлять в промпт примеры: как хорошо и как плохо
* Макеты / схемы на вход
* План, по которому модель сама итерируется (с тестами)
* Пусть агент проверяет результат генерации
* Пусть агент использует ваши консольные тулы
* Несколько параллельных потоков
* Не всегда максимальный уровень размышлений полезен
* «Запекаем» результаты
UPD: репозиторий.