Skip to content

Разбор передовых harness

В этом разделе теория harness из лекций сопоставляется с актуальными передовыми продуктами. В каждом продукте нас интересует только одно: как устроен его harness — то есть слой инженерной инфраструктуры вокруг модели: пять подсистем — инструкции, инструменты, среда, состояние и обратная связь, — а также ключевые механизмы непрерывности контекста, инициализации, верификации, наблюдаемости, handoff и циклов.

Мы намеренно не обсуждаем, насколько сильны рассуждения модели, насколько высок её результат в отдельном бенчмарке и «что умеет этот agent» в целом. Это вопросы уровня модели и продукта. Здесь мы разбираем только harness — всё, что находится за пределами весов модели.

Зачем это разбирать

В первой лекции говорилось: мощная модель ещё не означает надёжного выполнения. Одна и та же модель в разных harness может показывать результаты, отличающиеся на порядок. Но лекции объясняют, «как следует делать», а эти продукты показывают, «как это на практике делают ведущие команды».

Каждый продукт — это самостоятельный набор проектных решений. Сопоставив их, вы увидите, как одни и те же ключевые механизмы совершенно по-разному реализуются разными командами:

  • Pi строит harness как минималистичное ядро с программируемыми расширениями и занимается инженерией контекста по принципу «минимальный системный prompt + загрузка по требованию».
  • Claude Code превращает harness в полноценную runtime-среду: многоуровневая память, пятиуровневая compaction, permissions, hooks и subagent.
  • Codex доводит философию harness до предела: репозиторий — источник истины, AGENTS.md — лишь страница-оглавление, а worktree изолирует среду.
  • DeepSeek Harness и вовсе определяет сам harness как независимый от модели runtime: Everything is a Plugin.

Список статей

Как читать

Рекомендуем сначала прочитать первые лекции курса — особенно лекцию 2 «Что такое harness на самом деле» — и освоить модель пяти подсистем, а затем вернуться сюда и посмотреть, как эти механизмы реализованы в реальных продуктах.

В конце каждой статьи есть два раздела — «Сопоставление с фреймворком курса» и «Дизайнерские решения, которые стоит перенять». Они помогут быстро перевести продуктовые решения обратно в понятия курса и применить их в собственном проекте.