Цикл делегирования ИИ: плейбук вместо нового агента | Блог про ИИ-агентов для бизнеса — Михаил Ларькин

Цикл делегирования ИИ: плейбук вместо нового агента

Цикл делегирования ИИ превращает повторяющуюся задачу в живой плейбук из трёх частей: процесса, набора рабочих файлов и проверяемых критериев готовности. После каждого промаха меняется сам плейбук, поэтому на следующем запуске агент уже не повторяет ту же ошибку.

Цикл делегирования ИИ превращает повторяющуюся задачу в живой плейбук из трёх частей: процесса, набора рабочих файлов и проверяемых критериев готовности. После каждого промаха меняется сам плейбук, поэтому на следующем запуске агент уже не повторяет ту же ошибку.

В Actionable AI эту идею объяснили через четыре готовых промпта. Я переложил метод на русский язык, убрал привязку к одному сервису и добавил то, чего обычно не хватает в подобных гайдах: как выбрать первую задачу, где держать мастер-копию и чем заменить расплывчатое «вроде нормально».

СМЕНА ПОДХОДА
ОБЫЧНО
Новый агент под каждую задачу
Новый промпт, новая связка инструментов и новая точка поломки.
ПРАКТИЧНЕЕ
Один плейбук под одну работу
Процесс, нужные файлы и проверки лежат рядом и улучшаются вместе.

Почему отдельные агенты быстро начинают мешать

Первая версия агентной системы обычно выглядит убедительно: отдельный агент пишет письма, второй собирает отчёт, третий ищет лиды, а четвёртый распределяет задачи между ними. На демо всё аккуратно, однако через пару недель меняется таблица, появляется новый шаблон или клиент просит другой формат, и тогда приходится искать, в каком из промптов спряталось старое правило.

Vercel прошёл этот путь на собственном аналитическом агенте. Компания убрала 80% специальных инструментов и дала общей модели доступ к хорошо организованным YAML, Markdown и JSON-файлам. В тесте на пяти типовых запросах среднее время сократилось с 274,8 до 77,4 секунды, расход токенов снизился примерно на 37%, а успешность выросла с четырёх задач из пяти до пяти из пяти. Важно ограничение: подход сработал потому, что данные уже были хорошо описаны. Беспорядочная папка просто выдаёт плохой результат быстрее.

Anthropic предлагает похожую конструкцию в Agent Skills: одна папка содержит инструкцию SKILL.md, а рядом лежат скрипты, справочники и примеры. Агент загружает их по необходимости, поэтому вам не приходится каждый раз втискивать весь опыт компании в один огромный промпт.

Агенту нужна ваша рабочая кухня: где брать данные, как вы выбираете между вариантами и по каким признакам понимаете, что результат уже можно отправлять.

Если хочется сначала настроить сам агентный режим и доступ к локальным файлам, начните с инструкции как установить ИИ-агента на компьютер. Ниже разберём именно слой делегирования поверх уже работающего Claude Code, Codex или другого агента с доступом к папке.

Как выбрать первую задачу для плейбука

Не начинайте с «вести весь маркетинг» или «управлять компанией». Первый плейбук должен быть достаточно маленьким, чтобы его можно было проверить за один вечер, и достаточно частым, чтобы уже через неделю вы увидели, повторяет ли агент старые ошибки.

Хотя бы раз в неделю
Иначе цикл улучшения растянется на месяцы.
Да / нет
Качество легко узнать
Вы сразу видите хороший и плохой вариант.
20 мин
Можно объяснить новичку
Если объяснение занимает день, задача пока велика.

Подходящие первые кандидаты: еженедельный отчёт клиенту, проверка входящего счёта, подготовка к встрече, первичный разбор лида, публикация готовой статьи. Выбирайте работу, которую уже умеете делать сами. Тогда вы заметите ошибку до того, как она уйдёт наружу.

Три слоя, без которых делегирование не складывается

Три слоя плейбука для ИИ: процесс, набор инструментов и проверка результата
Плейбук держится на трёх слоях. Уберите любой, и контроль снова вернётся к человеку.

Процесс описывает порядок действий и ваши развилки. Набор инструментов хранит всё, что можно использовать повторно. Проверка результата заставляет агента предъявить доказательства до того, как работа попадёт к вам.

Эти слои связаны, но чинить их лучше отдельно. Если агент пропустил шаг согласования, правьте процесс. Если он второй раз собирает одинаковую таблицу с нуля, добавьте шаблон или скрипт в набор инструментов. Если ошибка дошла до вас, потому что её никто не проверил, добавьте критерий готовности.

Слой 1. Вытащить процесс из головы

Самая сложная часть живёт в привычках, которые вы уже не замечаете. Перед отчётом вы смотрите на число с самым большим отклонением, сравниваете его с планом, вспоминаете обещание с прошлого созвона и только потом решаете, с чего начать письмо. Обычный регламент теряет половину этих решений, потому что автор считает их очевидными.

Поэтому плейбук лучше собирать через интервью. Пусть агент задаёт по одному вопросу и не торопится писать инструкцию после первых трёх ответов.

Промпт 1. Собрать процесс через интервью
Помоги превратить повторяющуюся работу «[название задачи]» в плейбук, который ты сможешь выполнять без моих подсказок.

Сначала проведи интервью. Задавай по одному вопросу и жди ответа. Выясни:

  1. Что запускает работу и как часто она возникает.
  2. Где лежат входные данные и кто отвечает за их актуальность.
  3. Какие шаги я выполняю по порядку.
  4. В каких местах я выбираю между вариантами и по какому правилу.
  5. Какие ошибки уже случались.
  6. Как выглядит хороший результат и что делает вариант неприемлемым.

Не пиши плейбук, пока не задашь минимум восемь содержательных вопросов и я не подтвержу, что рассказал всё важное.

После интервью создай SKILL.md с разделами: назначение, когда запускать, входные данные, шаги, решения, критерии готовности, исключения. Покажи файл целиком и отдельно спроси: «Что я понял неправильно?» и «Что вы делаете автоматически, но не успели проговорить?»

Хороший результат этого шага читается как инструкция новому сотруднику, а не как пожелание «сделай профессионально». В нём указаны места, названия файлов, порядок действий и правила выбора.

Слой 2. Сохранить всё, что агент не должен собирать заново

Если агент каждую неделю заново придумывает структуру отчёта, вспоминает правильное написание имени клиента и пишет один и тот же скрипт для выгрузки чисел, вы делегировали задачу только наполовину. Плейбук должен ссылаться на готовые детали так же, как повар пользуется рецептом, ножами и уже подписанными банками со специями.

НЕ ХРАНИТЬ
Одноразовые результаты
Черновики, временные выгрузки, ключи, пароли и всё, что вы ещё не приняли.
СОХРАНЯТЬ
Повторно используемые детали
Шаблоны, скрипты, справочники, правила тона и хорошие примеры.

Для отчёта клиенту это может быть numbers-pull.py, шаблон письма, справочник с написанием брендов, плановые показатели и два прошлых отчёта, на которые клиент хорошо отреагировал. Для публикации статьи набор будет другим: структура frontmatter, визуальные шаблоны, SEO-проверки и примеры удачных материалов.

Промпт 2. Пополнить набор инструментов
Посмотри на результат, который мы только что приняли, и найди части, пригодные для следующих запусков.

Для каждой такой части:

  1. Предложи понятное имя файла без даты и номера версии.
  2. Замени разовые данные на поля вида [клиент], [период], [ссылка].
  3. Сохрани один заполненный пример рядом с шаблоном, если он помогает понять стандарт.
  4. Добавь ссылку на новый файл в нужный шаг SKILL.md.
  5. Обнови files/INDEX.md: имя, назначение и дата добавления.

Не сохраняй пароли, ключи, сырые персональные данные, непринятые черновики и результат, который больше не понадобится.

После обновления снова запусти задачу с чистого входа. Перечисли, какие файлы ты использовал, а какие части снова построил с нуля. Последние считаются кандидатами на пополнение набора.

Слой 3. Проверять работу фактами, а не самооценкой агента

Фраза «проверь себя» редко помогает, потому что модель перечитывает тот же текст тем же взглядом и сообщает, что всё выглядит логично. Проверка становится полезной, когда может закончиться красным результатом.

ПРОВЕРКА МОЖЕТ НЕ ПРОЙТИ
Число
Есть в исходной выгрузке.
Ссылка
Открывается и ведёт туда, куда обещано.
Тест
Возвращает pass или fail.

Для клиентского отчёта критерии могут выглядеть так: каждая цифра находится в выгрузке за тот же период; имя клиента совпадает со справочником; прошлое обещание закрыто или прямо отмечено; письмо короче 200 слов; ссылка на дашборд открывается. Здесь нет слов «качественно» и «понятно», потому что их невозможно доказать.

Промпт 3. Добавить проверяемое определение готовности
Добавь в SKILL.md раздел «Критерии готовности» для задачи [название].

Сформулируй от пяти до десяти проверок. Каждая должна давать наблюдаемое доказательство вне твоей оценки: совпадение с исходным файлом, рабочую ссылку, результат теста, скриншот, точный счётчик или сверку со справочником.

Перед выдачей результата:

  1. Выполни все проверки.
  2. Исправь провалы.
  3. Повтори проверки.
  4. Покажи короткий отчёт pass/fail с доказательством по каждому пункту.
  5. Отдельно перечисли то, что не удалось проверить.

Если на первом проходе провалились три проверки или больше, не латай финальный файл по одной строчке. Найди шаг процесса, из-за которого посыпалась работа, и сначала исправь его.

Ошибку нужно записывать в плейбук, пока она свежая

Самая частая поломка происходит уже после запуска. Агент сделал почти всё правильно, вы поправили одну фразу в чате, отправили результат и забыли. Через неделю история повторяется, потому что новый разговор не знает о прошлой коррекции.

Цикл улучшения плейбука: запустить задачу, проверить результат, найти слой ошибки и исправить файл
Коррекция приносит пользу только тогда, когда переживает текущий чат.

Сначала определите слой сбоя. Пропущенное действие относится к процессу. Повторное изобретение уже существующей детали относится к набору инструментов. Ошибка, которую можно было поймать до отправки, относится к проверке. После этого вносится минимальная правка, и та же задача запускается ещё раз на исходных данных.

Промпт 4. Превратить ошибку в постоянное улучшение
Результат оказался неверным: [коротко опишите конкретную ошибку].

Определи, где возник сбой:

  • в процессе, если не хватило шага, порядка или правила выбора;
  • в наборе инструментов, если нужный файл отсутствует, устарел или был создан заново;
  • в проверке, если ошибка дошла до меня, хотя её можно было обнаружить заранее.

Объясни диагноз двумя предложениями. Затем внеси минимальную правку в соответствующий файл, не переписывая весь плейбук.

Если такая ошибка случилась второй раз, добавь прямое правило, которое её блокирует. Запиши в notes.md дату, симптом, причину и сделанную правку.

После изменений повтори задачу с теми же входными данными и покажи, какая проверка теперь ловит старую ошибку.

Как выглядит плейбук на примере отчёта клиенту

Допустим, каждую пятницу менеджер отправляет клиенту короткий отчёт по рекламе. Руками он открывает дашборд, сравнивает неделю с планом, находит самый сильный сдвиг, вспоминает обещание с прошлого созвона и пишет письмо без рекламного блеска.

БЫЛО
Пять вкладок и память менеджера
Цифры копируются руками, прошлые договорённости иногда теряются, стиль зависит от загрузки.
СТАЛО
Папка и один запуск
Агент тянет данные, собирает черновик, проверяет числа и показывает только готовый вариант.

В SKILL.md лежит порядок действий. В files/ находятся скрипт выгрузки, шаблон письма, плановые показатели и написание имён. В examples/ лежат два принятых отчёта. В notes.md накапливаются редкие ошибки, по которым видно, где процесс всё ещё держится на голове менеджера.

ПАПКА ОДНОЙ РАБОТЫ
SKILL.md
шаги, решения, критерии готовности
files/
скрипт, шаблон, справочник, план
examples/
принятые результаты с короткой пометкой
notes.md
ошибки и изменения, новые сверху

На четвёртой неделе агент подставил число не из той колонки. Вместо поправки в переписке в критерии добавили сверку каждой цифры с исходной выгрузкой и периодом. На пятой неделе эта проверка упала до того, как отчёт увидел клиент. Вот в этот момент делегирование начинает накапливать качество.

Что сделать за первые 30 минут

10
Выберите одну частую работу
Берите повторяемую задачу, качество которой вы умеете быстро оценивать.
15
Пройдите интервью из первого промпта
Отвечайте реальными примерами, особенно на раздражающие вопросы.
5
Добавьте первые проверки
Пусть хотя бы три критерия могут честно вернуть fail.

Потом запустите задачу дважды. Первый запуск покажет, чего не хватает в процессе, а второй быстро выдаст всё, что агент снова построил с нуля и что пора сохранить в набор инструментов.

Есть одно неудобное ограничение. В Claude Code, Codex и других агентах с доступом к файлам плейбук обновляется прямо в рабочей папке. В обычном браузерном чате загруженный файл чаще всего остаётся снимком: вы получите новую версию в ответе, но мастер-копию придётся заменить вручную. Поэтому заранее решите, где хранится единственный актуальный вариант, иначе через месяц агент начнёт читать две противоречащие инструкции.

Следующий масштаб этого подхода, вся операционная система бизнеса, разобран в статье как стать AI-native компанией.

Возьмите одну задачу и проведите два запуска
Если после второго раза объяснений стало меньше, плейбук работает. Если нет, причина уже видна: процесс, набор файлов или проверка.
Автор
Михаил Ларькин

Исследую, как строить бизнес с AI-агентами. Провёл корпоративное обучение в десятках компаний.

Статью подготовила моя контент-система, проверил и подписал я Как это работает

Telegram-канал

Источники

  • The AI Delegation Loop
    Исходная идея трёхслойного плейбука и цикла исправлений; статья ниже является самостоятельной русской адаптацией, а не построчным переводом.
  • Equipping agents for the real world with Agent Skills
    Описание Agent Skills как папок с инструкциями, скриптами и ресурсами, а также рекомендации развивать их по наблюдаемым ошибкам.
  • We removed 80% of our agent’s tools
    Сравнение сложной агентной архитектуры с подходом через файловую систему: скорость, расход токенов и доля успешных задач.
  • How to build agents with filesystems and bash
    Практический разбор того, как агент ищет контекст в обычной структуре файлов.

FAQ

Что такое цикл делегирования ИИ?

Это способ передать повторяющуюся работу ИИ через плейбук из трёх слоёв: описание процесса, набор нужных файлов и проверяемые критерии готовности. Каждая найденная ошибка превращается в правку соответствующего слоя и остаётся в системе для следующих запусков.

Чем плейбук отличается от длинного промпта?

Промпт живёт внутри одного разговора. Плейбук хранится отдельно, ссылается на шаблоны, скрипты и примеры, а также содержит проверки результата. Его можно запускать снова и улучшать после каждой итерации.

Какую задачу первой передать ИИ?

Подойдёт задача, которая повторяется хотя бы раз в неделю, имеет понятный хороший результат и объясняется новому сотруднику за 15-20 минут. Сложный сквозной процесс лучше оставить на потом.

Где хранить плейбук?

Если агент умеет работать с файлами, храните плейбук в отдельной папке рядом с рабочими материалами. Для браузерного чата держите мастер-копию на компьютере или в облаке и заменяйте загруженную версию после каждой правки.

Как понять, что результат ИИ готов?

Каждый критерий должен давать внешнее доказательство: число совпадает с источником, ссылка открывается, тест проходит, имя сверено со справочником, а итоговый файл отображается без ошибок. Формулировка «выглядит хорошо» проверкой не считается.