Такие разборы я выкладываю регулярно, короткий пост по этой теме лежит здесь

Что я называю армией агентов

Коротко: армия - это несколько ролей с общей головой, а не набор отдельных программ.

Когда говорят «я создал армию ИИ-агентов, и они работают за меня», обычно рисуют картинку из десятка ботов, которые сами что-то делают ночью. На практике такая картинка разваливается на первом же вопросе: кто из них сейчас занят, кто ждёт моего ответа и что случится, если один из них ошибётся.

Поэтому я называю армией другое. Есть одна точка входа, куда я ставлю задачу. Есть роли, которые эту задачу берут. Есть память, чтобы завтрашняя сессия знала, что было вчера. И есть гейты - места, где действие ждёт моего подтверждения. Всё остальное - детали реализации.

На что я спорю

Коротко: я спорю с идеей, что чем больше агентов, тем больше работы они снимают.

Количество агентов не измеряет ничего. Измеряет другое: сколько задач дошло до результата без моей правки и сколько раз мне пришлось разбираться в том, что агент сделал сам. Если агентов десять, а разбираться приходится каждый день, я не получил армию, я получил десять новых источников забот.

Вторая вещь, с которой спорю: ощущение, что агент «экономит часы». Без подсчёта это ощущение, а не экономия. Как считать без самообмана, я разбирал отдельно: Сколько времени экономит ИИ-агент: как посчитать без самообмана. В этой части я цифр экономии не привожу: замера по Джарвису для публикации у меня пока нет, и подставлять число из общего ощущения не буду.

Чек-лист из пяти вопросов перед сборкой агента

Коротко: если на любой из пяти вопросов нет ответа, агента рано делать.

Забирайте целиком, он работает для любого агента, не только для моего:

  1. Откуда приходит задача? Одно место, откуда вы её ставите. Если задачи придётся нести в агента руками из трёх разных мест, вы станете его диспетчером.
  2. Где агент хранит, что было вчера? Без памяти между сессиями каждый запуск начинается с нуля, и вы каждый раз заново объясняете контекст.
  3. Какие действия уходят наружу? Письмо клиенту, публикация, платёж, удаление. Для каждого из них заранее решено, что оно ждёт вашего подтверждения.
  4. Как вы узнаете, что агент завис или ошибся? Тишина должна считаться сбоем. Если об этом можно узнать только случайно, это не система.
  5. Чем вы проверите результат? Не «выглядит нормально», а конкретным признаком: файл создан, запись есть, ответ пришёл.

Ответы на эти вопросы заняли у меня больше времени, чем сами агенты. Но именно они определили, что получилось не игрушкой.

Разобрать такую схему под вашу задачу можно на витрине кейсов, там я собираю свои разработки

Как это устроено у меня

Коротко: Джарвис - это один бот в Telegram, за которым стоят память, расписание и роли.

На 10 августа 2026 Джарвис работает вживую и поднимается сам. Закрыты фазы с нулевой по восьмую и ступень 9.1. В списке возможностей девять пунктов:

Что здесь решает какую задачу. Точка входа решает вопрос «откуда приходит задача»: я пишу или наговариваю голосом в Telegram, и мне не нужно садиться за компьютер. Память решает вопрос «что было вчера». Гейты подтверждений решают вопрос «что уходит наружу»: действие, которое нельзя откатить, ждёт моего ответа. Роли нейро-команды решают вопрос «кто берёт задачу»: вместо одного универсального агента задачу получает исполнитель под свой тип работы. Расписание позволяет агентам запускаться без меня.

Про механику каждого пункта я здесь подробно не пишу: в описании проекта они названы, но не расписаны, а достраивать детали, которых нет в моих записях, я не стану. Если нужен разбор отдельного блока, он пойдёт одной из следующих частей.

Часть 1: что сделал и что вышло

Коротко: итог первой части - девять работающих возможностей на дату 10 августа 2026.

Дата: 10 августа 2026. Измеримый итог: закрыты фазы 0-8 и ступень 9.1, система поднимается сама. Это не оценка, а сверка с реестром фаз: каждая закрыта, когда её можно показать работающей, а не когда код написан.

Порядок, в котором я шёл, был простым. Сначала точка входа и память: без них нет смысла строить дальше. Потом гейты: пока нет гейтов, агентам нельзя давать ничего, что уходит наружу. Потом роли, расписание, приём чатов и записей встреч. Офис агентов и супер-админка пришли позже, когда нужно было видеть всю картину сразу.

Это решение, а не история ошибок. Историю поломок отдельных этапов я здесь не рассказываю: детального замера по ним для этой части нет. Она пойдёт в части 2 с датами и описанием того, что сломалось и что я поменял.

Что агенты не делают за меня

Коротко: решение, что делать, и ответственность за публикацию остаются у меня.

Агенты берут на себя рутину: принять задачу, найти контекст, подготовить черновик, запустить по расписанию. Решение о том, что задача вообще нужна, они не принимают. Подтверждение действий наружу тоже на мне.

Это не ограничение системы, а её главная защита. Агент, у которого есть доступ ко всему и нет гейтов, рано или поздно сделает то, что нельзя откатить. Часть работы, которую агенты не берут, и есть цена надёжности.

Если вам нужно сравнить подходы к внедрению нейросетей, а не только агентов, у меня есть отдельный разбор: Использовать нейросети в бизнесе: сравнил три способа, а не выбрал на глаз.

Чем мерю успех

Коротко: тремя признаками, которые можно сосчитать, а не оценить на глаз.

Вот что я считаю успехом агентной системы:

Цифр по этим трём признакам для публикации у меня сейчас нет. Я назвал их заранее, чтобы в следующей части сравнивать с чем-то, а не придумывать задним числом.

Как повторить такое у себя

Коротко: начните с одного входа и одной памяти, а остальное добавляйте по мере появления узких мест.

Последовательность шагов для читателя, с честной оценкой того, что вы сделаете сами, а что потребует сборки:

  1. Выберите одну точку входа. Telegram, почта или форма. Это вы сделаете сами за вечер.
  2. Заведите память. Это файл или база, где лежат контекст и решения. Простой вариант делается самостоятельно, вариант с поиском по смыслу потребует сборки.
  3. Составьте список действий, которые уходят наружу. Для каждого решите, нужно ли подтверждение. Сделаете сами, это работа головой, а не кодом.
  4. Заведите одну роль и один тип задач. Не десять. Пока одна роль не доходит до результата стабильно, вторую не добавляйте.
  5. Проверьте руками несколько раз и только потом ставьте на расписание. Пропуск этого шага - главная причина, почему через месяц в папке с результатами пусто.
  6. Подключите видимость сбоя. Агент, который молчит, должен считаться сломанным. Это уже потребует сборки.

Если всё это держать в одной системе, получается то, что я называю армией. Но начинать с неё нельзя: начинать нужно с одной роли.

Грабли, которые закладываю заранее

Коротко: главные грабли - молчаливый сбой и действия наружу без подтверждения.

Три вещи, которые я закладываю в любую агентную систему до первого запуска:

Что оставляю части 2

Коротко: в части 2 будет то, что я пока не готов подтвердить цифрами.

Что пойдёт в следующую часть:

Первую часть закрываю тем, что есть: рабочая система и пять вопросов, по которым её можно повторить. Если захочется собрать похожее под вашу задачу, мостик ниже, к тому же шагу: витрина кейсов - здесь

Хотите такое же: напишите в личку

Коротко: похожую систему можно собрать под вашу задачу, начать можно с одного агента и одной роли.

Я могу собрать для вас агента, который берёт задачи из мессенджера, помнит контекст и ждёт подтверждения там, где ошибка стоит дорого. Напишите в личку кодовое слово «АРМИЮ АГЕНТОВ», и я пойму, что вы пришли из этой статьи.