Такие разборы я выкладываю регулярно, короткий пост по этой теме лежит здесь
Что я называю армией агентов
Коротко: армия - это несколько ролей с общей головой, а не набор отдельных программ.
Когда говорят «я создал армию ИИ-агентов, и они работают за меня», обычно рисуют картинку из десятка ботов, которые сами что-то делают ночью. На практике такая картинка разваливается на первом же вопросе: кто из них сейчас занят, кто ждёт моего ответа и что случится, если один из них ошибётся.
Поэтому я называю армией другое. Есть одна точка входа, куда я ставлю задачу. Есть роли, которые эту задачу берут. Есть память, чтобы завтрашняя сессия знала, что было вчера. И есть гейты - места, где действие ждёт моего подтверждения. Всё остальное - детали реализации.
На что я спорю
Коротко: я спорю с идеей, что чем больше агентов, тем больше работы они снимают.
Количество агентов не измеряет ничего. Измеряет другое: сколько задач дошло до результата без моей правки и сколько раз мне пришлось разбираться в том, что агент сделал сам. Если агентов десять, а разбираться приходится каждый день, я не получил армию, я получил десять новых источников забот.
Вторая вещь, с которой спорю: ощущение, что агент «экономит часы». Без подсчёта это ощущение, а не экономия. Как считать без самообмана, я разбирал отдельно: Сколько времени экономит ИИ-агент: как посчитать без самообмана. В этой части я цифр экономии не привожу: замера по Джарвису для публикации у меня пока нет, и подставлять число из общего ощущения не буду.
Чек-лист из пяти вопросов перед сборкой агента
Коротко: если на любой из пяти вопросов нет ответа, агента рано делать.
Забирайте целиком, он работает для любого агента, не только для моего:
- Откуда приходит задача? Одно место, откуда вы её ставите. Если задачи придётся нести в агента руками из трёх разных мест, вы станете его диспетчером.
- Где агент хранит, что было вчера? Без памяти между сессиями каждый запуск начинается с нуля, и вы каждый раз заново объясняете контекст.
- Какие действия уходят наружу? Письмо клиенту, публикация, платёж, удаление. Для каждого из них заранее решено, что оно ждёт вашего подтверждения.
- Как вы узнаете, что агент завис или ошибся? Тишина должна считаться сбоем. Если об этом можно узнать только случайно, это не система.
- Чем вы проверите результат? Не «выглядит нормально», а конкретным признаком: файл создан, запись есть, ответ пришёл.
Ответы на эти вопросы заняли у меня больше времени, чем сами агенты. Но именно они определили, что получилось не игрушкой.
Разобрать такую схему под вашу задачу можно на витрине кейсов, там я собираю свои разработки
Как это устроено у меня
Коротко: Джарвис - это один бот в Telegram, за которым стоят память, расписание и роли.
На 10 августа 2026 Джарвис работает вживую и поднимается сам. Закрыты фазы с нулевой по восьмую и ступень 9.1. В списке возможностей девять пунктов:
- задачи текстом и голосом из Telegram;
- память между сессиями;
- гейты подтверждений;
- роли нейро-команды;
- расписание;
- инжест чатов;
- офис агентов;
- супер-админка;
- разбор записей встреч.
Что здесь решает какую задачу. Точка входа решает вопрос «откуда приходит задача»: я пишу или наговариваю голосом в Telegram, и мне не нужно садиться за компьютер. Память решает вопрос «что было вчера». Гейты подтверждений решают вопрос «что уходит наружу»: действие, которое нельзя откатить, ждёт моего ответа. Роли нейро-команды решают вопрос «кто берёт задачу»: вместо одного универсального агента задачу получает исполнитель под свой тип работы. Расписание позволяет агентам запускаться без меня.
Про механику каждого пункта я здесь подробно не пишу: в описании проекта они названы, но не расписаны, а достраивать детали, которых нет в моих записях, я не стану. Если нужен разбор отдельного блока, он пойдёт одной из следующих частей.
Часть 1: что сделал и что вышло
Коротко: итог первой части - девять работающих возможностей на дату 10 августа 2026.
Дата: 10 августа 2026. Измеримый итог: закрыты фазы 0-8 и ступень 9.1, система поднимается сама. Это не оценка, а сверка с реестром фаз: каждая закрыта, когда её можно показать работающей, а не когда код написан.
Порядок, в котором я шёл, был простым. Сначала точка входа и память: без них нет смысла строить дальше. Потом гейты: пока нет гейтов, агентам нельзя давать ничего, что уходит наружу. Потом роли, расписание, приём чатов и записей встреч. Офис агентов и супер-админка пришли позже, когда нужно было видеть всю картину сразу.
Это решение, а не история ошибок. Историю поломок отдельных этапов я здесь не рассказываю: детального замера по ним для этой части нет. Она пойдёт в части 2 с датами и описанием того, что сломалось и что я поменял.
Что агенты не делают за меня
Коротко: решение, что делать, и ответственность за публикацию остаются у меня.
Агенты берут на себя рутину: принять задачу, найти контекст, подготовить черновик, запустить по расписанию. Решение о том, что задача вообще нужна, они не принимают. Подтверждение действий наружу тоже на мне.
Это не ограничение системы, а её главная защита. Агент, у которого есть доступ ко всему и нет гейтов, рано или поздно сделает то, что нельзя откатить. Часть работы, которую агенты не берут, и есть цена надёжности.
Если вам нужно сравнить подходы к внедрению нейросетей, а не только агентов, у меня есть отдельный разбор: Использовать нейросети в бизнесе: сравнил три способа, а не выбрал на глаз.
Чем мерю успех
Коротко: тремя признаками, которые можно сосчитать, а не оценить на глаз.
Вот что я считаю успехом агентной системы:
- Доля задач, дошедших до результата без моей правки. Если я каждый раз переделываю результат, агент экономит время только на бумаге.
- Число задач, остановленных гейтом. Это показывает, что гейты работают, а не стоят для вида.
- Время от постановки задачи до результата. Из него вычитаю то, что тратится на проверку.
Цифр по этим трём признакам для публикации у меня сейчас нет. Я назвал их заранее, чтобы в следующей части сравнивать с чем-то, а не придумывать задним числом.
Как повторить такое у себя
Коротко: начните с одного входа и одной памяти, а остальное добавляйте по мере появления узких мест.
Последовательность шагов для читателя, с честной оценкой того, что вы сделаете сами, а что потребует сборки:
- Выберите одну точку входа. Telegram, почта или форма. Это вы сделаете сами за вечер.
- Заведите память. Это файл или база, где лежат контекст и решения. Простой вариант делается самостоятельно, вариант с поиском по смыслу потребует сборки.
- Составьте список действий, которые уходят наружу. Для каждого решите, нужно ли подтверждение. Сделаете сами, это работа головой, а не кодом.
- Заведите одну роль и один тип задач. Не десять. Пока одна роль не доходит до результата стабильно, вторую не добавляйте.
- Проверьте руками несколько раз и только потом ставьте на расписание. Пропуск этого шага - главная причина, почему через месяц в папке с результатами пусто.
- Подключите видимость сбоя. Агент, который молчит, должен считаться сломанным. Это уже потребует сборки.
Если всё это держать в одной системе, получается то, что я называю армией. Но начинать с неё нельзя: начинать нужно с одной роли.
Грабли, которые закладываю заранее
Коротко: главные грабли - молчаливый сбой и действия наружу без подтверждения.
Три вещи, которые я закладываю в любую агентную систему до первого запуска:
- У каждого отказа есть след. Агент, который отказался, пропустил или упал, обязан это записать. Молчаливый сбой неотличим от работающей функции.
- Ничего наружу без гейта. Любое действие, которое нельзя откатить, ждёт подтверждения. Это работает как механизм, а не как пожелание в промпте.
- Результат принимается по признаку, а не по ощущению. «Агент сказал, что готово» не считается готовым.
Что оставляю части 2
Коротко: в части 2 будет то, что я пока не готов подтвердить цифрами.
Что пойдёт в следующую часть:
- первые замеры по трём признакам успеха, с датами;
- разбор поломок отдельных этапов и того, что я поменял после них;
- разбор одного блока Джарвиса подробно, с механикой.
Первую часть закрываю тем, что есть: рабочая система и пять вопросов, по которым её можно повторить. Если захочется собрать похожее под вашу задачу, мостик ниже, к тому же шагу: витрина кейсов - здесь
Хотите такое же: напишите в личку
Коротко: похожую систему можно собрать под вашу задачу, начать можно с одного агента и одной роли.
Я могу собрать для вас агента, который берёт задачи из мессенджера, помнит контекст и ждёт подтверждения там, где ошибка стоит дорого. Напишите в личку кодовое слово «АРМИЮ АГЕНТОВ», и я пойму, что вы пришли из этой статьи.
