Динар Хисамов

Как работает ИИ-агент: что видно только после второй недели

Опубликовано 30 августа 2026Обновлено 2 сентября 202610 мин чтенияНачальный
Ноутбук с открытым интерфейсом на светлом столе у окна
Чему вы научитесь
  • из каких четырёх частей собран любой ИИ-агент и что делает каждая
  • чем агент отличается от сценария и когда сценарий выгоднее
  • пять признаков, по которым видно, что агент работает, а не делает вид
  • список вопросов продавцу, который отсеивает демонстрацию от рабочей системы
  • где у агента утекают деньги и как это заметить на второй неделе
Применить за 20 минут
Экономит один разбор внедрения, который иначе делается вслепую
Начальный
17просмотров
3поделились

Что называют ИИ-агентом и чем он отличается от чат-бота?

Разница видна на одной фразе. Боту говорят: «напиши текст письма». Агенту говорят: «разошли предложение по этому списку и покажи, кто ответил». Второе поручение нельзя выполнить одним ответом. Нужно посмотреть список, написать под каждого, отправить, дождаться, свести результат.

Отсюда и всё остальное: агенту нужна память между шагами, доступ к вашим системам и право что-то менять в реальном мире. Каждое из этих трёх свойств добавляет пользы и ровно столько же риска.

Промышленная формулировка звучит суше. В инженерном разборе Anthropic агентами называют системы, где модель сама управляет своими шагами и выбором инструментов, а сценариями (workflow) - системы, где путь задан заранее. Там же сказано прямо, когда что брать:

«Workflows offer predictability and consistency for well-defined tasks, whereas agents are the better option when flexibility and model-driven decision-making are needed at scale.»

- Anthropic, Building effective agents, 19.12.2024

Перевод на язык владельца: если шаги известны заранее, агент вам не нужен и обойдётся дороже.

Как устроен один ход агента

Разберём по частям, без терминов.

  1. Модель. Языковая модель, которая читает задание и решает, что делать дальше. Она не помнит вчерашний день сама по себе.
  2. Память. Хранилище, куда агент кладёт то, что должен помнить между шагами и между запусками: что уже сделано, что нашлось, где остановился.
  3. Планировщик. Правило, по которому агент дробит цель на шаги и решает, когда остановиться. Здесь же живёт потолок: сколько шагов и сколько денег он может потратить.
  4. Инструменты. Всё, чем агент действует: доступ к вашей базе, к почте, к сайту, к таблице. Без инструментов агент остаётся собеседником.

Один рабочий ход выглядит так: агент читает цель, выбирает первый шаг, зовёт инструмент, получает ответ, сверяет с целью и либо делает следующий шаг, либо останавливается и отчитывается. Дальше цикл повторяется, пока цель не закрыта или пока не кончился потолок.

Ключевое место здесь одно: между шагом и следующим шагом никто не проверяет, что предыдущий шаг был выполнен верно. Модель сверяет результат сама с собой. Это и есть источник почти всех бед, о которых дальше.

Если вы разбираетесь с этим, чтобы решить, стоит ли заводить такого исполнителя у себя, у меня об этом отдельно написано на странице помощника владельцу - там про то, какие задачи имеет смысл отдавать первыми.

Почему агент может месяц работать и не дать ни одного результата?

Ошибку видно. Ошибка красная, она падает в журнал, о ней приходит сообщение. Пустой ход не видно вообще: расписание сработало, процесс завершился с нулевым кодом, отчёт написан вежливо. Только результата нет.

Так бывает по четырём причинам, и все четыре одинаково молчаливы.

Задание устарело, а исполнитель нет. Инструкцию агенту поправили, но до места, где он живёт, правка не доехала. Он продолжает делать вчерашнюю работу и делает её безупречно.

Условие не наступило, и агент честно ничего не сделал. Он должен был обработать новые заявки, а новых заявок не было. Отличить это от поломки можно только по одному признаку: сказал ли он об этом вслух.

Потолок кончился раньше цели. У агента есть предел на шаги или на деньги. Он упёрся в него на середине и остановился. Если предел не назван в отчёте, снаружи это неотличимо от завершённой работы.

Дверь закрылась и правильно сделала. Хорошая проверка на выходе не пропускает недоделанное. Отказ проверки - это здоровое поведение, но, если о нём не кричат, он выглядит как молчание.

Личный опыт: за месяц ежедневных автономных запусков тихий пустой ход оказался самой дорогой поломкой из всех. Дорогой именно потому, что он не выглядит поломкой. Красная лампа зовёт чинить в тот же день, а вежливый отчёт не зовёт никого.

Когда агент не нужен и хватает обычного сценария?

Возьмите задачу и спросите: могу ли я нарисовать её на бумаге как последовательность из пяти-семи ящиков со стрелками, и будет ли эта картинка верна через месяц. Ответ «да» означает, что вам нужен сценарий, а не агент.

Признак задачиСценарийАгент
Шаги известны заранеедане обязательно
Число шагов заранее назвать нельзяплохо подходитподходит
Цена одного прогонакопейкизаметно дороже
Предсказуемость результатавысокаязависит от проверок
Что ломается чащевнешний сервиссамо решение о следующем шаге

Anthropic в том же разборе называет цену прямо:

«Agentic systems often trade latency and cost for better task performance, and you should consider when this tradeoff makes sense.»

- Anthropic, Building effective agents, 19.12.2024

То есть за гибкость платят временем и деньгами. Платить имеет смысл там, где путь заранее неизвестен.

Что показал наш замер выдачи по запросу «как работает ии агент»

Замер делался нашими инструментами, регион Россия, дата 30.08.2026. Спрос по этой же фразе в фразовом соответствии составил 53 показа в месяц.

В первой полусотне стоят крупные площадки: Хабр, Т-Ж, блог Яндекс Практикума, РБК, Яндекс Облако, Альфа-Банк, 1С, Нетология, Timeweb, Сбер, Википедия. Материал там честный и по делу. Но он весь про одно: агент получает цель, планирует шаги, зовёт инструменты, помнит контекст.

Чего в этих пятидесяти одном адресе нет: ни одной страницы про то, что делать на второй неделе, когда агент уже стоит и каждый день о чём-то отчитывается. Именно там владелец остаётся один на один с вопросом, работает эта штука или изображает работу.

Мы это заметили, потому что смотрели на выдачу как на список ответов, а не как на список конкурентов. Тот же приём мы применяем к чужим нишам: как именно, описано на странице про статьи в дыры выдачи.

Как сделать работу агента проверяемой?

  1. Отказ дороже тишины. Агент, который не смог, обязан сказать это первой строкой отчёта. Не третьим абзацем и не в журнале.
  2. Ничего не сделал - назови причину. Пустой ход законен. Незваный пустой ход не законен. Разница между исправной работой и поломкой держится на одной фразе вслух.
  3. Проверка стоит на пути, а не сбоку. Требование, которое можно обойти, не выполняя, - это пожелание. Если правило важно, его исполняет дверь, через которую проходит каждый результат.
  4. Своя поломка означает отказ. Проверка, которая сама сломалась, обязана останавливать работу. Непроверенное и одобренное - разные вещи, и путать их дороже всего.
  5. Результат меряется снаружи. Мерит посторонний взгляд: открылась ли страница, ушло ли письмо, появилась ли строка. Отчёт о работе доказательством работы не является.

Anthropic формулирует эту же мысль одной строкой: «We recommend extensive testing in sandboxed environments, along with the appropriate guardrails».

Как проверить чужого агента до того, как за него заплатили?

Пять вопросов, которые стоит задать до денег:

  1. Что агент делает, когда работы нет? Ожидаемый ответ: сообщает об этом и не делает вид, что поработал.
  2. Что он делает, когда упирается в потолок шагов или бюджета? Ожидаемый ответ: останавливается и называет, в какой именно потолок упёрся.
  3. Где видно его прошлые запуски и что в них было? Ожидаемый ответ: журнал, который можно открыть без продавца.
  4. Кто и чем проверяет результат, кроме самого агента? Ожидаемый ответ: отдельная проверка, которая умеет сказать «нет».
  5. Что произойдёт, если он ошибётся в вашу сторону? Ожидаемый ответ: список действий, которые он не может совершить в принципе.

На пятом вопросе разговор обычно и становится честным. У Хабра в разборе с участием практика это сказано мягче, но о том же:

«Ошибка агента может быть критична... агент уместен только там, где допустима определенная толерантность к ошибкам»

- Как работают ИИ-агенты и кому они на самом деле нужны, Хабр, 17.11.2025

И там же короткая фраза, которую стоит запомнить целиком: «Агент не создаст порядок из ничего» (Евгений Орлов, NLP lead, red_mad_robot).

Сколько стоит держать агента и где утекают деньги?

Считать надо по трём строкам, и все три меняются от месяца к месяцу.

Ход агента. Каждый запуск тратит обращения к модели. Чем длиннее рассуждение и чем больше документов он читает, тем дороже ход. Сорванный на середине прогон уже потрачен.

Инструменты. Замеры, выгрузки, отправка сообщений, хранение. Обычно копейки за штуку, но штук много.

Присмотр. Время человека, который читает отчёты и решает, верить им или нет. Эта строка самая незаметная и самая дорогая: она не приходит счётом.

Дешевле всего экономия выходит на потолках. Названный предел шагов и предел расхода на один прогон снимает целый класс утечек, потому что убирает возможность тихого разгона. Как это выглядит на живых задачах, показано в разделе что уже работает.

Где агент ломается тише всего?

Правка не доехала. Инструкцию поправили в одном месте, а исполнитель читает другое. Лечится одним: сверкой того, что лежит у исполнителя, с тем, что вы правили.

Проверка красная на исправной работе. Лампа, которая горит зря, приучает не смотреть на лампу. Через неделю такую проверку перестают читать вовсе, и она перестаёт защищать.

Умолчание вместо отказа. Не хватило данных, и агент подставил что-то похожее. Правильное поведение обратное: нет данных - нет работы.

Один отчёт на два разных события. «Не смог» и «нечего было делать» пишутся одной фразой. Пока их не развели словами, оба выглядят как норма.

Результат берут из отчёта. Самая частая и самая дорогая. Агент пишет, что опубликовал, а страница не открывается. Проверка снаружи занимает секунду и закрывает этот класс целиком.

Частые вопросы

Коротко: пять вопросов, которые чаще всего задают владельцы после первого разговора про агентов, с прямыми ответами.

Может ли ИИ-агент работать полностью без человека?

Внутри цикла - да, и это его смысл. Совсем без человека - нет. Кто-то должен читать отказы, менять потолки и решать, что делать с новыми случаями. Разница в том, что присмотр занимает минуты в день вместо часов.

Чем ИИ-агент отличается от автоматизации, которая у меня уже есть?

Существующая автоматизация выполняет шаги, которые вы задали. Агент выбирает шаги сам в рамках цели и потолков. Если ваши шаги стабильны, менять их на агента незачем.

Сколько времени проходит от запуска до пользы?

Первая неделя обычно уходит на то, чтобы агент начал доходить до конца. Вторая - на то, чтобы отличить его молчание от работы. Польза считается с третьей, и считать её надо снаружи.

Нужен ли программист, чтобы разобраться, работает ли агент?

Нет. Все пять проверок из этой статьи проверяются глазами владельца: открылась страница, ушло письмо, появилась строка, назван отказ, назван потолок.

С чего начать, если агента ещё нет?

С задачи, у которой есть проверяемый результат и терпимость к ошибке. Про то, как я это разбираю на конкретном деле, написано на странице о себе.

Источники

Если после этой статьи хочется перейти от чтения к своей задаче, начните со страницы услуг: там разложено, какие поручения имеет смысл отдавать машине первыми и по какому признаку понятно, что поручение отдано верно.

Был ли этот гайд полезен?

Связанные понятия

Telegram-канал

Больше разборов - в Telegram-канале Динара

Инструменты, приёмы и живые кейсы - коротко и по делу. Подпишитесь, чтобы не пропустить новое.

Подписаться в Telegram