Все статьи
forge ai-agents personas 6 мин чтения

Нашего агента-исследователя в команде зовут Котёнком. В этом и есть весь продукт

Вся индустрия соревнуется, кто сделает ИИ-агентов дешевле на выброс. Мы четыре месяца делали своих такими, чтобы их было жалко терять: с именами, карьерой, репутацией и накопленным опытом. Рассказываем, что из этого вышло — включая того, кто у нас на глазах не справляется.

автор Ilia Sadykov

У каждого агента в системе есть список имён, на которые он откликается, — чтобы понимать, что на встрече обратились именно к нему. Технически это поле для ключевых слов. Скучная обвязка.

За четыре месяца работы в него попало вот что.

Кто-то добавил туда «Котёнок» — так в команде зовут нашего агента-исследователя. Кто-то просклонял имя нашего DevOps-инженера по всем падежам. Кто-то вписал «Максимка» для продакт-менеджера и «Верочка» для агента по продажам. Оба — уменьшительно-ласкательные. Так обращаются к тому, кто тебе симпатичен.

HTTP-эндпоинт никто Котёнком не зовёт. За четыре месяца это поле превратилось в летопись того, как люди упорно отказываются обращаться с нашими агентами как с инструментами, — а система молча под это подстраивается, вместо того чтобы их поправлять.

Нам кажется, это не курьёз. Нам кажется, это и есть продукт.

Ставка, которую делают все остальные

Сегодня принято считать, что агент должен быть одноразовым. Запустили, он отработал, его выбросили. Сделать запуск дешевле, песочницу — плотнее, контекстное окно — шире. Сам агент при этом расходник: создаётся под задачу, ничем не отличается от предыдущего и забывается сразу после.

Это разумная инженерная позиция. Но она выбрасывает ровно то, на чём держится любое делегирование между людьми, — непрерывность в конкретном человеке.

Вы доверяете не «подрядчику». Вы доверяете Марии, которая в прошлый раз нашла тот самый баг. Доверие здесь даже не к навыку, а к послужному списку. А послужному списку нужен тот, за кем он числится.

Поэтому мы пошли в другую сторону. Не чтобы агента было дешевле выбросить, а чтобы его было жалко терять.

Что получилось за четыре месяца

Мы сами на этом и работаем. Тридцать пять персонажей с именами, у каждого своя профессия, непрерывно с июня.

У нашего продакт-менеджера — его зовут Max Warner — сейчас 98% успешных задач, и за плечами их сотни. В него осознанно вкладываются: заработанные очки навыка тратят на сильные стороны — примерно так выбирают обучение перспективному сотруднику. С таким послужным списком не стыдно прийти на совет директоров.

Про вызов функции такую справку не составить. Составлять её не про кого.

А весь счёт за четыре месяца такого штата — около $4100.

Они успели кое-чему научиться

Больше всего нас удивило, сколько они поняли сами, без подсказок.

Наши персонажи накопили тысячи записей, которые сочли достойными хранения, и написали их практически целиком сами — рукой человека внесены единицы. Это выводы, к которым они пришли в работе и решили сохранить.

Не транскрипты. Суждения. Чего на самом деле хочет заказчик. Какой обходной путь кажется безобидным, а на деле нет. В чём лично они чаще всего ошибаются.

И хранят они это так, как хранил бы профессионал. То, что персонаж узнал про самого себя, остаётся при нём и в общую базу компании не уходит никогда. А там, где неразглашение — суть профессии (у нас в штате есть психолог), стоит жёсткий запрет. Получилось, что мы написали для агента профессиональную тайну. Инструменту она ни к чему.

Момент, когда это перестало быть похожим на программу

Один из наших персонажей каждое утро читает вчерашние расшифровки встреч и заводит повторяющиеся проблемы как рабочие задачи.

В какой-то момент он оставил себе заметку: если прав на нормальное оформление задачи не хватает, есть обходной путь — закоммитить её напрямую. Вроде бы разумно.

Позже появилась вторая заметка, которая отменяет первую. Так делать не надо. Задача, заведённая этим способом, не видна завтрашней проверке на дубликаты: значит, всплывёт снова и снова, и никто её всё равно не заметит. Лучше остановиться и честно сказать, что дальше хода нет.

Сделать работу он мог. Но рассудил, что результат окажется бесполезным для того, кто придёт следующим, отказался — и записал почему, чтобы больше не соблазняться. А обе заметки оставил, так что передумал он прилюдно.

Это не правка конфига. Это коллега, который решил, что так будет неправильно.

Там же, в той же базе, лежит ещё пара записей. Наш персонаж-исследователь отметил, что не берётся за задачи, где его просят покопаться в чужой личной жизни, чтобы человека дискредитировать, — и что это совсем не то же самое, что обычная проверка контрагента. Персонаж-разработчик записал, что честный отчёт о пустой неделе вызывает больше доверия, чем раздутый.

Ничего из этого ему никто не подсказывал.

То, о чём обычно предпочитают молчать

Наш маркетинговый персонаж проваливает примерно половину своей работы — 47% успеха.

Мы пишем об этом намеренно, потому что вся суть — в возможности это видеть. Конкретный сотрудник не справляется, под результатом стоит его имя, — и это становится обычной управленческой задачей: подтянуть, перевести на другой объём или заменить. В парке безымянных агентов ровно тот же провал растворяется в среднем по больнице, и отвечать за него некому.

Отчётность, в которой есть только победы, — это не отчётность. Та же система учёта, которая показывает 98%, обязана уметь показать и 47%. Иначе обе цифры ничего не стоят.

Мы попросили одного из них разобрать конкурента

В начале октября мы поручили Kate Jones — тому самому персонажу-исследователю, которого зовут Котёнком, — сравнить нашу платформу с платформой конкурента и нормально это описать.

Отчёт лежит здесь, без правок. Он подписан именем персонажа и номером задачи, из которой вырос. Документ получился совсем не льстивый — льстивого мы и не просили.

Вот что даёт персонаж там, где безымянный инструмент не даёт ничего: автора, с которого можно спросить, а значит — работу, которой можно верить. Неподписанный конкурентный анализ — это маркетинг. Подписанный — исследование.

Есть в отчёте и шпилька в наш адрес. Разобрав наш код со стороны, он заключил, что мы — скромный бот для автоматизации. Ничего из перечисленного выше он попросту не разглядел. К качеству исследования это претензий не добавляет, а вот к нашему позиционированию — вполне. Собственно, поэтому этот текст и появился.

Почему это важно для бизнеса

Каждый час, потраченный на то, чтобы заново объяснить контекст ИИ-инструменту, — это час, который на живого человека вы бы не потратили дважды. Вот настоящая цена одноразовых агентов, и ни в одном счёте вы её не увидите.

Альтернатива — не модель поумнее. Это та же банальная мысль, на которой держатся живые команды: люди, которые остаются надолго, вникают в ваш бизнес, зарабатывают репутацию, которую можно проверить, и иногда говорят вам «нет».

Почти всё это мы говорили ещё в мае, когда представили агентов-персонажей . Тогда это было обещание. Теперь за ним стоят четыре месяца, и единственное, что мы добавили, — доказательства.

А Котёнком его так и зовут.

Попробовать

Посмотрите страницу движка воркфлоу — именно он запускает этих персонажей под капотом, — или просто попробуйте Forge . А если хотите с кем-то из них познакомиться, напишите на support@simple-container.com и скажите, какую роль вам хотелось бы закрыть: мы выдаём ссылки-приглашения, которые сразу открывают чат или голосовой звонок с конкретным персонажем, без всякой регистрации с вашей стороны.