Стоимость
Во что обходится AI-ассистент поверх бота
Retrieval добавляет примерно от шести до двенадцати дней разработки к тому же боту со сценарными ответами. Бóльшая часть этого — не работа с моделью: это подготовка вашего контента в извлекаемые фрагменты, сборка набора для оценки и проработка того, что ассистент делает, когда не знает ответа. Расход токенов — текущая статья, а не статья разработки.
Во что обходится AI-ассистент поверх бота: объём работ, цена и что на неё влияет
- Фиксированная цена
- $6,720 USD
- Срок
- Ожидает утверждения
- Объём работ
- 16 рабочих дней
- Главный драйвер цены
- Подготовка корпуса — неструктурированные исходные документы, а не модель
- Коммерческая основа
- Фиксированная цена согласуется до старта; изменения объёма оцениваются отдельно
- Первый год, помимо разработки
- Абонентская поддержка, управляемый хостинг, плюс обращения к API модели, поддержание контента
As of 2025-10-01, Telegram Bot API 13.4
Почему это стоит именно столько
Разговор о цене AI-ассистента искажён тем, насколько легко делается демо. Подключить языковую модель к Telegram-боту и получить правдоподобные ответы — работа на полдня, и на встрече результат действительно впечатляет. Вся стоимость живёт в разрыве между этим демо и тем, что бизнес может показать клиентам, и почти никогда она не про модель.
Первая реальная статья расходов — ваш контент. Retrieval-ассистент ограничен тем, что он способен найти, а у большинства компаний нет корпуса: есть сайт, несколько PDF, документ с регламентом, написанный кем-то в 2019 году, и огромный объём знаний, существующий только в голове у руководителя. Превращение этого в фрагменты, которые хорошо ищутся, — подготовительная работа с честным количеством дней, и никакое улучшение качества моделей её не отменяет. Хорошо собранный ассистент поверх плохого контента проигрывает сценарному FAQ-боту поверх хороших ответов.
Вторая — оценка. Без фиксированного набора вопросов с заведомо верными ответами невозможно понять, стало ли после правки промпта лучше или хуже, и каждое изменение превращается в догадку, которую защищает тот, кто последним читал переписку. Собрать такой набор — работа неэффектная, и именно она отличает ассистента, которого можно улучшать, от ассистента, которого можно только перекатывать заново. Она же делает передачу проекта осмысленной: у вашей команды остаётся способ проверять систему после того, как мы уйдём.
Третья — отказ. Ассистент, уверенно выдумавший условия возврата, создаёт ответственность, которую сценарный бот создать не способен, и для компании, работающей с потребителем в ОАЭ, это не теоретический, а вполне реальный риск. Проработка границ — на что он отвечает, что передаёт человеку, от чего отказывается — и их проверка на прочность вынесены здесь в отдельную статью. Именно её чаще всего просят убрать, и именно её мы чаще всего убирать отказываемся.
Из чего складывается сумма
| Работа | Дни | Стоимость | Что входит |
|---|---|---|---|
| Аудит контента | 1 | $420 | Какие материалы есть, в каком они состоянии и на какую долю ваших реальных вопросов они вообще способны ответить. Нередко заканчивается рекомендацией написать три документа прежде, чем что-либо строить. |
| Подготовка корпуса | 3 | $1,260 | Извлечение, чистка и нарезка на фрагменты по границам смысла, а не по количеству символов. Главный фактор качества ответов и самая незаметная строка в этой таблице. |
| Конвейер retrieval | 2 | $840 | Эмбеддинги, векторное хранилище, переписывание запроса и реранжирование, настроенные под ваше реальное распределение вопросов, а не под бенчмарк. |
| Синтез ответа и ссылки на источник | 2 | $840 | Промптинг, привязка к найденным фрагментам и возврат источника рядом с ответом, чтобы клиент мог проверить, а руководитель — разобрать. |
| Проработка отказа и передачи человеку | 2 | $840 | На что ассистент не отвечает, как именно он об этом говорит и как передаёт диалог человеку, не теряя контекста. Включает проверку границ на прочность. |
| Набор для оценки | 2 | $840 | От пятидесяти до ста реальных вопросов с заведомо верными ответами плюс прогонщик для них. Единственный способ понять, помогло ли изменение. |
| Интеграция с Telegram | 2 | $840 | Потоковая выдача в пределах лимитов на редактирование сообщений, память диалога, кнопки обратной связи под каждым ответом и передача в тему, где сидит человек. |
| Защита и запуск | 2 | $840 | Ограничение частоты на пользователя, потолки расходов, защита от prompt injection, логирование, пригодное для разбора, и рубильник, возвращающий сценарные ответы. |
| Итого | 16 | $6,720 | Фиксируется при подписании. Изменения объёма оцениваются отдельно и никогда не поглощаются молча. |
Что сдвигает цифру
Качество ответов ограничено качеством корпуса, а не выбором модели.
Если документация скудная, самое дешёвое улучшение — написать её, а не менять модель. Мы скажем об этом до сметы, потому что строить поверх плохого корпуса — это потратить ваши деньги и нашу репутацию.
Расход токенов растёт от длины диалогов гораздо сильнее, чем от их количества.
Десять тысяч коротких справок могут обойтись дешевле пятисот длинных свободных разговоров. Считайте нагрузку по глубине переписки и ставьте потолки на пользователя до запуска, а не после первого неприятного счёта.
Каждый дополнительный язык умножает и подготовку корпуса, и оценку.
Арабский и английский — это не один ассистент со слоем перевода, а два пути поиска и два набора для оценки, потому что арабский контент редко бывает точным зеркалом английского.
Telegram ограничивает частоту редактирования сообщения, и это ограничивает потоковую выдачу.
Потока по токену, как в вебе, здесь нет. Ассистент выдаёт ответ кусками, и работа над ощущаемой задержкой — настоящее решение, а не значение по умолчанию.
Выдуманное правило из регламента — ответственность, которую сценарный бот создать не может.
Проработка отказа и ссылки на источник не опциональны для компании, работающей с потребителем в ОАЭ. Эту строку мы убирать отказываемся, и причина юридическая, а не ремесленная.
Примерно до тридцати разных вопросов retrieval проигрывает сценарным ответам.
Небольшой и устойчивый набор вопросов лучше, быстрее и дешевле закрывается написанным текстом. Пересчитайте свои вопросы до покупки ассистента; полный разбор — на странице сравнения.
Во что обходится первый год
| Регулярные расходы | Первый год | Подробности |
|---|---|---|
| Абонентская поддержка | $3,480/yr | Ассистенты требуют больше внимания, чем сценарные боты: корпус устаревает, характер вопросов смещается, а набор для оценки надо прогонять заново после каждого обновления модели у провайдера. |
| Управляемый хостинг | $660/yr | Среда исполнения, векторное хранилище и журнал диалогов. Скромно: векторный индекс корпуса одной компании меньше, чем принято думать. |
| Обращения к API модели | выставляет поставщик | Провайдер считает по токенам на вашем собственном аккаунте. Зависит от глубины диалога и от того, сколько контекста несёт каждый ответ, — и то и другое настраивается и настройки стоит. |
| Поддержание контента | выставляет поставщик | Ваша зона и самая важная регулярная инвестиция. Ассистент поверх корпуса, который никто не обновляет, деградирует постепенно, продолжая выглядеть исправным. |
Если покупать то же самое в другом месте
| Где вы это покупаете | Что вы получаете за эти деньги | Что вы берёте на себя |
|---|---|---|
| Коробочная подписка на AI-чатбота | Ежемесячный платёж, окно загрузки документов и ассистент, отвечающий уже на следующий день. Для прямолинейного FAQ поверх чистого контента это разумная покупка, и она сработает. | Нет контроля над нарезкой, поиском и поведением при отказе, нет набора для оценки — качество какое есть, и системно улучшить его нельзя. Передача диалога в ваши собственные процессы обычно поверхностная или отсутствует. |
| Универсальное AI-консалтинговое агентство | Глубокая экспертиза по моделям, стратегическая работа и спокойное отношение к тем частям задачи, которые действительно исследовательские. Ценно, когда задача нетиповая. | Всё, что специфично для Telegram, — лимиты редактирования, состояние диалога, передача в тему форума, контроль расходов на пользователя — обычно самая тонкая часть работ, и именно её видят ваши клиенты. |
| Своя команда и ключ от API | Полный контроль, знания остаются внутри и быстрый первый прототип. Верное решение, когда ассистент — это ядро вашего продукта. | Демо — те самые лёгкие 20%. Оценка, проработка отказа и контроль расходов — места, где внутренние разработки застревают, и у них нет видимого прогресса, который можно показать заказчику внутри компании. |
Вопросы про деньги
Нужен ли нам вообще AI или хватит сценарного бота?
Посчитайте, сколько у вас разных клиентских вопросов. Примерно до тридцати написанные ответы выигрывают по цене, скорости и доверию — и выдумать они ничего не могут. Выше этой отметки поддержка сценариев становится узким местом, и retrieval начинает окупаться. Полный разбор порога — на странице сравнения.
Какую модель вы используете?
Ту, что подходит задаче и бюджету, причём архитектура оставляет её сменной, а не зашитой. Выбор модели — действительно наименее значимое решение в этой работе, что прямо противоположно тому, как его обычно продают.
Сможет ли ассистент отвечать по-арабски?
Да, и оценивается это как второй ассистент, а не как галочка перевода. Ему нужен собственный корпус, собственная настройка поиска и собственный набор для оценки, потому что арабские материалы почти никогда не являются точным зеркалом английских.
Как не дать ассистенту выдумывать?
Привязывать каждый ответ к найденным фрагментам, возвращать источник рядом с ответом и проектировать явный путь отказа для всего, что вне корпуса. А затем проверять эти границы на прочность до запуска. Это не промпт, а раздел работ.
Во сколько обходится один диалог?
Почти целиком зависит от глубины диалога, поэтому мы ограничиваем токены на пользователя и логируем расход с первого дня, а не обнаруживаем его постфактум. Короткая справка и длинный свободный разговор на одной и той же модели различаются больше чем на порядок.
Может ли ассистент совершать действия, а не только отвечать?
Может — записывать, искать, заводить заявки, — но каждое действие требует собственного шага подтверждения и собственного следа в журнале, и это оценивается как обычная интеграционная работа, а не как работа с AI. Ассистент, действующий без подтверждения, — это будущий инцидент поддержки.
Что происходит, когда ассистент не знает ответа?
Он прямо говорит об этом и предлагает человека, а диалог уезжает в тему, за которой ваша команда и так следит, вместе со всей историей. Уверенный не-ответ хуже честной передачи, и вторую клиенты прощают.
Что почитать дальше
Продукт с фиксированной ценой, за которым стоит эта раскладка, — сборка retrieval-ассистента.
Прежде чем вообще покупать retrieval, прочитайте про порог по количеству вопросов через сценарную альтернативу.
Если нужны и арабский, и английский, экономика языков разобрана здесь: во что обходится второй язык.
О том, откуда берётся корпус и как выбираются границы фрагментов, смотрите интеграцию с Notion.