Telegraft

Стоимость

Во что обходится AI-ассистент поверх бота

Retrieval добавляет примерно от шести до двенадцати дней разработки к тому же боту со сценарными ответами. Бóльшая часть этого — не работа с моделью: это подготовка вашего контента в извлекаемые фрагменты, сборка набора для оценки и проработка того, что ассистент делает, когда не знает ответа. Расход токенов — текущая статья, а не статья разработки.

Во что обходится AI-ассистент поверх бота: объём работ, цена и что на неё влияет

Фиксированная цена
$6,720 USD
Срок
Ожидает утверждения
Объём работ
16 рабочих дней
Главный драйвер цены
Подготовка корпуса — неструктурированные исходные документы, а не модель
Коммерческая основа
Фиксированная цена согласуется до старта; изменения объёма оцениваются отдельно
Первый год, помимо разработки
Абонентская поддержка, управляемый хостинг, плюс обращения к API модели, поддержание контента

As of 2025-10-01, Telegram Bot API 13.4

Почему это стоит именно столько

Разговор о цене AI-ассистента искажён тем, насколько легко делается демо. Подключить языковую модель к Telegram-боту и получить правдоподобные ответы — работа на полдня, и на встрече результат действительно впечатляет. Вся стоимость живёт в разрыве между этим демо и тем, что бизнес может показать клиентам, и почти никогда она не про модель.

Первая реальная статья расходов — ваш контент. Retrieval-ассистент ограничен тем, что он способен найти, а у большинства компаний нет корпуса: есть сайт, несколько PDF, документ с регламентом, написанный кем-то в 2019 году, и огромный объём знаний, существующий только в голове у руководителя. Превращение этого в фрагменты, которые хорошо ищутся, — подготовительная работа с честным количеством дней, и никакое улучшение качества моделей её не отменяет. Хорошо собранный ассистент поверх плохого контента проигрывает сценарному FAQ-боту поверх хороших ответов.

Вторая — оценка. Без фиксированного набора вопросов с заведомо верными ответами невозможно понять, стало ли после правки промпта лучше или хуже, и каждое изменение превращается в догадку, которую защищает тот, кто последним читал переписку. Собрать такой набор — работа неэффектная, и именно она отличает ассистента, которого можно улучшать, от ассистента, которого можно только перекатывать заново. Она же делает передачу проекта осмысленной: у вашей команды остаётся способ проверять систему после того, как мы уйдём.

Третья — отказ. Ассистент, уверенно выдумавший условия возврата, создаёт ответственность, которую сценарный бот создать не способен, и для компании, работающей с потребителем в ОАЭ, это не теоретический, а вполне реальный риск. Проработка границ — на что он отвечает, что передаёт человеку, от чего отказывается — и их проверка на прочность вынесены здесь в отдельную статью. Именно её чаще всего просят убрать, и именно её мы чаще всего убирать отказываемся.

Из чего складывается сумма

РаботаДниСтоимостьЧто входит
Аудит контента1$420Какие материалы есть, в каком они состоянии и на какую долю ваших реальных вопросов они вообще способны ответить. Нередко заканчивается рекомендацией написать три документа прежде, чем что-либо строить.
Подготовка корпуса3$1,260Извлечение, чистка и нарезка на фрагменты по границам смысла, а не по количеству символов. Главный фактор качества ответов и самая незаметная строка в этой таблице.
Конвейер retrieval2$840Эмбеддинги, векторное хранилище, переписывание запроса и реранжирование, настроенные под ваше реальное распределение вопросов, а не под бенчмарк.
Синтез ответа и ссылки на источник2$840Промптинг, привязка к найденным фрагментам и возврат источника рядом с ответом, чтобы клиент мог проверить, а руководитель — разобрать.
Проработка отказа и передачи человеку2$840На что ассистент не отвечает, как именно он об этом говорит и как передаёт диалог человеку, не теряя контекста. Включает проверку границ на прочность.
Набор для оценки2$840От пятидесяти до ста реальных вопросов с заведомо верными ответами плюс прогонщик для них. Единственный способ понять, помогло ли изменение.
Интеграция с Telegram2$840Потоковая выдача в пределах лимитов на редактирование сообщений, память диалога, кнопки обратной связи под каждым ответом и передача в тему, где сидит человек.
Защита и запуск2$840Ограничение частоты на пользователя, потолки расходов, защита от prompt injection, логирование, пригодное для разбора, и рубильник, возвращающий сценарные ответы.
Итого16$6,720Фиксируется при подписании. Изменения объёма оцениваются отдельно и никогда не поглощаются молча.

Что сдвигает цифру

Качество ответов ограничено качеством корпуса, а не выбором модели.

Если документация скудная, самое дешёвое улучшение — написать её, а не менять модель. Мы скажем об этом до сметы, потому что строить поверх плохого корпуса — это потратить ваши деньги и нашу репутацию.

Расход токенов растёт от длины диалогов гораздо сильнее, чем от их количества.

Десять тысяч коротких справок могут обойтись дешевле пятисот длинных свободных разговоров. Считайте нагрузку по глубине переписки и ставьте потолки на пользователя до запуска, а не после первого неприятного счёта.

Каждый дополнительный язык умножает и подготовку корпуса, и оценку.

Арабский и английский — это не один ассистент со слоем перевода, а два пути поиска и два набора для оценки, потому что арабский контент редко бывает точным зеркалом английского.

Telegram ограничивает частоту редактирования сообщения, и это ограничивает потоковую выдачу.

Потока по токену, как в вебе, здесь нет. Ассистент выдаёт ответ кусками, и работа над ощущаемой задержкой — настоящее решение, а не значение по умолчанию.

Выдуманное правило из регламента — ответственность, которую сценарный бот создать не может.

Проработка отказа и ссылки на источник не опциональны для компании, работающей с потребителем в ОАЭ. Эту строку мы убирать отказываемся, и причина юридическая, а не ремесленная.

Примерно до тридцати разных вопросов retrieval проигрывает сценарным ответам.

Небольшой и устойчивый набор вопросов лучше, быстрее и дешевле закрывается написанным текстом. Пересчитайте свои вопросы до покупки ассистента; полный разбор — на странице сравнения.

Во что обходится первый год

Регулярные расходыПервый годПодробности
Абонентская поддержка$3,480/yrАссистенты требуют больше внимания, чем сценарные боты: корпус устаревает, характер вопросов смещается, а набор для оценки надо прогонять заново после каждого обновления модели у провайдера.
Управляемый хостинг$660/yrСреда исполнения, векторное хранилище и журнал диалогов. Скромно: векторный индекс корпуса одной компании меньше, чем принято думать.
Обращения к API моделивыставляет поставщикПровайдер считает по токенам на вашем собственном аккаунте. Зависит от глубины диалога и от того, сколько контекста несёт каждый ответ, — и то и другое настраивается и настройки стоит.
Поддержание контентавыставляет поставщикВаша зона и самая важная регулярная инвестиция. Ассистент поверх корпуса, который никто не обновляет, деградирует постепенно, продолжая выглядеть исправным.

Если покупать то же самое в другом месте

Где вы это покупаетеЧто вы получаете за эти деньгиЧто вы берёте на себя
Коробочная подписка на AI-чатботаЕжемесячный платёж, окно загрузки документов и ассистент, отвечающий уже на следующий день. Для прямолинейного FAQ поверх чистого контента это разумная покупка, и она сработает.Нет контроля над нарезкой, поиском и поведением при отказе, нет набора для оценки — качество какое есть, и системно улучшить его нельзя. Передача диалога в ваши собственные процессы обычно поверхностная или отсутствует.
Универсальное AI-консалтинговое агентствоГлубокая экспертиза по моделям, стратегическая работа и спокойное отношение к тем частям задачи, которые действительно исследовательские. Ценно, когда задача нетиповая.Всё, что специфично для Telegram, — лимиты редактирования, состояние диалога, передача в тему форума, контроль расходов на пользователя — обычно самая тонкая часть работ, и именно её видят ваши клиенты.
Своя команда и ключ от APIПолный контроль, знания остаются внутри и быстрый первый прототип. Верное решение, когда ассистент — это ядро вашего продукта.Демо — те самые лёгкие 20%. Оценка, проработка отказа и контроль расходов — места, где внутренние разработки застревают, и у них нет видимого прогресса, который можно показать заказчику внутри компании.

Вопросы про деньги

Нужен ли нам вообще AI или хватит сценарного бота?

Посчитайте, сколько у вас разных клиентских вопросов. Примерно до тридцати написанные ответы выигрывают по цене, скорости и доверию — и выдумать они ничего не могут. Выше этой отметки поддержка сценариев становится узким местом, и retrieval начинает окупаться. Полный разбор порога — на странице сравнения.

Какую модель вы используете?

Ту, что подходит задаче и бюджету, причём архитектура оставляет её сменной, а не зашитой. Выбор модели — действительно наименее значимое решение в этой работе, что прямо противоположно тому, как его обычно продают.

Сможет ли ассистент отвечать по-арабски?

Да, и оценивается это как второй ассистент, а не как галочка перевода. Ему нужен собственный корпус, собственная настройка поиска и собственный набор для оценки, потому что арабские материалы почти никогда не являются точным зеркалом английских.

Как не дать ассистенту выдумывать?

Привязывать каждый ответ к найденным фрагментам, возвращать источник рядом с ответом и проектировать явный путь отказа для всего, что вне корпуса. А затем проверять эти границы на прочность до запуска. Это не промпт, а раздел работ.

Во сколько обходится один диалог?

Почти целиком зависит от глубины диалога, поэтому мы ограничиваем токены на пользователя и логируем расход с первого дня, а не обнаруживаем его постфактум. Короткая справка и длинный свободный разговор на одной и той же модели различаются больше чем на порядок.

Может ли ассистент совершать действия, а не только отвечать?

Может — записывать, искать, заводить заявки, — но каждое действие требует собственного шага подтверждения и собственного следа в журнале, и это оценивается как обычная интеграционная работа, а не как работа с AI. Ассистент, действующий без подтверждения, — это будущий инцидент поддержки.

Что происходит, когда ассистент не знает ответа?

Он прямо говорит об этом и предлагает человека, а диалог уезжает в тему, за которой ваша команда и так следит, вместе со всей историей. Уверенный не-ответ хуже честной передачи, и вторую клиенты прощают.

Что почитать дальше