Модель может стоить несколько центов за ответ. Но система, которой разрешено читать CRM, проверять заказы, соблюдать права доступа, не придумывать финансовые обещания и нормально работать в понедельник утром, — это уже не «несколько API-вызовов».
Поиск стоимости AI-агента в 2026 году возвращает диапазоны от 8 000 до 500 000 долларов и выше. Это не обязательно означает, что кто-то лжет. Просто «агентом» называют и сценарий в no-code сервисе, и production-продукт с пятью интеграциями, ролями, аудитом, подтверждением человеком и поддержкой.
Поэтому здесь не будет одной магической цены. Ниже — рабочая модель бюджета. Диапазоны являются редакционными ориентирами для кастомной разработки малому и среднему бизнесу в Европе в 2026 году, без НДС. Это не прайс-лист. Точная смета появляется после описания сценариев, данных, интеграций, нагрузки и критериев приемки.
Короткий ответ: шесть уровней бюджета
| Что вы покупаете | Разовый запуск | Эксплуатация в месяц | Главное ограничение |
|---|---|---|---|
| Настройка готового SaaS/no-code Один канал и готовые коннекторы | €500–€5 000 | €50–€1 500 | Сложные исключения и своя логика |
| Proof of concept Одна гипотеза на образцах, без production SLA | €4 000–€12 000 | €50–€500 | Это еще не готовый сервис |
| Внутренний копилот Один workflow, 1–2 источника, черновик человеку | €15 000–€40 000 | €300–€3 000 | Человек остается в контуре |
| Клиентский AI-ассистент Живые данные, 2–3 интеграции, эскалация | €25 000–€70 000 | €800–€6 000 | Права и качество важнее чата |
| Агент с действиями Запись в системы, подтверждение, откат, аудит | €40 000–€120 000+ | €1 500–€15 000+ | Цена растет с автономностью и риском |
| AI-функция своего продукта Multi-tenant, роли, биллинг, масштабирование | €60 000–€200 000+ | €3 000–€30 000+ | Это продуктовая разработка, не бот |
Нижняя граница предполагает узкий сценарий, готовые системы, чистые данные, доступные API и быстрые решения заказчика. Верхняя — несколько ролей и каналов, сложные исключения, чувствительные данные, большой объем или действия с последствиями.
Если нужна лишь помощь отдельным сотрудникам, сначала проверьте корпоративный AI-инструмент или готовый SaaS. Кастомная разработка оправдана, когда ценность находится в вашем процессе, данных, правилах или клиентском опыте.
Формула стоимости первого года
Year 1 TCO = discovery + implementation + integrations
+ evaluation + security + rollout
+ 12 × (model usage + infrastructure + vendors
+ human review + monitoring + maintenance)
В смете нужны две цифры: стоимость создания и стоимость владения. Проект за €20 000 с €6 000 ежемесячных расходов дороже в первый год, чем проект за €45 000 с €1 000 в месяц. Дешевое демо также может потребовать почти полной перестройки перед production.
Семь факторов, двигающих смету
1. Количество сценариев
«Где мой заказ?» и «подберите товар, проверьте наличие, поменяйте адрес и оформите возврат» — не один чатбот. У каждого намерения свои данные, правила, исключения и тесты. Три узких сценария дешевле одного размытого универсального помощника.
2. Состояние данных
Если политика существует в трех противоречивых PDF, каталог не имеет стабильных артикулов, а исключения хранятся в головах менеджеров, разработка начинается с операционной уборки. AI быстрее масштабирует несогласованность, но не устраняет ее.
3. Интеграции и качество API
Документированный API с sandbox и webhooks занимает дни. Старая ERP без тестовой среды, собственная авторизация и неполные данные — недели. Каждому объекту, направлению, праву и ошибке нужна отдельная оценка.
4. Ответ или действие
Черновик можно исправить. Отправка письма, изменение брони или возврат денег требуют авторизации, защиты от повторов, подтверждения, лимитов, аудита и отката. Здесь бюджет обычно делает самый большой скачок.
5. Требуемое качество
Внутреннее резюме остается полезным после правок. Медицинское, финансовое или юридическое решение имеет другой порог и риск. Чем дороже ошибка, тем больше стоят тесты и контроль.
6. Объем, скорость и пики
Тысяча ночных документов и тысяча одновременных голосовых разговоров — разные системы. Real-time, длинный контекст, поиск, мультимодальность, повторы и сложное reasoning увеличивают переменную стоимость.
7. Ownership и compliance
SSO, роли, регион хранения, аудит, удаление, договорные ограничения, penetration test и incident response не украшают демо, но определяют, можно ли продуктом пользоваться.
Куда уходит бюджет разработки
Discovery описывает процесс, данные, действия, риск, метрики и неизвестные. Evaluation собирает реальные тесты, критерии и крайние случаи. Интеграции и продукт включают авторизацию, API, состояние, интерфейс, ошибки и аналитику. Hardening добавляет логи, мониторинг, лимиты, fallback, incident response и документацию.
Если предложение оценивает только модель и frontend чата, остальная работа либо появится в change requests, либо останется вашим риском.
Ежемесячные расходы после запуска
| Статья | От чего зависит | Как контролировать |
|---|---|---|
| Модель | Input/output, reasoning, кеш, повторы, multimodal | Роутинг, короткий контекст, кеш, batch, лимиты |
| Поиск и хранение | Документы, embeddings, индексы, логи, retention | Жизненный цикл данных и архив |
| Инфраструктура | Compute, очереди, базы, сеть, среды | Autoscaling, бюджеты, service tiers |
| Сторонние сервисы | CRM, helpdesk, сообщения, speech, observability | Проверить цены за пользователя, действие и объем |
| Проверка людьми | Доля кейсов и минуты на review | Автоматизировать доказанные категории |
| Поддержка | Изменения API, знаний, моделей и инциденты | Владелец, SLA, regression suite |
В смете нужна формула с объемом, а не один тариф. Производители моделей считают токены, инструменты — вызовы, аудио — минуты, SaaS — пользователей или действия. Все это меняется.
Расчет API-расходов
Представим 20 000 диалогов в месяц: в среднем 8 000 входных и 1 000 выходных токенов на диалог. Для иллюстрации возьмем €2,50 за миллион input и €15 за миллион output.
Input: 20 000 × 8 000 = 160M × €2,50 = €400
Output: 20 000 × 1 000 = 20M × €15,00 = €300
Базовая модель: €700 / месяц
Плюс 30% на повторы, evaluation и неровный трафик:
Ориентир модели: около €910 / месяц
Это иллюстрация, не прогноз и не привязка к провайдеру. Актуальные страницы OpenAI, Google и AWS показывают разные модели, tiers, caps и режимы обработки.
Если 25% диалогов требуют трех минут менеджера, это 250 часов. При полной стоимости часа €20 человеческая проверка стоит €5 000 — больше модели в пять раз. Поэтому оптимизация только токенов часто направлена не на крупнейшую статью.
Три модели бюджета
Копилот поддержки интернет-магазина
Email, два языка, статусы, доставка и сбор данных для возврата; 2 500 обращений в месяц; отправляет человек.
| Разово | Сумма | Ежемесячно | Сумма |
|---|---|---|---|
| Discovery и 120 тестов | €3 200 | Модель, hosting, logging | €350–€700 |
| Helpdesk + заказы + перевозчик | €12 400 | Поддержка и regression review | €600–€1 000 |
| Review UI, правила, аналитика | €8 000 | Проверка людьми | Зависит от команды |
| Hardening и rollout | €5 000 | Итого без review | €950–€1 700 |
| Запуск | €28 600 |
Внутренний B2B research-ассистент
Менеджер загружает разрешенные материалы и получает briefing с источниками; система не пишет в CRM и не контактирует с клиентом.
| Разово | Сумма | Ежемесячно | Сумма |
|---|---|---|---|
| Сценарии, UX, критерии | €2 500 | Модель и поиск | €150–€450 |
| Загрузка, retrieval, ссылки | €8 400 | Hosting, storage, logs | €100–€250 |
| Evaluation, доступ, аналитика | €4 500 | Поддержка | €300–€700 |
| Запуск и документация | €3 000 | Итого | €550–€1 400 |
| Запуск | €18 400 |
Агент обработки счетов с действиями
Читает счет, сверяет поставщика и заказ, готовит запись, отправляет исключения человеку; финансовая запись — после подтверждения.
| Разово | Сумма | Ежемесячно | Сумма |
|---|---|---|---|
| Процесс, риск, данные, тесты | €7 500 | OCR/model/infrastructure | €800–€2 200 |
| ERP, документы, auth | €25 000 | Monitoring и support SLA | €1 500–€3 500 |
| Approval UI, audit, дубли | €18 000 | Review исключений | Зависит от доли |
| Security test и rollout | €12 500 | Итого без review | €2 300–€5 700 |
| Запуск | €63 000 |
Это примеры механики, а не обещание одинаковой цены. Одна интеграция или изменение автономности легко двигают смету на десятки процентов.
Как читать подозрительно дешевое предложение
Низкая цена прекрасна, если речь честно идет о прототипе. Если описание обещает production, проверьте наличие реальных acceptance cases, отдельной оценки интеграций, авторизации вне модели, человеческой очереди, логов, cost caps, мониторинга, обработки таймаутов и дублей, регрессионных тестов, deployment, документации и ежемесячных расходов.
Спросите, что случится, если CRM недоступна, модель вернула неверный формат или пользователь повторно нажал «выполнить». Ответ «добавим позже» показывает настоящую границу продукта.
Как снизить стоимость без хрупкого решения
- Один workflow вместо универсального агента.
- Read-only перед write. Сначала поиск и черновик, затем действия.
- Человек только в нужных категориях.
- Подготовленные данные до контракта.
- 50–100 реальных кейсов для discovery и приемки.
- Существующий канал вместо нового интерфейса.
- Роутинг моделей и обычный код для правил.
- Batch/flex для не срочных задач.
- Явный out of scope.
Самый дорогой способ экономить — пропустить evaluation и запустить широкую автономность. Ошибка в тесте стоит часы; та же ошибка после сотен клиентов — исправление данных, поддержка, репутация и иногда юридическая работа.
Готовый бюджетный бриф
БИЗНЕС-РЕЗУЛЬТАТ
Изменить ______ с ______ до ______ без ухудшения ______
ПЕРВЫЙ WORKFLOW
Пользователь / вход → результат: ______
Объем в месяц / пик / задержка: ______
ДАННЫЕ И ИНТЕГРАЦИИ
Источники и владельцы: ______
Системы для чтения / записи: ______
Действия после подтверждения: ______
КАЧЕСТВО И РИСК
50–100 acceptance cases: да / нет
Нулевой допуск / эскалация: ______
Логи / retention / роли: ______
ПОКАЗАТЬ ОТДЕЛЬНО
Discovery; build; каждую интеграцию; evaluation; security;
production rollout; сторонние расходы при 1×, 2×, 10×;
human review; поддержку; Year 1 TCO.
ПРЕДПОЛОЖЕНИЯ
Что предоставляет заказчик: ______
Что не входит: ______
Какая переменная сильнее всего меняет цену: ______
Перед запросом цены заполните и шаблон ТЗ на AI-ассистента, чтобы разные подрядчики оценивали один продукт.
Когда лучше не разрабатывать
Покупайте готовое, если процесс типовой, данные находятся в популярной платформе, а 70–80% SaaS-функций достаточно. Настраивайте готовое, если интерфейс и коннекторы уже существуют, а ценность дают ваши правила. Разрабатывайте, если нужны нестандартные данные, права, логика, несколько систем или AI является частью платного продукта.
Отложите проект, если нет владельца процесса, базовой метрики, доступа к данным или согласия о правильном результате. Начните с подготовки бизнеса к AI.
Частые вопросы
Сколько стоит простой AI-чатбот?
Настройка готового сервиса может стоить €500–€5 000. Кастомный proof of concept — около €4 000–€12 000. Production-ассистент с данными, интеграциями и тестами начинается значительно выше.
Сколько стоит AI-агент для бизнеса?
Узкий production-агент с действиями часто планируется в диапазоне €40 000–€120 000+, но системы, права, риск и объем могут вывести проект далеко за него.
Почему API дешевый, а разработка дорогая?
Продукт должен собрать контекст, проверить пользователя, подключить системы, ограничить действия, обработать сбой, показать и залогировать результат.
Какой бюджет нужен для AI-пилота?
Одна узкая гипотеза — примерно €4 000–€12 000. Пилот на живом потоке с production-интеграцией и безопасностью — €15 000–€40 000 и выше.
Сколько закладывать на поддержку?
Считайте конкретно модель, hosting, monitoring, review и регулярную поддержку при 1×, 2× и 10× объеме, а не универсальным процентом.
Источники и примечания
- OpenAI API pricing.
- Google Gemini API billing.
- Amazon Bedrock pricing.
- The Crunch и MarsDevs — примеры ширины рыночных оценок.
Самая полезная цифра в смете — не итог. Это предположения рядом с ним: workflow, данные, права, объем, качество и поведение при ошибке. Когда они названы, цена становится решением. Без них она остается впечатлением.