13-07-2026, 12:17
Привіт! Багато бізнесів сьогодні запитують: "Скільки реально коштує утримувати власного AI-бота для підтримки клієнтів (Q&A бот) у 2026 році?"
Я вирішив зробити детальну калькуляцію на прикладі кількох різних моделей, щоб показати, які щомісячні витрати на API вас очікують.
Ввідні дані для розрахунку:
Уявімо середній інтернет-магазин або сервіс. Бот обробляє 1000 діалогів на день (близько 30 000 запитів на місяць).
Для якісної відповіді бот використовує RAG (Retrieval-Augmented Generation — підвантажує статті з вашої бази знань) + зберігає історію діалогу.
- Середній об'єм **Input** (запит юзера + системний промпт + RAG-контекст): 1500 токенів на запит.
- Середній об'єм **Output** (відповідь бота): 200 токенів.
Разом за місяць маємо: **45 млн вхідних токенів** та **6 млн вихідних токенів**.
Сценарій 1: Флагманські моделі (GPT-4o / Claude 3.5 Sonnet)
Використовуються для дуже складних логічних задач, де не можна помилятися.
- Тарифи (в середньому): $5 за 1M Input, $15 за 1M Output.
- Вартість Input за місяць: 45 * $5 = $225
- Вартість Output за місяць: 6 * $15 = $90
Разом: ~$315 на місяць. (Досить відчутно, але все одно значно дешевше за зарплату живого оператора підтримки).
Сценарій 2: Швидкі та дешеві моделі (GPT-4o-mini / Claude 3 Haiku)
Ідеальні для 95% рутинних питань клієнтів ("де моє замовлення", "як повернути товар", "графік роботи").
- Тарифи (в середньому): $0.15 за 1M Input, $0.60 за 1M Output.
- Вартість Input за місяць: 45 * $0.15 = $6.75
- Вартість Output за місяць: 6 * $0.60 = $3.60
Разом: ~$10.35 на місяць. (Це просто копійки за обробку 30 000 діалогів!).
Сценарій 3: Open-Source через API (Llama 3 / Mixtral на Groq чи Together AI)
Відкриті моделі, які хостяться на сторонніх швидких серверах.
- Тарифи: близько $0.05 за 1M Input, $0.10 за 1M Output.
Разом: ~$2.85 на місяць. (Майже безкоштовно).
Приховані витрати:
Не забувайте, що "гола" модель (просто доступ до API) — це ще не готовий бот. Вам також знадобиться:
1. Векторна база даних (Pinecone, Qdrant, Weaviate) для швидкого пошуку по базі знань (RAG): ~$20-70/міс залежно від об'єму.
2. Сервер (VPS), де крутиться бекенд-логіка бота (Node.js/Python): ~$10-20/міс.
3. Вартість розробки та інтеграції з вашою CRM/Telegram/Сайтом (одноразова інвестиція).
Висновки:
Сьогодні запускати бота на топовій і важкій GPT-4o для відповідей на прості FAQ — це спалювання грошей. Легкі моделі типу GPT-4o-mini або Haiku за $10-15 на місяць закривають абсолютну більшість потреб бізнесу без втрати якості для клієнта.
Хто з вас впроваджував або розробляв Q&A ботів? Які моделі обрали під капотом і скільки реально платите за API в кінці місяця?
Я вирішив зробити детальну калькуляцію на прикладі кількох різних моделей, щоб показати, які щомісячні витрати на API вас очікують.
Ввідні дані для розрахунку:
Уявімо середній інтернет-магазин або сервіс. Бот обробляє 1000 діалогів на день (близько 30 000 запитів на місяць).
Для якісної відповіді бот використовує RAG (Retrieval-Augmented Generation — підвантажує статті з вашої бази знань) + зберігає історію діалогу.
- Середній об'єм **Input** (запит юзера + системний промпт + RAG-контекст): 1500 токенів на запит.
- Середній об'єм **Output** (відповідь бота): 200 токенів.
Разом за місяць маємо: **45 млн вхідних токенів** та **6 млн вихідних токенів**.
Сценарій 1: Флагманські моделі (GPT-4o / Claude 3.5 Sonnet)
Використовуються для дуже складних логічних задач, де не можна помилятися.
- Тарифи (в середньому): $5 за 1M Input, $15 за 1M Output.
- Вартість Input за місяць: 45 * $5 = $225
- Вартість Output за місяць: 6 * $15 = $90
Разом: ~$315 на місяць. (Досить відчутно, але все одно значно дешевше за зарплату живого оператора підтримки).
Сценарій 2: Швидкі та дешеві моделі (GPT-4o-mini / Claude 3 Haiku)
Ідеальні для 95% рутинних питань клієнтів ("де моє замовлення", "як повернути товар", "графік роботи").
- Тарифи (в середньому): $0.15 за 1M Input, $0.60 за 1M Output.
- Вартість Input за місяць: 45 * $0.15 = $6.75
- Вартість Output за місяць: 6 * $0.60 = $3.60
Разом: ~$10.35 на місяць. (Це просто копійки за обробку 30 000 діалогів!).
Сценарій 3: Open-Source через API (Llama 3 / Mixtral на Groq чи Together AI)
Відкриті моделі, які хостяться на сторонніх швидких серверах.
- Тарифи: близько $0.05 за 1M Input, $0.10 за 1M Output.
Разом: ~$2.85 на місяць. (Майже безкоштовно).
Приховані витрати:
Не забувайте, що "гола" модель (просто доступ до API) — це ще не готовий бот. Вам також знадобиться:
1. Векторна база даних (Pinecone, Qdrant, Weaviate) для швидкого пошуку по базі знань (RAG): ~$20-70/міс залежно від об'єму.
2. Сервер (VPS), де крутиться бекенд-логіка бота (Node.js/Python): ~$10-20/міс.
3. Вартість розробки та інтеграції з вашою CRM/Telegram/Сайтом (одноразова інвестиція).
Висновки:
Сьогодні запускати бота на топовій і важкій GPT-4o для відповідей на прості FAQ — це спалювання грошей. Легкі моделі типу GPT-4o-mini або Haiku за $10-15 на місяць закривають абсолютну більшість потреб бізнесу без втрати якості для клієнта.
Хто з вас впроваджував або розробляв Q&A ботів? Які моделі обрали під капотом і скільки реально платите за API в кінці місяця?
Kiber Arkhitektor | Expert AI System
Побудова досконалих цифрових світів та архітектур.


Займаюсь розробкою сайтів,