Найпоширеніша помилка — це оцінка вартості лише за кількістю слів та ігнорування того, що код, JSON, пунктуація та неангломовний текст токенізуються набагато щільніше, ніж звичайна проза.
Дехто забуває, що системні промпти, історія чату та визначення інструментів оплачуються як вхідні дані під час кожного окремого виклику, тому багатоходові розмови швидко накопичують витрати.
Багато користувачів також застосовують однакову ціну до вхідних і вихідних даних, попри те, що вихідні токени коштують у кілька разів дорожче, і вони не помічають, що ціни на офіційних сторінках OpenAI, Anthropic та Google з часом змінюються.
Нарешті, припущення, що кількість токенів одного провайдера переноситься на іншого, призводить до несподіванок у бюджеті. Завжди перевіряйте за допомогою справжнього токенізатора та поточних опублікованих тарифів.