PostCorporate APIBLOG
← все заметки

Как считать цену AI API без пакетных бонусов

Самая честная витрина пополнения скучная: сколько долларов положили, столько и лежит на балансе. Никаких «+35% токенов» и эквивалентов, которые потом невозможно сверить с расходом. Расход всё равно считается по фактической цене модели — вход, выход и кеш. Именно эти три строки и должны совпадать с биллингом.

Формула без магии

Для одного запроса считайте так:

стоимость = свежие_входные_токены × цена_входа
          + кешированные_токены × цена_кеша
          + выходные_токены × цена_выхода

Цены указаны за 1M токенов, поэтому в коде делите на 1 000 000. Если модель имеет коэффициент к базовой модели, цена в таблице уже показывает итоговый $/1M — умножать коэффициент второй раз не нужно.

Пример

Допустим, у модели вход стоит $0.05 за 1M, выход — $0.25 за 1M, кеш — $0.025 за 1M. Запрос: 300K свежего входа, 100K кеша, 2K выхода.

вход:  300000 × 0.05  / 1_000_000 = $0.015
кеш:   100000 × 0.025 / 1_000_000 = $0.0025
выход:   2000 × 0.25  / 1_000_000 = $0.0005
итого: $0.018

Именно $0.018 должно уйти с баланса. Не «примерно 420K токенов», а конкретные центы по конкретному прайсу.

Почему токенные эквиваленты при пополнении вредят

Фраза «$5 = 145M токенов» верна только для одной воображаемой модели с коэффициентом ×1. На тяжёлой модели тот же баланс уйдёт в разы быстрее, на дешёвой — медленнее. Когда витрина показывает доллары, клиент сравнивает пополнение с балансом и расходом, а не с бесполезным средним токеном.

Правило для команды. В продажах — доллары. В тарифе — $/1M по входу, выходу и кешу. В аналитике — фактические центы по каждому запросу. Тогда баланс сходится без объяснений.