Модели и цены
Как считается цена
Цена клиента считается за 1M токенов, вход и выход — отдельно, и бывает одного из двух видов:
-
Наценка (markup) — закупочная цена провайдера в USD переводится в рубли по эффективному курсу и умножается на наценку модели:
цена_RUB = закупка_USD × курс_эфф × (1 + markup_pct / 100) курс_эфф = курс_ЦБ × (1 + fx_buffer_pct / 100) # буфер по умолчанию 5% -
Фиксированная (fixed) — цена в рублях задаётся вручную и не зависит от курса.
Стоимость конкретного запроса — tokens_in / 1M × цена_in + tokens_out / 1M × цена_out. Цена за 1K токенов — то же значение в другом масштабе,
для удобства чтения на небольших объёмах.
Это ровно та формула, что видно в ответе GET /v1/models и в витрине
цен — числа совпадают, ничего не пересчитывается отдельно
для лендинга.
GET /v1/models
Публичный, не требует авторизации. Возвращает список включённых моделей:
curl https://api.aigateway.andrewdev.ru/v1/models{
"object": "list",
"data": [
{
"id": "gemini-3.5-flash",
"object": "model",
"owned_by": "tunnel",
"modality": "chat",
"context_window": 1000000,
"pricing": {
"currency": "RUB",
"per_1m_tokens": { "input": "185.5", "output": "556.5" },
"per_1k_tokens": { "input": "0.1855", "output": "0.5565" }
}
},
{
"id": "gemini-embedding-2",
"object": "model",
"owned_by": "tunnel",
"modality": "embedding",
"context_window": 8192,
"pricing": {
"currency": "RUB",
"per_1m_tokens": { "input": "12.3", "output": "0" },
"per_1k_tokens": { "input": "0.0123", "output": "0" }
}
}
]
}Конкретные id, context_window и цены зависят от того, что сейчас
включено в каталоге, и от текущего курса ЦБ — приведённые значения
иллюстративные. Актуальный список — всегда в самом ответе эндпоинта или
на странице цен.
id — тот же slug, что передаётся в model при вызове
/v1/chat/completions или
/v1/embeddings. modality подсказывает, в какой
эндпоинт эту модель можно передавать.