возьми API
Кабинет

МОДЕЛЬ

OpenAI: GPT-4o-mini

openai/gpt-4o-mini

openai

Контекст

128 000

токенов

Модальность

chat

tools · vision · streaming

Статус

активна

в каталоге

Спецификация

Модальности

вход:textimagefileвыход:text

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokenspredictionpresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options

Реальные метрики

из логов запросов

24 часа

1

запросов

Ср. латентность
1207 ms
Успешность
100.0%

7 дней

12

запросов

Ср. латентность
782 ms
Успешность
100.0%

всё время

30

запросов

Ср. латентность
3070 ms
Успешность
100.0%

Эффективная цена и кэш

после кэша и smart-blend · всё время

Эфф. цена

₽ 49,63

за 1M токенов, факт.

Cache-read

0.0%

промпта из кэша

Токенов

5.6K

841 in · 4.8K out

Потрачено

0

всего по модели

Цены

Направление₽ / 1M ток.≈ ₽ / 1K ток.
Входящие токены (prompt)14,130.0141
Исходящие токены (completion)56,550.0565

Провайдеры

латентность и аптайм за 24ч
ПровайдерКонтекстЛатентностьАптайм₽/1M вход₽/1M выход
OpenRouter128 0001207 ms100.0%14,1356,55

Роутинг выбирает провайдера по smart-blend (цена · латентность · доступность).

Использование (OpenAI SDK)

from openai import OpenAI

client = OpenAI(
    base_url="https://api.vozmiapi.ru/v1",
    api_key="YOUR_VOZMIAPI_KEY",
)

resp = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

cURL

curl https://api.vozmiapi.ru/v1/chat/completions \
  -H "Authorization: Bearer $VOZMIAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'