МОДЕЛЬ
OpenAI: GPT-4o-mini
openai/gpt-4o-mini
Контекст
128 000
токенов
Модальность
chat
tools · vision · streaming
Статус
активна
в каталоге
Спецификация
Модальности
вход:textimagefileвыход:text
Поддерживаемые параметры
frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokenspredictionpresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options
Реальные метрики
из логов запросов24 часа
1
запросов
- Ср. латентность
- 1207 ms
- Успешность
- 100.0%
7 дней
12
запросов
- Ср. латентность
- 782 ms
- Успешность
- 100.0%
всё время
30
запросов
- Ср. латентность
- 3070 ms
- Успешность
- 100.0%
Эффективная цена и кэш
после кэша и smart-blend · всё времяЭфф. цена
₽ 49,63
за 1M токенов, факт.
Cache-read
0.0%
промпта из кэша
Токенов
5.6K
841 in · 4.8K out
Потрачено
₽ 0
всего по модели
Цены
| Направление | ₽ / 1M ток. | ≈ ₽ / 1K ток. |
|---|---|---|
| Входящие токены (prompt) | ₽ 14,13 | ₽ 0.0141 |
| Исходящие токены (completion) | ₽ 56,55 | ₽ 0.0565 |
Провайдеры
латентность и аптайм за 24ч| Провайдер | Контекст | Латентность | Аптайм | ₽/1M вход | ₽/1M выход |
|---|---|---|---|---|---|
| OpenRouter | 128 000 | 1207 ms | 100.0% | ₽ 14,13 | ₽ 56,55 |
Роутинг выбирает провайдера по smart-blend (цена · латентность · доступность).
Использование (OpenAI SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://api.vozmiapi.ru/v1",
api_key="YOUR_VOZMIAPI_KEY",
)
resp = client.chat.completions.create(
model="openai/gpt-4o-mini",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)cURL
curl https://api.vozmiapi.ru/v1/chat/completions \
-H "Authorization: Bearer $VOZMIAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-4o-mini",
"messages": [{"role": "user", "content": "Привет!"}]
}'