Пользовательское соглашение
Дата последнего обновления: 21 июля 2026 г.
1. Что делает возьми API
возьми API — это единый шлюз к каталогу ведущих LLM, совместимый с форматами OpenAI и Anthropic. Мы сами подбираем оптимального провайдера для каждого запроса, а часть запросов дополнительно оптимизируется через кэш и умную маршрутизацию модели (см. ниже).
2. Умная маршрутизация модели
Для запросов, которые система классифицирует как «лёгкие» (короткое summary, перевод, простая классификация без длинного контекста), мы можем обслужить запрос более дешёвой моделью того же класса — вместо запрошенной. Это снижает стоимость и латентность, не меняя формат ответа.
Прозрачность:
- В ответе всегда указывается, какая модель фактически обслужила запрос.
- Умную маршрутизацию можно отключить как для отдельного запроса, так и глобально — в настройках кабинета.
- Биллинг: списание идёт по тарифу той модели, которая фактически обслужила запрос. Сэкономленную сумму видно в карточке генерации.
- Качество ответов регулярно контролируется, и при отклонениях маршрутизация корректируется.
3. Кэширование
Только детерминированные запросы кэшируются: temperature=0 или top_p=1 + seed, без tools, без stream. TTL — 24 часа. Повторный детерминированный запрос обслуживается из кэша: он не тарифицируется (нулевая стоимость) и не обращается к провайдеру повторно.
4. Биллинг и пополнения
- Списание — в копейках (
kop), расчёт по фактическому количеству prompt/completion токенов из ответа провайдера. Наценка по умолчанию 20% сверху от цены провайдера, индивидуальная — в карточке модели. - Пополнение картой РФ или через СБП реализуется через ЮKassa. Чек ОФД формируется автоматически на email пользователя. Зачисление — в момент подтверждения платежа.
- Минимальный остаток для запросов — 0.10 ₽. Запросы выше остатка отклоняются с кодом 402.
5. Данные и логи
- Каждая генерация сохраняется в БД: prompt, completion, токены, модель, latency. Срок хранения — пока действует ваш аккаунт.
- Эти данные не передаются третьим лицам, кроме провайдера, обслужившего запрос (см. каталог моделей).
- Удаление аккаунта удаляет все ваши генерации (cascade).
6. Лимиты и safety
- Per-key rate limit: настраивается в кабинете (
rate_limit_rpm). - Per-key credit cap: ограничивает сумму, которую можно потратить этим ключом.
- Отказоустойчивость: сбой вспомогательных сервисов (кэш, метрики) никогда не ломает ваш запрос.
7. Контакты
По всем вопросам — support@vozmiapi.ru. Эта страница может обновляться без отдельного уведомления; материальные изменения объявляются в кабинете.