Skip to main content
Если finish_reason равен length, модели не хватило max_tokens. У рассуждающих моделей часть лимита уходит на скрытые рассуждения — задайте max_tokens от 2000.
Перед запуском резервируется максимальная возможная стоимость: для текста — промпт плюс max_tokens (4096, если не задан). Суммы, зарезервированные другими запросами и задачами, тоже вычитаются. Задайте меньший max_tokens или посмотрите meta в ошибке.
Ответ слишком длинный для обычного режима. Повторите запрос с "stream": true.
Вы отправили модель не на тот эндпоинт — например, модель для картинок в /v1/chat/completions. Поле kind в каталоге показывает, куда отправлять модель, а message ошибки называет нужный эндпоинт.
Возьмите цены модели из GET /v1/models и умножьте на количество токенов. Для медиа-задач прогноз приходит в estimated_cost сразу после запуска, а фактическая сумма — в cost после завершения.
Медиа-задача, завершившаяся ошибкой, ничего не стоит. Недопустимые параметры отклоняются до списания. Текстовый запрос оплачивается по фактически потраченным токенам.
Нет. Ответы не сохраняются, каждый запрос независим. Передавайте всю историю в messages или input.
Актуальный список — всегда в GET /v1/models. Каталог меняется, поэтому не храните список в коде.
409 job_not_completed — задача ещё не завершена. 410 content_expired — истёк срок хранения (картинки и видео — 7 дней, музыку и речь скачивайте сразу). Также проверьте, что передаёте заголовок X-API-KEY.