POST
Создать ответ

Authorizations

Authorization
string
header
required

API-ключ в качестве токена носителя в заголовке авторизации

Headers

X-LLMSTORE-Metadata
enum<string>

Дайте согласие на отображение метаданных маршрутизации в ответе в разделе llmstore_metadata. По умолчанию отключено. Устаревший заголовок X-LLMSTORE-Experimental-Metadata также принимается для обратной совместимости. Уровень согласия для отображения метаданных маршрутизации в ответе в разделе llmstore_metadata.

Available options:
disabled,
enabled
Example:

"enabled"

Body

application/json

Схема запроса для эндпоинта ответов

background
boolean | null
cache_control
object

Включите автоматическое кэширование подсказок. Если установлено на верхнем уровне, система автоматически применяет точки останова кэша к последнему кэшируемому блоку в запросе. Если он установлен для отдельного блока контента, он отмечает явную точку останова в кэше; Токены уровня блоков также работают с моделями OpenAI, которые поддерживают явное кэширование подсказок — LLMSTORE преобразует их в собственный формат провайдера.

Example:
debug
object

Параметры отладки для проверки преобразований запросов (только потоковая передача)

Example:
frequency_penalty
number<double> | null
image_config
object

Параметры конфигурации образа, зависящие от поставщика. Ключи и значения различаются в зависимости от модели/провайдера. Подробнее см. https://llmstore.ru/docs/guides/overview/multimodal/image-generation.

Example:
include
enum<string>[] | null
Available options:
file_search_call.results,
message.input_image.image_url,
computer_call_output.output.image_url,
reasoning.encrypted_content,
code_interpreter_call.outputs
input

Ввод для запроса ответа — может быть строкой или массивом элементов.

Example:
instructions
string | null
max_output_tokens
integer | null
max_tool_calls
integer | null

Максимальное количество шагов агента серверного инструмента (например, 'web_search), которое модель может выполнить во время запроса. По умолчанию 30, что также является максимальным. Игнорируется, если установлен stop_server_tools_when.

Example:

30

metadata
object | null

Пары ключ-значение метаданных для запроса. Ключи должны содержать не более 64 символов и не могут содержать скобки. Значения должны содержать не более 512 символов. Разрешается максимум 16 пар.

Example:
modalities
enum<string>[]

Способы вывода ответа. Поддерживаемые значения: «текст» и «изображение».

Available options:
text,
image
Example:
model
string
models
string[]
parallel_tool_calls
boolean | null
plugins
object[]

Плагины, которые вы хотите включить для этого запроса, включая их настройки.

Example:
presence_penalty
number<double> | null
previous_response_id
any

Не поддерживается. Responses API не имеет состояния: ответы не сохраняются, поэтому на предыдущий ответ нельзя ссылаться. Запросы с ненулевым значением отклоняются с ошибкой 400. Вместо этого отправьте полную историю разговоров во «вход».

prompt
object | null
Example:
prompt_cache_key
string | null
prompt_cache_options
object | null

Элементы управления кэшем подсказок на уровне запроса. mode: "explicit" отключает точки останова, управляемые OpenAI, поэтому кэшируются только блоки, отмеченные prompt_cache_breakpoint. Поддерживается только OpenAI GPT-5.6 и новее.

Example:
provider
object | null

Если доступно несколько поставщиков моделей, при необходимости укажите предпочтения маршрутизации.

Example:
reasoning
object | null

Конфигурация режима рассуждения в ответе

Example:
route
enum<string> | null
deprecated

УСТАРЕЛО Вместо этого используйте parts.sort.partition. Обратно совместимый псевдоним дляпровайдеров.sort.partition. Принимает устаревшие значения: «резервный» (сопоставляется с «моделью»), «сортировка» (сопоставляется с «нет»).

Available options:
fallback,
sort,
null
Example:

"fallback"

safety_identifier
string | null

Рекомендуемый идентификатор конечного пользователя для изоляции злоупотреблений. Используйте стабильный идентификатор, хэш или псевдоним. Когда провайдеру требуется идентификатор пользователя, LLMSTORE складывает его в хешированный идентификатор, отправляемый вверх по течению, и никогда не пересылает его в необработанном виде. Если этот параметр опущен, запросы используют идентификатор уровня учетной записи, поэтому блокировка политики поставщика может повлиять на всю учетную запись.

Example:

"user-123"

service_tier
enum<string> | null
default:auto

Уровень служб, используемый для обработки этого запроса. «быстрый» принимается как псевдоним «приоритета».

Available options:
auto,
default,
fast,
flex,
priority,
scale,
null
session_id
string

Уникальный идентификатор для группировки связанных запросов (например, разговора или рабочего процесса агента). Если он предоставлен, LLMSTORE использует его в качестве липкого ключа маршрутизации, направляя все запросы в сеансе к одному и тому же поставщику, чтобы максимизировать попадание в кэш запросов. Также используется для группировки наблюдаемости. Если оно указано как в теле запроса, так и в заголовке x-session-id, значение body имеет приоритет. Максимум 256 символов.

Maximum string length: 256
stop_server_tools_when
object[]

Условия остановки цикла агента серверного инструмента. Любое срабатывание условия останавливает цикл (логика ИЛИ). Если установлено, это переопределяет max_tool_calls. Когда условие срабатывает, пока модель все еще генерирует вызовы инструментов, ожидающие вызовы инструментов выполняются, и выполняется последний поворот с отключенными вызовами инструментов, поэтому ответ заканчивается ответом на естественном языке вместо незавершенного вызова инструмента.

Minimum array length: 1

Единственное условие, при выполнении которого цикл агента серверного инструмента останавливается.

Example:
Example:
store
boolean
default:false
stream
boolean
default:false
temperature
number<double> | null
text
object

Конфигурация вывода текста, включая формат и многословность

Example:
tool_choice
Available options:
auto
Example:

"auto"

tools
object[]

Определение функционального инструмента

Example:
top_k
integer
top_logprobs
integer | null
top_p
number<double> | null
trace
object

Метаданные для наблюдения и отслеживания. Известные ключи (trace_id, Trace_name, Span_Name, Generation_Name, Parent_span_id) имеют специальную обработку. Дополнительные ключи передаются в виде пользовательских метаданных в настроенные пункты назначения широковещательной передачи.

Example:
truncation
enum<string> | null
Available options:
auto,
disabled,
null
Example:

"auto"

user
string

Уникальный идентификатор, представляющий вашего конечного пользователя, который помогает различать разных пользователей вашего приложения. Это позволяет вашему приложению идентифицировать конкретных пользователей в случае сообщений о злоупотреблениях, предотвращая влияние действий отдельных пользователей на все ваше приложение. Максимум 256 символов.

Maximum string length: 256

Response

Успешный ответ

Полный непотоковое ответ от Responses API

completed_at
integer | null
required
created_at
integer
required
error
object | null
required

Информация об ошибке, возвращенная из API

Example:
frequency_penalty
number<double> | null
required
id
string
required
incomplete_details
object | null
required
Example:
instructions
required
Example:
metadata
object | null
required

Пары ключ-значение метаданных для запроса. Ключи должны содержать не более 64 символов и не могут содержать скобки. Значения должны содержать не более 512 символов. Разрешается максимум 16 пар.

Example:
model
string
required
object
enum<string>
required
Available options:
response
output
object[]
required

Выходной элемент ответа

Example:
parallel_tool_calls
boolean
required
presence_penalty
number<double> | null
required
status
enum<string>
required
Available options:
completed,
incomplete,
in_progress,
failed,
cancelled,
queued
Example:

"completed"

temperature
number<double> | null
required
tool_choice
required
Available options:
auto
Example:

"auto"

tools
object[]
required

Определение функционального инструмента

Example:
top_p
number<double> | null
required
background
boolean | null
max_output_tokens
integer | null
max_tool_calls
integer | null
output_text
string
previous_response_id
string | null
prompt
object | null
Example:
prompt_cache_key
string | null
prompt_cache_options
object | null

Элементы управления кэшем подсказок на уровне запроса. mode: "explicit" отключает точки останова, управляемые OpenAI, поэтому кэшируются только блоки, отмеченные prompt_cache_breakpoint. Поддерживается только OpenAI GPT-5.6 и новее.

Example:
reasoning
object | null
Example:
safety_identifier
string | null
service_tier
enum<string> | null
Available options:
auto,
default,
flex,
priority,
scale,
null
Example:

"default"

store
boolean
text
object

Конфигурация вывода текста, включая формат и многословность

Example:
top_logprobs
integer
truncation
enum<string> | null
Available options:
auto,
disabled,
null
Example:

"auto"

usage
object

Информация об использовании токена для ответа

Example:
user
string | null
error_type
enum<string>

Тип ошибки Canonical LLMSTORE, стабильный для всех форматов API

Available options:
context_length_exceeded,
max_tokens_exceeded,
token_limit_exceeded,
string_too_long,
authentication,
permission_denied,
payment_required,
rate_limit_exceeded,
provider_overloaded,
provider_unavailable,
invalid_request,
invalid_prompt,
not_found,
precondition_failed,
payload_too_large,
unprocessable,
content_policy_violation,
refusal,
invalid_image,
image_too_large,
image_too_small,
unsupported_image_format,
image_not_found,
image_download_failed,
server,
timeout,
unmapped
Example:

"rate_limit_exceeded"

llmstore_metadata
object
Example: