Создать ответ
Создает потоковый или непотоковый ответ, используя формат API OpenResponses.
Authorizations
API-ключ в качестве токена носителя в заголовке авторизации
Headers
Дайте согласие на отображение метаданных маршрутизации в ответе в разделе llmstore_metadata. По умолчанию отключено. Устаревший заголовок X-LLMSTORE-Experimental-Metadata также принимается для обратной совместимости.
Уровень согласия для отображения метаданных маршрутизации в ответе в разделе llmstore_metadata.
disabled, enabled "enabled"
Body
Схема запроса для эндпоинта ответов
Включите автоматическое кэширование подсказок. Если установлено на верхнем уровне, система автоматически применяет точки останова кэша к последнему кэшируемому блоку в запросе. Если он установлен для отдельного блока контента, он отмечает явную точку останова в кэше; Токены уровня блоков также работают с моделями OpenAI, которые поддерживают явное кэширование подсказок — LLMSTORE преобразует их в собственный формат провайдера.
Параметры отладки для проверки преобразований запросов (только потоковая передача)
Параметры конфигурации образа, зависящие от поставщика. Ключи и значения различаются в зависимости от модели/провайдера. Подробнее см. https://llmstore.ru/docs/guides/overview/multimodal/image-generation.
file_search_call.results, message.input_image.image_url, computer_call_output.output.image_url, reasoning.encrypted_content, code_interpreter_call.outputs Ввод для запроса ответа — может быть строкой или массивом элементов.
Максимальное количество шагов агента серверного инструмента (например, 'web_search), которое модель может выполнить во время запроса. По умолчанию 30, что также является максимальным. Игнорируется, если установлен stop_server_tools_when.
30
Пары ключ-значение метаданных для запроса. Ключи должны содержать не более 64 символов и не могут содержать скобки. Значения должны содержать не более 512 символов. Разрешается максимум 16 пар.
Способы вывода ответа. Поддерживаемые значения: «текст» и «изображение».
text, image Плагины, которые вы хотите включить для этого запроса, включая их настройки.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
Не поддерживается. Responses API не имеет состояния: ответы не сохраняются, поэтому на предыдущий ответ нельзя ссылаться. Запросы с ненулевым значением отклоняются с ошибкой 400. Вместо этого отправьте полную историю разговоров во «вход».
Элементы управления кэшем подсказок на уровне запроса. mode: "explicit" отключает точки останова, управляемые OpenAI, поэтому кэшируются только блоки, отмеченные prompt_cache_breakpoint. Поддерживается только OpenAI GPT-5.6 и новее.
Если доступно несколько поставщиков моделей, при необходимости укажите предпочтения маршрутизации.
Конфигурация режима рассуждения в ответе
УСТАРЕЛО Вместо этого используйте parts.sort.partition. Обратно совместимый псевдоним дляпровайдеров.sort.partition. Принимает устаревшие значения: «резервный» (сопоставляется с «моделью»), «сортировка» (сопоставляется с «нет»).
fallback, sort, null "fallback"
Рекомендуемый идентификатор конечного пользователя для изоляции злоупотреблений. Используйте стабильный идентификатор, хэш или псевдоним. Когда провайдеру требуется идентификатор пользователя, LLMSTORE складывает его в хешированный идентификатор, отправляемый вверх по течению, и никогда не пересылает его в необработанном виде. Если этот параметр опущен, запросы используют идентификатор уровня учетной записи, поэтому блокировка политики поставщика может повлиять на всю учетную запись.
"user-123"
Уровень служб, используемый для обработки этого запроса. «быстрый» принимается как псевдоним «приоритета».
auto, default, fast, flex, priority, scale, null Уникальный идентификатор для группировки связанных запросов (например, разговора или рабочего процесса агента). Если он предоставлен, LLMSTORE использует его в качестве липкого ключа маршрутизации, направляя все запросы в сеансе к одному и тому же поставщику, чтобы максимизировать попадание в кэш запросов. Также используется для группировки наблюдаемости. Если оно указано как в теле запроса, так и в заголовке x-session-id, значение body имеет приоритет. Максимум 256 символов.
256Условия остановки цикла агента серверного инструмента. Любое срабатывание условия останавливает цикл (логика ИЛИ). Если установлено, это переопределяет max_tool_calls. Когда условие срабатывает, пока модель все еще генерирует вызовы инструментов, ожидающие вызовы инструментов выполняются, и выполняется последний поворот с отключенными вызовами инструментов, поэтому ответ заканчивается ответом на естественном языке вместо незавершенного вызова инструмента.
1Единственное условие, при выполнении которого цикл агента серверного инструмента останавливается.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
Конфигурация вывода текста, включая формат и многословность
auto "auto"
Определение функционального инструмента
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
- Option 16
- Option 17
- Option 18
- Option 19
- Option 20
- Option 21
- Option 22
- Option 23
- Option 24
- Option 25
- Option 26
- Option 27
Метаданные для наблюдения и отслеживания. Известные ключи (trace_id, Trace_name, Span_Name, Generation_Name, Parent_span_id) имеют специальную обработку. Дополнительные ключи передаются в виде пользовательских метаданных в настроенные пункты назначения широковещательной передачи.
auto, disabled, null "auto"
Уникальный идентификатор, представляющий вашего конечного пользователя, который помогает различать разных пользователей вашего приложения. Это позволяет вашему приложению идентифицировать конкретных пользователей в случае сообщений о злоупотреблениях, предотвращая влияние действий отдельных пользователей на все ваше приложение. Максимум 256 символов.
256Response
Успешный ответ
Полный непотоковое ответ от Responses API
Информация об ошибке, возвращенная из API
Пары ключ-значение метаданных для запроса. Ключи должны содержать не более 64 символов и не могут содержать скобки. Значения должны содержать не более 512 символов. Разрешается максимум 16 пар.
response Выходной элемент ответа
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
- Option 16
- Option 17
- Option 18
- Option 19
- Option 20
- Option 21
- Option 22
- Option 23
- Option 24
- Option 25
- Option 26
- Option 27
- Option 28
- Option 29
- Option 30
- Option 31
- Option 32
- Option 33
- Option 34
- Option 35
- Option 36
- Option 37
- Option 38
- Option 39
- Option 40
- Option 41
- Option 42
- Option 43
- Option 44
- Option 45
- Option 46
- Option 47
- Option 48
- Option 49
- Option 50
- Option 51
- Option 52
- Option 53
- Option 54
- Option 55
- Option 56
- Option 57
- Option 58
- Option 59
- Option 60
- Option 61
- Option 62
- Option 63
- Option 64
- Option 65
- Option 66
- Option 67
- Option 68
- Option 69
- Option 70
- Option 71
- Option 72
- Option 73
- Option 74
- Option 75
- Option 76
- Option 77
- Option 78
- Option 79
- Option 80
- Option 81
- Option 82
- Option 83
- Option 84
- Option 85
- Option 86
- Option 87
- Option 88
- Option 89
- Option 90
- Option 91
- Option 92
- Option 93
- Option 94
- Option 95
- Option 96
- Option 97
- Option 98
- Option 99
- Option 100
- Option 101
- Option 102
- Option 103
- Option 104
- Option 105
- Option 106
- Option 107
- Option 108
- Option 109
- Option 110
- Option 111
- Option 112
- Option 113
- Option 114
- Option 115
- Option 116
- Option 117
- Option 118
- Option 119
- Option 120
- Option 121
- Option 122
- Option 123
- Option 124
- Option 125
- Option 126
- Option 127
- Option 128
- Option 129
- Option 130
- Option 131
- Option 132
- Option 133
- Option 134
- Option 135
- Option 136
- Option 137
- Option 138
- Option 139
- Option 140
- Option 141
- Option 142
- Option 143
- Option 144
- Option 145
- Option 146
- Option 147
- Option 148
- Option 149
- Option 150
- Option 151
- Option 152
- Option 153
- Option 154
- Option 155
- Option 156
- Option 157
- Option 158
- Option 159
- Option 160
- Option 161
- Option 162
- Option 163
- Option 164
- Option 165
- Option 166
- Option 167
- Option 168
- Option 169
- Option 170
- Option 171
- Option 172
- Option 173
- Option 174
- Option 175
- Option 176
- Option 177
- Option 178
- Option 179
- Option 180
- Option 181
- Option 182
- Option 183
- Option 184
- Option 185
- Option 186
- Option 187
- Option 188
- Option 189
- Option 190
- Option 191
- Option 192
- Option 193
- Option 194
- Option 195
- Option 196
- Option 197
- Option 198
- Option 199
- Option 200
- Option 201
- Option 202
- Option 203
- Option 204
- Option 205
- Option 206
- Option 207
- Option 208
- Option 209
- Option 210
- Option 211
- Option 212
- Option 213
- Option 214
- Option 215
- Option 216
- Option 217
- Option 218
- Option 219
- Option 220
- Option 221
- Option 222
- Option 223
- Option 224
- Option 225
- Option 226
- Option 227
- Option 228
- Option 229
- Option 230
- Option 231
- Option 232
- Option 233
- Option 234
- Option 235
completed, incomplete, in_progress, failed, cancelled, queued "completed"
auto "auto"
Определение функционального инструмента
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
Элементы управления кэшем подсказок на уровне запроса. mode: "explicit" отключает точки останова, управляемые OpenAI, поэтому кэшируются только блоки, отмеченные prompt_cache_breakpoint. Поддерживается только OpenAI GPT-5.6 и новее.
auto, default, flex, priority, scale, null "default"
Конфигурация вывода текста, включая формат и многословность
auto, disabled, null "auto"
Информация об использовании токена для ответа
Тип ошибки Canonical LLMSTORE, стабильный для всех форматов API
context_length_exceeded, max_tokens_exceeded, token_limit_exceeded, string_too_long, authentication, permission_denied, payment_required, rate_limit_exceeded, provider_overloaded, provider_unavailable, invalid_request, invalid_prompt, not_found, precondition_failed, payload_too_large, unprocessable, content_policy_violation, refusal, invalid_image, image_too_large, image_too_small, unsupported_image_format, image_not_found, image_download_failed, server, timeout, unmapped "rate_limit_exceeded"