Создать пресет из тела запроса на ответы
Создает пресет (или новую версию существующего) из тела запроса на вывод. Сохраняются только поля, которые перекрываются с предустановленной конфигурацией; другие поля (например, «сообщения», «поток», «подсказка») игнорируются.
Authorizations
API-ключ в качестве токена носителя в заголовке авторизации
Path Parameters
URL-безопасный фрагмент, идентифицирующий предустановку. Создается, если он не существует.
1"my-preset"
Body
Схема запроса для эндпоинта ответов
Включите автоматическое кэширование подсказок. Если установлено на верхнем уровне, система автоматически применяет точки останова кэша к последнему кэшируемому блоку в запросе. Если он установлен для отдельного блока контента, он отмечает явную точку останова в кэше; Токены уровня блоков также работают с моделями OpenAI, которые поддерживают явное кэширование подсказок — LLMSTORE преобразует их в собственный формат провайдера.
Параметры отладки для проверки преобразований запросов (только потоковая передача)
Параметры конфигурации образа, зависящие от поставщика. Ключи и значения различаются в зависимости от модели/провайдера. Подробнее см. https://llmstore.ru/docs/guides/overview/multimodal/image-generation.
file_search_call.results, message.input_image.image_url, computer_call_output.output.image_url, reasoning.encrypted_content, code_interpreter_call.outputs Ввод для запроса ответа — может быть строкой или массивом элементов.
Максимальное количество шагов агента серверного инструмента (например, 'web_search), которое модель может выполнить во время запроса. По умолчанию 30, что также является максимальным. Игнорируется, если установлен stop_server_tools_when.
30
Пары ключ-значение метаданных для запроса. Ключи должны содержать не более 64 символов и не могут содержать скобки. Значения должны содержать не более 512 символов. Разрешается максимум 16 пар.
Способы вывода ответа. Поддерживаемые значения: «текст» и «изображение».
text, image Плагины, которые вы хотите включить для этого запроса, включая их настройки.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
Не поддерживается. Responses API не имеет состояния: ответы не сохраняются, поэтому на предыдущий ответ нельзя ссылаться. Запросы с ненулевым значением отклоняются с ошибкой 400. Вместо этого отправьте полную историю разговоров во «вход».
Элементы управления кэшем подсказок на уровне запроса. mode: "explicit" отключает точки останова, управляемые OpenAI, поэтому кэшируются только блоки, отмеченные prompt_cache_breakpoint. Поддерживается только OpenAI GPT-5.6 и новее.
Если доступно несколько поставщиков моделей, при необходимости укажите предпочтения маршрутизации.
Конфигурация режима рассуждения в ответе
УСТАРЕЛО Вместо этого используйте parts.sort.partition. Обратно совместимый псевдоним дляпровайдеров.sort.partition. Принимает устаревшие значения: «резервный» (сопоставляется с «моделью»), «сортировка» (сопоставляется с «нет»).
fallback, sort, null "fallback"
Рекомендуемый идентификатор конечного пользователя для изоляции злоупотреблений. Используйте стабильный идентификатор, хэш или псевдоним. Когда провайдеру требуется идентификатор пользователя, LLMSTORE складывает его в хешированный идентификатор, отправляемый вверх по течению, и никогда не пересылает его в необработанном виде. Если этот параметр опущен, запросы используют идентификатор уровня учетной записи, поэтому блокировка политики поставщика может повлиять на всю учетную запись.
"user-123"
Уровень служб, используемый для обработки этого запроса. «быстрый» принимается как псевдоним «приоритета».
auto, default, fast, flex, priority, scale, null Уникальный идентификатор для группировки связанных запросов (например, разговора или рабочего процесса агента). Если он предоставлен, LLMSTORE использует его в качестве липкого ключа маршрутизации, направляя все запросы в сеансе к одному и тому же поставщику, чтобы максимизировать попадание в кэш запросов. Также используется для группировки наблюдаемости. Если оно указано как в теле запроса, так и в заголовке x-session-id, значение body имеет приоритет. Максимум 256 символов.
256Условия остановки цикла агента серверного инструмента. Любое срабатывание условия останавливает цикл (логика ИЛИ). Если установлено, это переопределяет max_tool_calls. Когда условие срабатывает, пока модель все еще генерирует вызовы инструментов, ожидающие вызовы инструментов выполняются, и выполняется последний поворот с отключенными вызовами инструментов, поэтому ответ заканчивается ответом на естественном языке вместо незавершенного вызова инструмента.
1Единственное условие, при выполнении которого цикл агента серверного инструмента останавливается.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
Конфигурация вывода текста, включая формат и многословность
auto "auto"
Определение функционального инструмента
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
- Option 16
- Option 17
- Option 18
- Option 19
- Option 20
- Option 21
- Option 22
- Option 23
- Option 24
- Option 25
- Option 26
- Option 27
Метаданные для наблюдения и отслеживания. Известные ключи (trace_id, Trace_name, Span_Name, Generation_Name, Parent_span_id) имеют специальную обработку. Дополнительные ключи передаются в виде пользовательских метаданных в настроенные пункты назначения широковещательной передачи.
auto, disabled, null "auto"
Уникальный идентификатор, представляющий вашего конечного пользователя, который помогает различать разных пользователей вашего приложения. Это позволяет вашему приложению идентифицировать конкретных пользователей в случае сообщений о злоупотреблениях, предотвращая влияние действий отдельных пользователей на все ваше приложение. Максимум 256 символов.
256Response
Предустановка успешно создана или обновлена.
Ответ, содержащий созданный пресет и его назначенную версию.
Пресет с назначенной на данный момент версией.