Создать сообщение
Создает сообщение, используя формат API Anthropic Messages. Поддерживает текст, изображения, PDF-файлы, инструменты и расширенное мышление.
Authorizations
API-ключ в качестве токена носителя в заголовке авторизации
Headers
Дайте согласие на отображение метаданных маршрутизации в ответе в разделе llmstore_metadata. По умолчанию отключено. Устаревший заголовок X-LLMSTORE-Experimental-Metadata также принимается для обратной совместимости.
Уровень согласия для отображения метаданных маршрутизации в ответе в разделе llmstore_metadata.
disabled, enabled "enabled"
Body
Схема запроса для эндпоинта API Anthropic Messages
Включите автоматическое кэширование подсказок. Если установлено на верхнем уровне, система автоматически применяет точки останова кэша к последнему кэшируемому блоку в запросе. Если он установлен для отдельного блока контента, он отмечает явную точку останова в кэше; Токены уровня блоков также работают с моделями OpenAI, которые поддерживают явное кэширование подсказок — LLMSTORE преобразует их в собственный формат провайдера.
Резервные модели, которые можно попробовать в случае сбоя или отказа основной модели, по порядку. Управляется многомодельной маршрутизацией LLMSTORE, а не резервными средствами Anthropic на стороне сервера; не могут быть объединены с моделями. Каждая запись принимает только «модель». Максимум 3 записи.
Конфигурация для управления поведением вывода. Поддерживает параметр усилий и формат структурированного вывода.
Плагины, которые вы хотите включить для этого запроса, включая их настройки.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
Если доступно несколько поставщиков моделей, при необходимости укажите предпочтения маршрутизации.
УСТАРЕЛО Вместо этого используйте parts.sort.partition. Обратно совместимый псевдоним дляпровайдеров.sort.partition. Принимает устаревшие значения: «резервный» (сопоставляется с «моделью»), «сортировка» (сопоставляется с «нет»).
fallback, sort, null "fallback"
Уникальный идентификатор для группировки связанных запросов (например, разговора или рабочего процесса агента). Если он предоставлен, LLMSTORE использует его в качестве липкого ключа маршрутизации, направляя все запросы в сеансе к одному и тому же поставщику, чтобы максимизировать попадание в кэш запросов. Также используется для группировки наблюдаемости. Если оно указано как в теле запроса, так и в заголовке x-session-id, значение body имеет приоритет. Максимум 256 символов.
256Управляет скоростью генерации выходных данных. Если установлено значение «быстро», используется более высокоскоростная конфигурация вывода по более высокой цене. По умолчанию используется значение «стандарт», если оно опущено.
fast, standard, null "fast"
Условия остановки цикла агента серверного инструмента. Любое срабатывание условия останавливает цикл (логика ИЛИ). Если установлено, это переопределяет max_tool_calls. Когда условие срабатывает, пока модель все еще генерирует вызовы инструментов, ожидающие вызовы инструментов выполняются, и выполняется последний поворот с отключенными вызовами инструментов, поэтому ответ заканчивается ответом на естественном языке вместо незавершенного вызова инструмента.
1Единственное условие, при выполнении которого цикл агента серверного инструмента останавливается.
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 1
- Option 2
- Option 3
- Option 1
- Option 2
- Option 3
- Option 4
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
- Option 16
Метаданные для наблюдения и отслеживания. Известные ключи (trace_id, Trace_name, Span_Name, Generation_Name, Parent_span_id) имеют специальную обработку. Дополнительные ключи передаются в виде пользовательских метаданных в настроенные пункты назначения широковещательной передачи.
Уникальный идентификатор, представляющий вашего конечного пользователя, который помогает различать разных пользователей вашего приложения. Это позволяет вашему приложению идентифицировать конкретных пользователей в случае сообщений о злоупотреблениях, предотвращая влияние действий отдельных пользователей на все ваше приложение. Максимум 256 символов.
256Response
Успешный ответ
Непотоковый ответ от API Anthropic Messages с расширениями LLMSTORE
- Option 1
- Option 2
- Option 3
- Option 4
- Option 5
- Option 6
- Option 7
- Option 8
- Option 9
- Option 10
- Option 11
- Option 12
- Option 13
- Option 14
- Option 15
- Option 16
assistant Структурированная информация об отказе
end_turn, max_tokens, model_context_window_exceeded, stop_sequence, tool_use, pause_turn, refusal, compaction, null "end_turn"
message Modal, AkashML, AI21, AionLabs, Alibaba, Ambient, Baidu, Amazon Bedrock, Amazon Nova, Anthropic, Arcee AI, AtlasCloud, Avian, Azure, BaseTen, BytePlus, Black Forest Labs, Cerebras, Chutes, Cirrascale, Claude Platform on AWS, Clarifai, Cloudflare, Cohere, CoreWeave, Crucible, Crusoe, Darkbloom, Decart, Deepgram, DeepInfra, DeepSeek, DekaLLM, DigitalOcean, Featherless, Fireworks, Fish Audio, Friendli, GMICloud, Google, Google AI Studio, Groq, HeyGen, Inception, Inceptron, InferenceNet, Ionstream, Infermatic, Io Net, Inferact vLLM, Inflection, Liquid, Mara, Mancer 2, Meta, Minimax, ModelRun, Mistral, Modular, Moonshot AI, Morph, VoyageAI by MongoDB, NCompass, Nebius, Nex AGI, NextBit, Novita, Nvidia, OpenAI, OpenInference, Parasail, Poolside, Perceptron, Perplexity, Phala, Recraft, Reka, Relace, Sail Research, Sakana AI, SambaNova, Seed, SiliconFlow, Sourceful, StepFun, Stealth, StreamLake, Switchpoint, Tencent, Tenstorrent, Thinking Machines, Together, Upstage, Venice, Wafer, WandB, Quiver, Krea, Runway, Xiaomi, xAI, Z.AI, FakeProvider "OpenAI"