v1

latestOpenAPI 3.1.0Apache 2.02026-07-264001921002.3 KB
Chat Completions

Create a chat completion

Creates a completion for the provided messages. Supports streaming via SSE.

post/v1/chat/completions

Request body

modelstring required

Model in provider/model format (e.g., openai/gpt-4)

fallbacksstring[]

Fallback models in provider/model format

streamboolean

Whether to stream the response

frequency_penaltynumber
logit_biasobject
logprobsboolean
max_completion_tokensinteger
metadataobject
modalitiesstring[]
parallel_tool_callsboolean
presence_penaltynumber
prompt_cache_keystring
response_formatobject

Format for the response

safety_identifierstring
service_tierstring
storeboolean
temperaturenumber
seedinteger

Deterministic sampling seed

top_pnumber

Nucleus sampling parameter

top_logprobsinteger

Number of most likely tokens to return at each position

prompt_cache_retention'in_memory' | '24h'

Prompt cache retention policy

truncationstring
userstring
verbosity'low' | 'medium' | 'high'

Example request

{
  "model": "openai/gpt-4"
}

Response

Successful response

idstring
createdinteger
modelstring
objectstring
service_tierstring
system_fingerprintstring
citationsstring[]