v1

latestOpenAPI 3.0.1MIT2026-07-26236440.2 KB

Create Chat Completion

Create a chat completion using OpenAI format. Reasoning models stream their thoughts in a separate reasoning field by default; see /v1legacy/chat/completions and /v1thinking/chat/completions for alternative shapes.

post/chat/completions

Request body

modelstring required

Model to use for completion

streamboolean

Enable streaming

max_tokensinteger

Maximum tokens to generate

temperaturenumber

Sampling temperature

top_pnumber

Nucleus sampling

top_kinteger

Top-k sampling

frequency_penaltynumber
presence_penaltynumber
web_searchboolean

Enable web search

reasoning_effort'none' | 'minimal' | 'low' | 'medium' | 'high' | 'xhigh'

Reasoning effort level. Silently ignored for models that do not support reasoning_effort, so clients can send a single shared request across providers.

reasoning_delta_field'reasoning' | 'reasoning_content'

Shorthand for reasoning.delta_field.

reasoning_content_compatboolean

Shorthand: set to true to force the legacy reasoning_content field, equivalent to reasoning.delta_field = "reasoning_content".

Example request

{
  "model": "gpt-4o"
}

Response

Success

idstring required
objectstring required
createdinteger required
modelstring required