v1

latestOpenAPI 3.1.02026-07-266827131.9 KB

Chat Completions qwen

Generate chat completions using Qwen ILM or VLM models with image and video inputs.

post/vu/chat/completions

Request body

modelstring required

The model to use (e.g., qwen:qwen3-vl-plus)

temperaturenumber

Controls randomness: 0.0-2.0, higher = more random

max_tokensinteger

Maximum number of tokens to generate

top_pnumber

Nucleus sampling: 0.0-1.0

frequency_penaltynumber

Reduces repetition of frequent tokens: -2.0 to 2.0

presence_penaltynumber

Increases likelihood of new topics: -2.0 to 2.0

ninteger

Number of completions to generate

streamboolean

Whether to stream the response

Example request

{
  "model": "qwen:qwen3-vl-plus"
}

Response

Chat completion response with structured output

idstring required

Unique identifier for the completion

objectstring required

Object type, always 'completion'

modelstring required

The model used for the completion

created_atinteger required

Unix timestamp of when the completion was created

statusstring required

Status of the completion

Example response

{
  "id": "9212f247-2372-95b3-8c9b-968368a952fc",
  "object": "completion",
  "model": "qwen3-vl-plus",
  "created_at": 1767095035,
  "status": "completed",
  "choices": [
    {
      "text": "This video shows an interesting scientific experiment conducted in a vacuum environment, titled \"Vacuum vs Orange\"."
    }
  ],
  "usage": {
    "input_tokens": 34578,
    "output_tokens": 561,
    "total_tokens": 35139
  },
  "meta": {
    "provider": "qwen",
    "provider_model": "qwen3-vl-plus"
  }
}