---
title: "Chat Completions"
method: POST
path: "/models/v2/openai/v1/chat/completions"
---

# Chat Completions

`POST /models/v2/openai/v1/chat/completions`

Sends a prompt to an OpenAI compatible chat completion model and returns a completion. Provides completions for open source models that are `text-generation`, `chat`, `audio-text-to-text`, `image-text-to-text`, `video-text-to-text`, and also supports closed source providers `openai`, `anthropic`, `mistral`, `cohere`, and `google`. To send a request to a closed source provider, prefix your model with their provider name, e.g. `openai/gpt-4`.

## Headers

- `Authorization` string, required

## Request body

- ChatCompletionsRequest
  - `model` string, required — The ID of the model to run (e.g., `Qwen/Qwen3-1.7B`, `openai/gpt-4`)
  - `messages` ChatMessage[], required — Conversation messages (OpenAI chat format)
    - `role` 'system' | 'user' | 'assistant', required — The role of the message sender
    - `content` string, required — The message text
  - `max_completion_tokens` integer — Maximum number of tokens to generate
  - `temperature` number — Sampling temperature
  - `stream` boolean — Whether to stream responses
  - `top_p` number — Nucleus sampling parameter
  - `presence_penalty` number — Penalize new tokens based on whether they appear in the text so far
  - `frequency_penalty` number — Penalize new tokens based on their existing frequency in the text so far
  - `logprobs` boolean — Whether to return log probabilities of output tokens (if supported)
  - `top_logprobs` integer — Number of most likely tokens to return at each position (if logprobs is true)

## Response `200`

Successful model completion

- ChatCompletionsResponse
  - `id` string — Unique ID for this completion
  - `object` string — Type of returned object (usually `chat.completion`)
  - `created` integer — Unix timestamp of completion
  - `choices` object[] — Generated completions
    - `index` integer
    - `message` object
      - `role` string
      - `content` string
    - `finish_reason` string

## Other responses

- `400` — Bad request
- `500` — Internal server error

---

[API](https://skmtc.net/bytez/apis/closed-source-model-api.md) · [All operations](https://skmtc.net/bytez/apis/closed-source-model-api/llms.txt) · [OpenAPI document](https://skmtc-service-staging.skmtc.workers.dev/v1/apis/bytez/closed-source-model-api/versions/d64c9c733afe/schema)
