---
title: "Create embeddings (OpenAI format)"
method: POST
path: "/openai/v1/embeddings"
tags: ["OpenAI Integration"]
---

# Create embeddings (OpenAI format)

`POST /openai/v1/embeddings`

Creates embedding vectors for the input text.

**Note:** This endpoint also works without the `/v1` prefix (e.g., `/openai/embeddings`).

## Request body

- OpenAIEmbeddingRequest
  - `model` string, required — Model identifier
  - `input` union, required — Input text to embed
    - string
    - string[]
  - `encoding_format` 'float' | 'base64'
  - `dimensions` integer — Number of dimensions for the embedding
  - `user` string
  - `fallbacks` string[]

## Response `200`

Successful response

- EmbeddingResponse
  - `data` object[]
    - `index` integer
    - `object` string
    - `embedding` union
      - string
      - number[]
      - array[]
        - number[]
  - `model` string
  - `object` string
  - `usage` BifrostLLMUsage — Token usage information
    - `prompt_tokens` integer — Total input tokens including any prompt-cache tokens (read + write). Subtract prompt_tokens_details.cached_read_tokens and prompt_tokens_details.cached_write_tokens to get the non-cached portion.
    - `prompt_tokens_details` ChatPromptTokensDetails
      - `text_tokens` integer
      - `audio_tokens` integer
      - `image_tokens` integer
      - `cached_read_tokens` integer — Tokens served from the prompt cache (cache hit). These tokens are already included in prompt_tokens and are billed at the reduced cache-read rate. Populated for all providers that support prompt caching (Anthropic, Bedrock, OpenAI, Gemini, xAI, etc.).
      - `cached_write_tokens` integer — Tokens written to the prompt cache on this request (cache creation / write). These tokens are already included in prompt_tokens and are billed at the cache-creation rate. Populated for providers that separately report cache write tokens (Anthropic, Bedrock).
    - `completion_tokens` integer — Number of output/completion tokens generated.
    - `completion_tokens_details` ChatCompletionTokensDetails
      - `text_tokens` integer
      - `accepted_prediction_tokens` integer
      - `audio_tokens` integer
      - `citation_tokens` integer
      - `num_search_queries` integer
      - `reasoning_tokens` integer
      - `image_tokens` integer
      - `rejected_prediction_tokens` integer
    - `total_tokens` integer
    - `cost` BifrostCost — Cost breakdown for the request
      - `input_tokens_cost` number
      - `output_tokens_cost` number
      - `reasoning_tokens_cost` number — Cost for reasoning/thinking tokens (reasoning models)
      - `citation_tokens_cost` number — Cost for citation tokens
      - `search_queries_cost` number — Cost for web search queries
      - `request_cost` number
      - `total_cost` number
  - `extra_fields` BifrostResponseExtraFields — Additional fields included in responses
    - `request_type` string — Type of request that was made
    - `provider` 'openai' | 'azure' | 'anthropic' | 'bedrock' | 'cohere' | 'vertex' | 'vllm' | 'mistral' | 'ollama' | 'groq' | 'sgl' | 'parasail' | 'perplexity' | 'replicate' | 'cerebras' | 'deepseek' | 'gemini' | 'openrouter' | 'elevenlabs' | 'huggingface' | 'nebius' | 'xai' | 'runway' | 'fireworks' — AI model provider identifier
    - `model_requested` string — The model that was requested
    - `model_deployment` string — The actual model deployment used
    - `latency` integer — Request latency in milliseconds
    - `chunk_index` integer — Index of the chunk for streaming responses
    - `raw_request` object — Raw request if enabled
    - `raw_response` object — Raw response if enabled
    - `cache_debug` BifrostCacheDebug
      - `cache_hit` boolean
      - `cache_id` string
      - `hit_type` string
      - `requested_provider` string
      - `requested_model` string
      - `provider_used` string
      - `model_used` string
      - `input_tokens` integer
      - `threshold` number
      - `similarity` number

## Other responses

- `400` — Bad request
- `500` — Internal server error

---

[API](https://skmtc.net/getbifrost/apis/bifrost-api.md) · [All operations](https://skmtc.net/getbifrost/apis/bifrost-api/llms.txt) · [OpenAPI document](https://skmtc-service-staging.skmtc.workers.dev/v1/apis/getbifrost/bifrost-api/versions/f8cab88f64ea/schema)
