---
title: "Time-to-first-token percentiles per model (streaming)"
method: GET
path: "/v1/analytics/model-router/latency/ttft-by-model"
tags: ["analytics"]
---

# Time-to-first-token percentiles per model (streaming)

`GET /v1/analytics/model-router/latency/ttft-by-model`

## Query parameters

- `agent_id` string, uuid, nullable
- `operation` string, nullable
- `limit` integer
- `start_date` string, date, required
- `end_date` string, date, required

## Response `200`

Successful Response

- TtftByModelRow[]
  - `served_model` string, required
  - `provider` string, nullable
  - `p50_ms` number, required
  - `p95_ms` number, required
  - `p99_ms` number, required
  - `avg_ms` number, required
  - `max_ms` number, required
  - `invocations` integer, required

## Other responses

- `400` — Bad request
- `401` — Authentication required
- `422` — Validation Error

---

[API](https://skmtc.net/oneloop-hq/apis/feather-api.md) · [All operations](https://skmtc.net/oneloop-hq/apis/feather-api/llms.txt) · [OpenAPI document](https://skmtc-service-staging.skmtc.workers.dev/v1/apis/oneloop-hq/feather-api/revisions/5a5597ebb2d6/schema)
