---
title: "Extract Web Content"
method: POST
path: "/v1/extract"
tags: ["Extract"]
---

# Extract Web Content

`POST /v1/extract`

Extract content from any webpage as HTML, text, markdown, article, links, images, metadata, or structured data. Optimized for LLM consumption.

## Request body

- ExtractRequest
  - `url` string, uri, required
  - `type` 'html' | 'text' | 'markdown' | 'article' | 'links' | 'images' | 'metadata' | 'structured'
  - `selector` string — CSS selector to target
  - `waitFor` string — Wait for selector before extracting
  - `timeout` integer
  - `darkMode` boolean
  - `blockAds` boolean
  - `blockCookieBanners` boolean
  - `includeImages` boolean
  - `maxLength` integer
  - `cleanOutput` boolean

## Response `200`

Content extracted

- ExtractResponse
  - `success` boolean
  - `type` string
  - `url` string
  - `data` unknown
  - `responseTime` integer

## Other responses

- `400` — Validation error
- `401` — Invalid API key

---

[API](https://skmtc.net/snapapi/apis/snapapi-screenshot-web-data-api.md) · [All operations](https://skmtc.net/snapapi/apis/snapapi-screenshot-web-data-api/llms.txt) · [OpenAPI document](https://skmtc-service-staging.skmtc.workers.dev/v1/apis/snapapi/snapapi-screenshot-web-data-api/versions/b12ff2791613/schema)
