---
title: "网页读取接口"
method: POST
path: "/web_fetch"
tags: ["WebFetch"]
---

# 网页读取接口

`POST /web_fetch`

网页读取接口，返回更适合大模型处理的结果（网页标题、内容、摘要等）。

## Request body

- object
  - `model` string — 网页读取模型
  - `url` string, required — 网页URL
  - `engine` 'direct' | 'browser' — 读取引擎，不同平台支持的读取引擎可能不一样，direct 表示速度优先，browser 表示质量优先
  - `response_format` 'markdown' | 'html' | 'text' | 'screenshot' — 返回内容格式
  - `timeout` integer — 等待网页加载超时时间，单位为秒
  - `budget_tokens` integer — 预算token数
  - `target_selectors` string[] — 仅提取指定 CSS 选择器中的内容
  - `wait_for_selectors` string[] — 等待指定 CSS 选择器加载后再进行内容提取（适合异步加载内容的网页）
  - `remove_selectors` string[] — 提取内容时排除指定 CSS 选择器对应的内容
  - `openai_compatible` boolean — 是否返回OpenAI兼容格式的内容，默认为false
  - `remove_images` boolean — 是否移除网页内容中的图片，默认为false
  - `with_links` boolean — 是否单独返回去重后的所有链接列表，默认为false
  - `with_images` boolean — 是否单独返回去重后的图片URL列表，默认为false
  - `with_images_alt` boolean — 是否返回内容中图片的alt文本，默认为false
  - `with_iframes` boolean — 是否返回网页嵌入的iframe内容，默认为false

## Response `200`

成功响应

- object
  - `id` string, required — 请求ID
  - `created` integer, required — 请求创建时间戳
  - `result` object, required — 网页读取结果
    - `url` string — 网页链接
    - `title` string — 网页标题
    - `content` string — 网页内容，当response_format为screenshot时返回空字符串
    - `screenshot` string — 网页截图，仅当response_format为screenshot时返回
    - `links` object — 网页中提取的链接字典，仅在with_links=true时返回
    - `images` object — 网页中提取的图片URL字典，仅在with_images=true时返回
    - `metadata` object — 额外的元数据信息
  - `usage` object, required
    - `completion_tokens` integer — 输出内容消耗token数
    - `total_tokens` integer, required — 总消耗token数

## Other responses

- `400` — 参数验证错误
- `401` — 未授权
- `500` — 标准错误响应

---

[API](https://skmtc.dev/geekai/apis/api.md) · [All operations](https://skmtc.dev/geekai/apis/api/llms.txt) · [OpenAPI document](https://skmtc-service-production.skmtc.workers.dev/v1/apis/geekai/api/revisions/2bf0c8f70a39/schema)
