网页信息 API

抓取网页的标题、描述、分享图、图标与站点名称

数据来源:目标网页

返回统一的 JSON 格式 { code, message, cached, stale, updatedAt, data },支持跨域,免注册每天可免费调用 100 次,注册后每天 10000 次。

获取网页标题、描述、og:image、favicon 等信息

GET /api/webmeta

请求参数

  • url(必填):网页地址(http / https),示例 https://www.baidu.com

返回字段

  • url(string):实际抓取的网页地址:跟随重定向(最多 3 次)后的最终地址,已去掉 # 及之后的部分
  • title(string|null):网页标题:依次取 og:title、<title>、twitter:title 中第一个非空的,已解码 HTML 实体并把连续空白合并为一个空格;都没有时为 null
  • description(string|null):网页描述:依次取 meta description、og:description、twitter:description 中第一个非空的;都没有时为 null
  • image(string|null):分享图的绝对地址:依次取 og:image、og:image:url、twitter:image、twitter:image:src 中第一个非空的值,相对地址按 <base href> 或网页地址补全;没有这些标签、取到的值为空或不是 http/https 地址时为 null
  • favicon(string):网站图标的绝对地址:优先取 <link rel="icon"> 或 rel="shortcut icon",其次 apple-touch-icon;页面没有声明时为网站根目录的 /favicon.ico(不检查该文件是否存在)
  • siteName(string):站点名称:依次取 og:site_name、application-name;都没有时为网页的域名(如 github.com)
  • type(string|null):Open Graph 类型(og:type 的原值,如 website、article);没有声明时为 null
  • keywords(string|null):meta keywords 的原文(未拆分,分隔符由网页决定,通常是英文或中文逗号);没有声明时为 null
  • canonical(string|null):规范地址(绝对地址):取 <link rel="canonical">,没有时取 og:url;都没有或不是 http/https 地址时为 null