跳到正文
//数据源 · 本地与地图

网页解析器 API, URL 进,带类型 JSON 出

站点一改版,自己写的提取脚本就废了:选择器一个个失效,维护没有尽头。网页解析器换了个路子,用 AI 提取读任意公开页面,另外还有 16+ 个专用解析器和站点地图发现,整站采集也能做。

免费开始7 天免费试用

Web Parser 能拉到什么

POST /api/webparser/parse任意公开 URL:标题、正文、作者、发布日期、meta description、链接、图片、字数。AI 引擎会剥掉导航和广告,无需配置
POST /api/webparser/sitemap整站的全部 URL:传域名,拿站点地图,再批量解析这份列表
/api/ai-parser/amazonAmazon:商品名、价格、评分、评价、卖点、ASIN
/api/ai-parser/glassdoorGlassdoor:公司评价、评分、薪酬、面试经历
/api/ai-parser/g2G2:软件评价、评分、优缺点、替代品
/api/ai-parser/trustpilotTrustpilot:商家评价、评分、回复率
/api/ai-parser/capterraCapterra:软件评价、价格、功能
/api/ai-parser/producthuntProduct Hunt:产品发布、点赞数、创作者信息
/api/ai-parser/crunchbaseCrunchbase:公司数据、融资轮次、投资方
/api/ai-parser/angellistAngelList:初创岗位、公司资料
/api/ai-parser/githubGitHub:仓库、README、issue、pull request、star
/api/ai-parser/hackernewsHacker News:帖子、评论、得分
/api/ai-parser/pinterestPinterest:pin、画板、账号资料
/api/ai-parser/builtwithBuiltWith:技术栈、技术使用情况
/api/ai-parser/applyboardApplyBoard:教育项目
/api/ai-parser/wikileaksWikiLeaks:文档数据
/api/ai-parser/trustmrrTrustMRR:MRR 数据

开始解析任意网站

任意 URL 转干净 JSON,16+ 个专用解析器,还能发现站点地图。不用维护选择器。

常见问题

可以。解析器会先跑完 JavaScript 渲染再提取,所以单页应用和客户端渲染的站点,回来是真正的正文,不是空壳。