网页爬取

「网页爬取」标签聚合的各栏目已发布内容,按本站发布日期从新到旧排列。

3 条

  1. API产品

    CapSolver

    基于计算机视觉与机器学习的自动验证码识别与网络数据采集加速服务。

    #验证码#网页爬取#OCR#API#扩展

  2. 开发工具GitHub

    Open Lovable:把网页克隆成 React 应用

    Firecrawl 团队开源的示例应用:输入网站链接,自动抓取页面并交由大模型生成可运行的 React 应用,支持对话式迭代、四种模型任选与云端沙箱预览,适合复刻前端或快速搭出原型。

    #网页克隆#网页爬取#代码生成#原型开发#开源

  3. 爬虫GitHub

    AnyCrawl:把网页变成 LLM 数据的抓取工具包

    用 TypeScript 编写、可自托管的网页抓取工具包,以三种引擎覆盖静态页到 JS 渲染页,支持搜索结果批量采集、全站遍历与 LLM 结构化抽取,输出对大模型友好的数据。

    #网页爬取#AI 爬虫#结构化抽取#RAG#SERP API#自托管#开源