Back to Topics Directory
Topic Hub

#web-crawler (15 Repositories)

Ranked open-source repositories tagged with #web-crawler, scored by pull request acceptance likelihood and maintainer engagement velocity.

Topic Avg Merge Rate

26.0%

Avg Review Latency

19.0h

Filter by language

15 repositories tagged #web-crawler

B TierGo 421

internetarchive/Zeno

State-of-the-art web crawler 🔱

100.0%
Merge Rate
23h
First Review
100%
1st-Timers
1
Maintainers
A TierPython 30.1k

ScrapeGraphAI/Scrapegraph-ai

Python scraper based on AI

68.8%
Merge Rate
19h
First Review
100%
1st-Timers
3
Maintainers
A TierRust 1.1k

lexmount/moli

Best headless browser for AI agents. Lite, Fast, High-Compatibility. Built in Rust

67.3%
Merge Rate
1d
First Review
100%
1st-Timers
4
Maintainers
B TierJava 1.9k

MarginaliaSearch/MarginaliaSearch

Internet search engine for text-oriented websites. Indexing the small, old and weird web.

83.8%
Merge Rate
5d
First Review
100%
1st-Timers
1
Maintainers
B TierTypeScript 174.2k

firecrawl/firecrawl

The context API to search, scrape, and interact with the web at scale. 🔥

44.3%
Merge Rate
3d
First Review
26%
1st-Timers
41
Maintainers
B TierGo 2.1k

Anakin-Inc/anakin

Open-source web scraping API. Turn any website into clean markdown or structured JSON. Anti-detect browser, proxy auto-selection, self-hosted. One command: make up

26.2%
Merge Rate
1d
First Review
25%
1st-Timers
4
Maintainers
D TierTypeScript 1.1k

webrecorder/browsertrix-crawler

Run a high-fidelity browser-based web archiving crawler in a single Docker container

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierGo 311

infinilabs/crawler

🕷️ An easy-to-use spider written in Golang. (previous named GOPA.)

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierGo 341

s0rg/crawley

The unix-way web crawler

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJava 486

VIDA-NYU/ache

ACHE is a web crawler for domain-specific search.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJavaScript 378

lewisdonovan/google-news-scraper

Lightweight scraper for Google News

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPHP 371

crwlrsoft/crawler

Library for Rapid (Web) Crawler and Scraper Development

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJava 204

Norconex/crawler

Norconex Crawlers (or spiders) are flexible web and filesystem crawlers for collecting, parsing, and manipulating data from the web or filesystem to various data repositories such as search engines.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJavaScript 1.6k

gildas-lormeau/single-file-cli

CLI tool for saving a faithful copy of a complete web page in a single HTML file (based on SingleFile)

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierVUVue 231

crawlab-team/crawlab-lite

Lite version of Crawlab. 轻量版 Crawlab 爬虫管理平台

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
Best Web-crawler Open Source Repositories & C-Rank™ | GetMerged