Back to Topics Directory
Topic Hub

#scraper (30 Repositories)

Ranked open-source repositories tagged with #scraper, scored by pull request acceptance likelihood and maintainer engagement velocity.

Topic Avg Merge Rate

31.2%

Avg Review Latency

45.3h

Filter by language

30 repositories tagged #scraper

A TierJava 2.0k 1 GFIs

TeamNewPipe/NewPipeExtractor

NewPipe's core library for extracting data from streaming sites

85.7%
Merge Rate
9h
First Review
100%
1st-Timers
4
Maintainers
B TierTypeScript 834

maoserr/epublifier

Converts some webnovels to epub format

95.8%
Merge Rate
-
First Review
100%
1st-Timers
1
Maintainers
A TierGo 542

Solr159/JavBoss

开箱即用的本地 JAV/视频 刮削、管理、播放软件,支持命令行一键安装和 docker 部署。只需简单添加目录,即可打造你的私人 JAV/视频 媒体库,带给你顶级的浏览体验,懒人必备。| Your local JAV/video manager.

88.4%
Merge Rate
1d
First Review
50%
1st-Timers
13
Maintainers
B TierPython 115

henrique-coder/perplexity-webui-scraper

An advanced, high-performance Python client, MCP server, and REST API for reverse-engineering Perplexity AI's WebUI.

71.4%
Merge Rate
12h
First Review
50%
1st-Timers
1
Maintainers
A TierPython 233

slive777/OpenAver

Free open-source desktop app that scrapes JAV metadata and generates NFO + cover art for Jellyfin, Emby & Kodi. No Docker, no CLI — one-click install on Windows & macOS. 8 built-in sources + optional Metatube federation (30+ providers), actress collections, cross-language tag aliases, and a REST API for AI agents.

81.3%
Merge Rate
5d
First Review
50%
1st-Timers
2
Maintainers
A TierPython 168

openzim/gutenberg

Scraper for downloading the entire ebooks repository of project Gutenberg

71.4%
Merge Rate
8h
First Review
100%
1st-Timers
5
Maintainers
B TierGo 132

PxyUp/fitter

New way for collect information from the API's/Websites

75.0%
Merge Rate
1d
First Review
100%
1st-Timers
0
Maintainers
B TierC# 183

kameleo-io/kameleo

Anti-detect browser for web scraping and automation. Engine-level fingerprint masking for Chromium and Firefox. Self-hosted, Docker-ready. Integrates with Selenium, Playwright, and Puppeteer via SDKs in Python, JavaScript, and C#.

87.2%
Merge Rate
19d
First Review
33%
1st-Timers
0
Maintainers
B TierKotlin 348

sokomishalov/skraper

Kotlin/Java library and cli tool for scraping posts and media from various sources with neither authorization nor full page rendering (Facebook, Instagram, Twitter, Youtube, Tiktok, Telegram, Twitch, Reddit, 9GAG, Pinterest, Flickr, Tumblr, Coub, Vimeo, IFunny, VK, Odnoklassniki, Pikabu)

100.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
B TierTypeScript 174.2k

firecrawl/firecrawl

The context API to search, scrape, and interact with the web at scale. 🔥

44.3%
Merge Rate
3d
First Review
26%
1st-Timers
41
Maintainers
B TierScala 733

ruippeixotog/scala-scraper

A Scala library for scraping content from HTML pages

70.2%
Merge Rate
2d
First Review
0%
1st-Timers
0
Maintainers
B TierGo 2.1k

Anakin-Inc/anakin

Open-source web scraping API. Turn any website into clean markdown or structured JSON. Anti-detect browser, proxy auto-selection, self-hosted. One command: make up

26.2%
Merge Rate
1d
First Review
25%
1st-Timers
4
Maintainers
C TierLua 838

HDoujinDownloader/HDoujinDownloader

A general-purpose doujinshi and image gallery downloader

40.0%
Merge Rate
5d
First Review
100%
1st-Timers
1
Maintainers
D TierElixir 956

fredwu/crawler

A high performance web crawler / scraper in Elixir.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierGo 31.7k

iawia002/lux

👾 Fast and simple video download library and CLI tool written in Go

0.0%
Merge Rate
12d
First Review
0%
1st-Timers
2
Maintainers
D TierJavaScript 109

rajhodedara/live-sport-plugin

A robust live sports scraping and streaming plugin designed for media centers. Aggregates real-time feeds and delivers seamless IPTV playback.

0.0%
Merge Rate
5d
First Review
0%
1st-Timers
0
Maintainers
D TierGo 142

henson/Scraper

Tracking the most popular Github repos, updated daily.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 448

danieldotnl/ha-multiscrape

Home Assistant custom component for scraping (html, xml or json) multiple values (from a single HTTP request) with a separate sensor/attribute for each value. Support for (login) form-submit functionality.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJavaScript 588

sunny9577/proxy-scraper

⭐️ A proxy scraper made using Protractor | Proxy list Updates every three hour 🔥

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPHP 10.0k

guyueyingmu/avbook

AV 电影管理系统, avmoo , javbus , javlibrary 爬虫,线上 AV 影片图书馆,AV 磁力链接数据库,Japanese Adult Video Library,Adult Video Magnet Links - Japanese Adult Video Database

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierGo 7.1k

go-rod/rod

A Chrome DevTools Protocol driver for web automation and scraping.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierTypeScript 497

gigobyte/HLTV

The unofficial HLTV Node.js API

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierR 362

salimk/Rcrawler

An R web crawler and scraper

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 15.1k

codelucas/newspaper

newspaper3k is a news, full-text, and article metadata extraction in Python 3. Advanced docs:

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierR 334

dmi3kno/polite

Be nice on the web

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierJavaScript 344

SlavyanDesu/BocchiBot

BocchiBot is a multipurpose WhatsApp bot using wa-automate-nodejs library!

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierTypeScript 1.3k

yjl9903/AnimeGarden

動漫花園 镜像站 | 动画 BT 资源聚合站 | 动画 BT 资源开放接口

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPython 4.6k

d60/twikit

Twitter API Scraper | Without an API key | Twitter Internal API | Free | Twitter scraper | Twitter Bot

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierTypeScript 30.5k

cheeriojs/cheerio

The fast, flexible, and elegant library for parsing and manipulating HTML and XML.

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
D TierPHP 371

crwlrsoft/crawler

Library for Rapid (Web) Crawler and Scraper Development

0.0%
Merge Rate
-
First Review
0%
1st-Timers
0
Maintainers
Best Scraper Open Source Repositories & C-Rank™ | GetMerged