Open Source: #web-scraping

Проекты каталога, отмеченные тегом #web-scraping. Теги работают как отдельные посадочные страницы, чтобы похожие инструменты было проще находить и связывать между собой.

В подборке 6 проектов с суммарным рейтингом 419,990 звёзд на GitHub. Основные языки: Python, TypeScript, Ruby.

Фильтры

Языки

Репозитории

Найдено: 6
firecrawl/firecrawl
Firecrawl

Firecrawl — API и открытый сервер для поиска, обхода сайтов и превращения веб-страниц в чистый Markdown или структурированные данные.

Звёзды 129,787 Форки 7,708 Автор firecrawl Язык TypeScript Лицензия AGPL-3.0
Открыть
unclecode/crawl4ai
Crawl4AI

Crawl4AI — Python-краулер и инструмент извлечения веб-данных, который готовит страницы для LLM, RAG и агентных сценариев.

Звёзды 68,969 Форки 7,036 Автор unclecode Язык Python Лицензия Apache-2.0
Открыть
huginn/huginn
Huginn

Huginn — система для личных автоматизаций: агенты читают веб, следят за событиями и запускают действия на вашем сервере.

Звёзды 49,450 Форки 4,276 Автор huginn Язык Ruby Лицензия MIT
Открыть