OpenCV — библиотека компьютерного зрения для обработки изображений, видео и задач машинного восприятия.
Open Source: #computer-vision
Проекты каталога, отмеченные тегом #computer-vision. Теги работают как отдельные посадочные страницы, чтобы похожие инструменты было проще находить и связывать между собой.
В подборке 13 проектов с суммарным рейтингом 699,591 звёзд на GitHub. Основные языки: Python, C++, Jupyter Notebook.
Репозитории
PaddleOCR — OCR-инструментарий для распознавания текста и структуры документов, включая PDF, изображения, многоязычный OCR и разбор документов для LLM-сценариев.
Tesseract OCR — движок распознавания текста на изображениях и сканах, поддерживающий множество языков и сценариев OCR.
Ultralytics — Python-пакет и командная утилита для моделей YOLO и задач компьютерного зрения.
YOLOv5 — популярный PyTorch-проект Ultralytics для детекции объектов и экспорта моделей.
face_recognition — Python-библиотека и консольная утилита для распознавания лиц, построенная поверх dlib.
Segment Anything — репозиторий Meta AI с моделью SAM, кодом инференса, примерами и ссылками на веса.
Supervision — Python-библиотека Roboflow с переиспользуемыми инструментами для computer vision.
PyTorch Image Models — большая коллекция моделей компьютерного зрения для PyTorch.
Real-ESRGAN — проект для восстановления и увеличения изображений и видео в реальных условиях.
MediaPipe — набор решений Google для ML-обработки живого и потокового медиа.