llama.cpp запускает большие языковые модели локально: от командной строки до совместимого с OpenAI API сервера.
Open Source: #llm
Проекты каталога, отмеченные тегом #llm. Теги работают как отдельные посадочные страницы, чтобы похожие инструменты было проще находить и связывать между собой.
В подборке 55 проектов с суммарным рейтингом 4,548,466 звёзд на GitHub. Основные языки: Python, TypeScript, Go.
Про LLM-инструменты
Большие языковые модели перестали быть магией исследовательских лабораторий — теперь их запускают локально, дообучают на своих данных и встраивают в продукты. Open source экосистема вокруг LLM развивается быстрее любой другой: новые инструменты появляются буквально каждую неделю.
В этой подборке — движки инференса, фреймворки для RAG и агентов, обёртки над API моделей и интерфейсы для локального запуска. Если собираете что-то на основе языковых моделей, начните отсюда: это проверенные проекты с активной разработкой.
Репозитории
Awesome LLM Apps собирает готовые примеры приложений с языковыми моделями: агенты, RAG, голосовые сценарии и интеграции с MCP.
DeepSeek-V3 — открытая страница модели DeepSeek с MoE-архитектурой, 671B параметрами, 37B активируемыми параметрами и материалами для запуска и изучения.
Browser Use — Python-инструмент для браузерных AI-агентов: модель получает браузерное пространство действий, профиль, ограничения доменов и цикл выполнения задачи.
LLMs from scratch — учебный репозиторий Sebastian Raschka для пошаговой реализации GPT-подобной языковой модели на PyTorch.
DeepSeek-R1 — открытая серия моделей рассуждения DeepSeek с R1, R1-Zero и дистиллированными вариантами на базе Qwen и Llama.
NextChat — легкий клиент для общения с языковыми моделями на вебе, в настольных и мобильных приложениях, с поддержкой разных провайдеров.
autoresearch — эксперимент Andrej Karpathy с AI-агентами, которые автоматически проводят исследования вокруг обучения nanochat на одном GPU.
TradingAgents — Python-фреймворк для экспериментов с мультиагентным LLM-подходом к анализу рынка, рисков и портфеля.
MoneyPrinterTurbo — Python-приложение для генерации коротких видео с помощью языковых моделей, озвучки, субтитров и процесса сборки медиа.
vLLM — высокопроизводительный движок для инференса и обслуживания LLM с API, совместимым с OpenAI, пакетной обработкой запросов и эффективным управлением памятью.
RAGFlow — RAG-платформа с открытым кодом для поиска по документам, разбиения текста, цитирования источников и агентных сценариев вокруг LLM.