← Весь каталог

Тематическая подборка

inference

6 open-source проектов с AI-разборами, метриками и прямыми ссылками на GitHub.

011 янв. 1 г.

vllm-project/vllm

vLLM — высокопроизводительный и экономичный по памяти движок инференса и обслуживания больших языковых моделей с поддержкой 200+ архитектур.

90.2kPython
021 янв. 1 г.

antonellof/ferrox

Чистый Rust-движок для запуска плотных и MoE-моделей GGUF на CPU, Apple Metal и CUDA через CLI и OpenAI-совместимый сервер.

49Rust
031 янв. 1 г.

MaincodeHQ/from-tin-to-tokens

Бесплатный учебник о создании с нуля стека вывода больших языковых моделей на Rust — от интерфейса драйвера до HTTP-сервиса.

26
041 янв. 1 г.

swellweb/reame

CPU-first сервер инференса на llama.cpp с дисковым KV-кэшем, спекулятивным декодированием и OpenAI-совместимым API для недорогих ARM-серверов.

111C++
051 янв. 1 г.

pur4v/p2ptokens

Rust-платформа для peer-to-peer вывода LLM: узлы одновременно обслуживают и используют запросы, обменивая вычислительный ресурс через подписанный баланс.

29Rust
061 янв. 1 г.

MADEVAL/FerryAI

Библиотека для локального запуска ONNX, GGUF и RubixML-моделей внутри PHP через FFI с чатами, эмбеддингами, RAG и векторным поиском.

37PHP