High Performance LLM Inference Operator Library
LLM inference in C/C++
Port of OpenAI's Whisper model in C/C++
Official inference framework for 1-bit LLMs
A library that provides an embeddable, persistent key-value store for fast storage.