Projects with this topic
Sort by:
-
useful Gentoo overlay Curated ebuilds, AI, tools & science
Updated -
A modular experimentation framework for evaluating LLM orchestration strategies over real 5G network capabilities.
Updated -
Experiments with Subliminal Learning
Updated -
Extreme KV Cache Compression for LLM Inference — C++17/CUDA implementation of TurboQuant (arXiv 2504.19874). 7.5x compression, <2% quality loss.
Updated