Trending repositories: quantization

5 tracked repositories tagged with quantization, ordered by stars. Use the topic filters below to narrow further.

Filter by topic

5 of 5 repositories

  • microsoft/BitNet

    Official inference framework for 1-bit LLMs

    AI summary: An official inference framework optimized for running 1-bit Large Language Models efficiently on CPUs.

    39,816ai-mlC++MIT
  • RyanCodrai/turbovec

    A vector index built on TurboQuant, written in Rust with Python bindings

    AI summary: Rust vector index with Python bindings based on TurboQuant for extreme RAM compression.

    14,655dataRustMIT
  • TheTom/turboquant_plus

    AI summary: Advanced KV cache compression techniques merged into major LLM inference engines.

    7,002ai-mlPythonApache-2.0
  • openai/parameter-golf

    Train the smallest LM you can that fits in 16MB. Best model wins!

    AI summary: A rigorous challenge optimizing language models for minimal parameter counts and rapid training times.

    5,174ai-mlPythonMIT
  • PrismML-Eng/Bonsai-demo

    Bonsai Demo

    AI summary: Interactive demonstration of the Bonsai machine learning optimization platform.

    2,170ai-mlShellApache-2.0