wgml 0.2.0

Cross-platform GPU LLM inference.
Documentation
1
2
3
4
5
6
7
8
//! Llama2 inference on the GPU or CPU.
//!
pub use tokenizer::*;
pub use transformer::*;

pub mod cpu;
mod tokenizer;
mod transformer;