[package]
edition = "2021"
name = "ferrox-inference"
version = "0.11.1"
build = false
autolib = false
autobins = false
autoexamples = false
autotests = false
autobenches = false
description = "Pure-Rust GGUF / MoE inference engine: mmap loaders, quantized CPU + Metal + CUDA kernels"
homepage = "https://github.com/antonellof/ferrox"
readme = "README.md"
keywords = [
"llm",
"inference",
"gguf",
"quantization",
"moe",
]
categories = [
"science",
"algorithms",
]
license = "Apache-2.0"
repository = "https://github.com/antonellof/ferrox"
[features]
api = ["dep:ferrox-api"]
cuda = [
"ferrox-core/cuda",
"ferrox-models/cuda",
]
default = []
metal = [
"ferrox-core/metal",
"ferrox-models/metal",
]
[lib]
name = "ferrox_inference"
path = "src/lib.rs"
[[example]]
name = "readme_snippet"
path = "examples/readme_snippet.rs"
[dependencies.ferrox-api]
version = "0.11.1"
optional = true
[dependencies.ferrox-core]
version = "0.11.1"
[dependencies.ferrox-gguf]
version = "0.11.1"
[dependencies.ferrox-models]
version = "0.11.1"
[dependencies.ferrox-moe]
version = "0.11.1"
[dependencies.ferrox-quant]
version = "0.11.1"
[dependencies.ferrox-safetensors]
version = "0.11.1"