[package]
edition = "2021"
name = "haagenti-sparse"
version = "0.1.0"
authors = ["Daemoniorum LLC"]
build = false
autolib = false
autobins = false
autoexamples = false
autotests = false
autobenches = false
description = "Sparse attention masks for prompt-aware computation reduction"
readme = false
keywords = [
"sparse",
"attention",
"diffusion",
"optimization",
]
categories = [
"science",
"algorithms",
]
license = "MIT OR Apache-2.0"
repository = "https://github.com/daemoniorum/haagenti"
[features]
cuda = ["haagenti-cuda"]
default = []
[lib]
name = "haagenti_sparse"
path = "src/lib.rs"
[[bench]]
name = "sparse_attention"
path = "benches/sparse_attention.rs"
harness = false
[[bench]]
name = "sparse_compression"
path = "benches/sparse_compression.rs"
[dependencies.arrayvec]
version = "0.7"
[dependencies.async-trait]
version = "0.1"
[dependencies.bincode]
version = "1.3"
[dependencies.bytes]
version = "1.8"
[dependencies.haagenti-core]
version = "0.1.0"
[dependencies.haagenti-cuda]
version = "0.1.0"
optional = true
[dependencies.rand]
version = "0.8"
[dependencies.serde]
version = "1.0"
features = ["derive"]
[dependencies.smallvec]
version = "1.13"
[dependencies.thiserror]
version = "2.0"
[dependencies.tokio]
version = "1.41"
features = [
"io-util",
"sync",
"net",
"fs",
"rt-multi-thread",
"time",
"macros",
]
[dependencies.tracing]
version = "0.1"
[dev-dependencies.criterion]
version = "0.5"
[dev-dependencies.tokio-test]
version = "0.4"