rig-candle 0.41.0

Local Candle Llama, SmolLM2, and Qwen3 completion models for Rig
Documentation
#![doc = include_str!("../README.md")]

mod artifacts;
mod generation;
mod loader;
mod model;
mod profile;
mod protocol;
mod runtime;
mod types;
mod validation;

pub use artifacts::{GgufModelData, ModelArtifacts, ModelData};
pub use generation::GenerationConfig;
pub use model::{CandleModel, CandleModelBuilder, LlamaModel, LlamaModelBuilder};
pub use profile::{ConversationProtocol, ModelArchitecture, ModelFamily, Quantization};
pub use types::{CandleCompletionResponse, CandleError, FinishReason};

pub(crate) use profile::{
    BEGIN_OF_TEXT, END_HEADER, END_OF_TURN, IM_END, IM_START, SMOLLM2_DEFAULT_SYSTEM_PROMPT,
    START_HEADER,
};