systemprompt-evaluation 0.29.0

Evaluation framework for systemprompt.io AI governance infrastructure. Samples production AI traffic, scores it against rubrics with an LLM judge, and replays failures with repair hints.
Documentation
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
//! Data model for evaluation runs, cases, results, rubrics, and sampling.
//!
//! Copyright (c) systemprompt.io — Business Source License 1.1.
//! See <https://systemprompt.io> for licensing details.

mod case;
mod result;
mod rubric;
mod run;
mod sampling;

pub use case::{CanonicalMessage, CanonicalPrompt, EvalCase, NewCaseParams};
pub use result::{EvalResult, NewResultParams, Verdict};
pub use rubric::{DimensionScore, JudgeVerdict, Rubric, RubricDimension};
pub use run::{EvalRun, EvalRunKind, EvalRunStatus, NewRunParams, TriggerSource};
pub use sampling::{SampleFilter, SampledRequest};