1pub mod criteria;
50pub mod error;
51pub mod evaluator;
52pub mod llm_judge;
53pub mod report;
54pub mod schema;
55pub mod scoring;
56
57#[cfg(feature = "personas")]
58pub mod personas;
59
60pub mod optimizer;
61
62pub mod annotation;
64pub mod baseline;
65pub mod conversation_scorer;
66pub mod cost_tracker;
67pub mod pricing;
68pub mod structured_judge;
69pub mod test_generator;
70pub mod trace_analyzer;
71
72#[cfg(feature = "embedding")]
74pub mod embedding_scorer;
75
76#[cfg(feature = "ci-helpers")]
77pub mod junit_reporter;
78
79#[cfg(feature = "statistics")]
80pub mod ab_comparator;
81
82#[cfg(feature = "vertex-eval")]
83pub mod vertex;
84
85pub use criteria::{
87 EvaluationCriteria, ResponseMatchConfig, Rubric, RubricConfig, ToolTrajectoryConfig,
88};
89pub use error::{EvalError, Result};
90pub use evaluator::{EvaluationConfig, Evaluator};
91pub use llm_judge::{
92 LlmJudge, LlmJudgeConfig, RubricEvaluationResult, RubricScore, SemanticMatchResult,
93};
94pub use report::{EvaluationReport, EvaluationResult, Failure, TestCaseResult};
95pub use schema::{EvalCase, EvalSet, IntermediateData, SessionInput, TestFile, ToolUse, Turn};
96pub use scoring::{ResponseScorer, ToolTrajectoryScorer};
97
98pub use optimizer::{OptimizationResult, OptimizerConfig, PromptOptimizer};
100
101pub use annotation::{AnnotationRecord, AnnotationStore, HumanVerdict};
103pub use baseline::{Baseline, BaselineStore, Regression};
104pub use conversation_scorer::{ConversationMetrics, ConversationScorer, ConversationScorerConfig};
105pub use cost_tracker::{CostMetrics, CostTracker};
106pub use pricing::ModelPricing;
107pub use structured_judge::{
108 JudgeRubric, ScalePoint, StructuredJudge, StructuredJudgeConfig, StructuredVerdict, Verdict,
109};
110pub use test_generator::{EvalCaseMetadata, GeneratorConfig, TestGenerator};
111pub use trace_analyzer::{
112 ToolCallRecord, TraceAnalysis, TraceAnalyzer, TraceDiagnostic, TracePattern,
113};
114
115#[cfg(feature = "embedding")]
116pub use embedding_scorer::EmbeddingScorer;
117
118#[cfg(feature = "ci-helpers")]
119pub use junit_reporter::JunitReporter;
120
121#[cfg(feature = "statistics")]
122pub use ab_comparator::AbComparator;
123
124#[cfg(feature = "vertex-eval")]
125pub use vertex::{
126 AutoraterConfig, PointwiseMetricResult, PointwiseMetricSpec, TrajectoryMetric,
127 VertexEvalClient, VertexEvalConfig, VertexEvalJudge,
128};
129
130pub mod prelude {
132 pub use crate::criteria::{
133 EvaluationCriteria, ResponseMatchConfig, Rubric, RubricConfig, ToolTrajectoryConfig,
134 };
135 pub use crate::error::{EvalError, Result};
136 pub use crate::evaluator::{EvaluationConfig, Evaluator};
137 pub use crate::llm_judge::{
138 LlmJudge, LlmJudgeConfig, RubricEvaluationResult, SemanticMatchResult,
139 };
140 pub use crate::report::{EvaluationReport, EvaluationResult, Failure, TestCaseResult};
141 pub use crate::schema::{EvalCase, EvalSet, TestFile, ToolUse, Turn};
142}