pub struct PerRequestRecord {Show 39 fields
pub request_id: Option<String>,
pub play_id: Option<String>,
pub session_id: Option<String>,
pub turn_index: Option<usize>,
pub metadata: Value,
pub uuid: String,
pub arrival_time_ms: f64,
pub dispatched_at_ms: Option<f64>,
pub first_admit_ms: Option<f64>,
pub terminal_time_ms: f64,
pub first_token_ms: Option<f64>,
pub last_token_ms: Option<f64>,
pub ttft_ms: Option<f64>,
pub ttst_ms: Option<f64>,
pub e2e_latency_ms: Option<f64>,
pub itl_ms: Option<f64>,
pub input_length: usize,
pub requested_output_length: usize,
pub output_length: usize,
pub reused_input_tokens: usize,
pub first_admission_g1_reused_input_tokens: Option<usize>,
pub first_admission_host_reused_input_tokens: Option<usize>,
pub prefill_worker_idx: Option<usize>,
pub decode_worker_idx: Option<usize>,
pub prefill_admit_ms: Option<f64>,
pub source_held_ms: Option<f64>,
pub destination_reserved_ms: Option<f64>,
pub destination_activated_ms: Option<f64>,
pub decode_admit_ms: Option<f64>,
pub source_released_ms: Option<f64>,
pub decode_reused_input_tokens: Option<usize>,
pub prefill_route_overlap_tokens: Option<usize>,
pub decode_route_overlap_tokens: Option<usize>,
pub routing_history: Vec<PerRequestRoutingRecord>,
pub admission_history: Vec<PerRequestAdmissionRecord>,
pub admission_count: usize,
pub readmission_count: usize,
pub pressure_record_ordinals: Vec<u64>,
pub terminal_status: ReplayTerminalStatus,
}Expand description
Flat per-request record for optional JSONL emission. One JSON line per request is consumed by external analysis tools that want per-request granularity (TTFT vs. ISL scatter, worker-residency analysis, bypass classification, etc.).
Fields§
§request_id: Option<String>Authored request identity from ReplaySpec. Legacy runtime inputs that only carry an internal UUID leave this unset.
play_id: Option<String>§session_id: Option<String>Session identifier from the trace, when present. Mirrors AIPerf’s
conversation_id field for the same purpose: bucket per-request
records by multi-turn session. Placed first in the serialized output
so each JSONL row leads with its session/turn identity, matching
AIPerf’s profile_export.jsonl layout.
turn_index: Option<usize>Zero-based turn index within session_id, when present.
metadata: ValueAuthored provider-neutral metadata retained for correlation.
uuid: String§arrival_time_ms: f64§dispatched_at_ms: Option<f64>§first_admit_ms: Option<f64>§terminal_time_ms: f64§first_token_ms: Option<f64>§last_token_ms: Option<f64>§ttft_ms: Option<f64>§ttst_ms: Option<f64>§e2e_latency_ms: Option<f64>§itl_ms: Option<f64>Inter-token latency for this request, in milliseconds. Matches
AIPerf’s inter_token_latency field — one scalar per request.
input_length: usize§requested_output_length: usizeNumber of output tokens requested by the workload trace.
output_length: usizeNumber of output tokens actually emitted by the mock engine.
reused_input_tokens: usize§first_admission_g1_reused_input_tokens: Option<usize>§first_admission_host_reused_input_tokens: Option<usize>§prefill_worker_idx: Option<usize>§decode_worker_idx: Option<usize>§prefill_admit_ms: Option<f64>§source_held_ms: Option<f64>§destination_reserved_ms: Option<f64>§destination_activated_ms: Option<f64>§decode_admit_ms: Option<f64>§source_released_ms: Option<f64>§decode_reused_input_tokens: Option<usize>§prefill_route_overlap_tokens: Option<usize>§decode_route_overlap_tokens: Option<usize>§routing_history: Vec<PerRequestRoutingRecord>§admission_history: Vec<PerRequestAdmissionRecord>§admission_count: usize§readmission_count: usize§pressure_record_ordinals: Vec<u64>§terminal_status: ReplayTerminalStatusTrait Implementations§
Source§impl Clone for PerRequestRecord
impl Clone for PerRequestRecord
Source§fn clone(&self) -> PerRequestRecord
fn clone(&self) -> PerRequestRecord
1.0.0 (const: unstable) · Source§fn clone_from(&mut self, source: &Self)
fn clone_from(&mut self, source: &Self)
source. Read more