pub struct ResponsesRequest {Show 36 fields
pub include: Option<Vec<IncludeField>>,
pub input: ResponseInput,
pub instructions: Option<String>,
pub max_output_tokens: Option<u32>,
pub max_tool_calls: Option<u32>,
pub metadata: Option<HashMap<String, Value>>,
pub model: String,
pub conversation: Option<ConversationRef>,
pub parallel_tool_calls: Option<bool>,
pub previous_response_id: Option<String>,
pub reasoning: Option<ResponseReasoningParam>,
pub service_tier: Option<ServiceTier>,
pub store: Option<bool>,
pub stream: Option<bool>,
pub temperature: Option<f32>,
pub tool_choice: Option<ResponsesToolChoice>,
pub tools: Option<Vec<ResponseTool>>,
pub top_logprobs: Option<u32>,
pub top_p: Option<f32>,
pub truncation: Option<Truncation>,
pub text: Option<TextConfig>,
pub user: Option<String>,
pub request_id: Option<String>,
pub priority: i32,
pub frequency_penalty: Option<f32>,
pub presence_penalty: Option<f32>,
pub stop: Option<StringOrArray>,
pub prompt: Option<ResponsePrompt>,
pub prompt_cache_key: Option<String>,
pub prompt_cache_retention: Option<PromptCacheRetention>,
pub safety_identifier: Option<String>,
pub stream_options: Option<StreamOptions>,
pub context_management: Option<Vec<ContextManagementEntry>>,
pub top_k: i32,
pub min_p: f32,
pub repetition_penalty: f32,
}Fields§
§include: Option<Vec<IncludeField>>Fields to include in the response
input: ResponseInputInput content - can be string or structured items
instructions: Option<String>System instructions for the model
max_output_tokens: Option<u32>Maximum number of output tokens
max_tool_calls: Option<u32>Maximum number of tool calls
metadata: Option<HashMap<String, Value>>Additional metadata
model: StringModel to use
conversation: Option<ConversationRef>Optional conversation reference to persist input/output as items.
Spec: conversation accepts either a bare ID string or
ResponseConversationParam { id }. Both wire shapes deserialize into
ConversationRef; downstream code reads the id via
ConversationRef::as_id.
parallel_tool_calls: Option<bool>Whether to enable parallel tool calls
previous_response_id: Option<String>ID of previous response to continue from
reasoning: Option<ResponseReasoningParam>Reasoning configuration
service_tier: Option<ServiceTier>Service tier
store: Option<bool>Whether to store the response
stream: Option<bool>Whether to stream the response
temperature: Option<f32>Temperature for sampling
tool_choice: Option<ResponsesToolChoice>Tool choice behavior (Responses-spec enum — see ResponsesToolChoice).
tools: Option<Vec<ResponseTool>>Available tools
top_logprobs: Option<u32>Number of top logprobs to return
top_p: Option<f32>Top-p sampling parameter
truncation: Option<Truncation>Truncation behavior
text: Option<TextConfig>Text format for structured outputs (text, json_object, json_schema)
user: Option<String>User identifier
request_id: Option<String>Request ID
priority: i32Request priority
frequency_penalty: Option<f32>Frequency penalty
presence_penalty: Option<f32>Presence penalty
stop: Option<StringOrArray>Stop sequences
prompt: Option<ResponsePrompt>Reference to a prompt template and its variables.
Spec: body param prompt (ResponsePrompt).
prompt_cache_key: Option<String>Stable cache key used by upstream to share prompt-prefix caches across
requests. Spec: body param prompt_cache_key (replaces user).
prompt_cache_retention: Option<PromptCacheRetention>Retention policy for prompt-cache entries.
Spec: body param prompt_cache_retention ("in-memory" | "24h").
safety_identifier: Option<String>Stable user identifier for policy/abuse detection (max 64 chars on the
spec, but we do not enforce length here — routers may pass through).
Spec: body param safety_identifier (replaces user on request side).
stream_options: Option<StreamOptions>Streaming-only options. Spec: body param stream_options.
On the Responses API the only documented field is include_obfuscation.
context_management: Option<Vec<ContextManagementEntry>>Per-request context-management configuration.
Spec: body param context_management — array of entries describing how
the upstream should compact context for this request.
top_k: i32Top-k sampling parameter (SGLang extension)
min_p: f32Min-p sampling parameter (SGLang extension)
repetition_penalty: f32Repetition penalty (SGLang extension)
Trait Implementations§
Source§impl Clone for ResponsesRequest
impl Clone for ResponsesRequest
Source§fn clone(&self) -> ResponsesRequest
fn clone(&self) -> ResponsesRequest
1.0.0 (const: unstable) · Source§fn clone_from(&mut self, source: &Self)
fn clone_from(&mut self, source: &Self)
source. Read moreSource§impl Debug for ResponsesRequest
impl Debug for ResponsesRequest
Source§impl Default for ResponsesRequest
impl Default for ResponsesRequest
Source§impl<'de> Deserialize<'de> for ResponsesRequest
impl<'de> Deserialize<'de> for ResponsesRequest
Source§fn deserialize<__D>(__deserializer: __D) -> Result<Self, __D::Error>where
__D: Deserializer<'de>,
fn deserialize<__D>(__deserializer: __D) -> Result<Self, __D::Error>where
__D: Deserializer<'de>,
Source§impl GenerationRequest for ResponsesRequest
impl GenerationRequest for ResponsesRequest
Source§fn extract_text_for_routing(&self) -> String
fn extract_text_for_routing(&self) -> String
Source§fn routing_tokens(&self) -> Option<&[i32]>
fn routing_tokens(&self) -> Option<&[i32]>
Source§impl JsonSchema for ResponsesRequest
impl JsonSchema for ResponsesRequest
Source§fn schema_id() -> Cow<'static, str>
fn schema_id() -> Cow<'static, str>
Source§fn json_schema(generator: &mut SchemaGenerator) -> Schema
fn json_schema(generator: &mut SchemaGenerator) -> Schema
Source§fn inline_schema() -> bool
fn inline_schema() -> bool
$ref keyword. Read more