use async_openai::{Client, config::Config, types::chat::CreateChatCompletionRequest};
use async_stream;
use std::error::Error;
use tokio_stream::StreamExt;
use tracing::{debug, error};
use super::{
mappers::{map_messages, map_tools},
streaming::process_completion_stream,
};
use crate::provider::error_stream;
use crate::{Context, LlmError, LlmResponseStream, ProviderError, StreamingModelProvider};
pub trait OpenAiChatProvider {
type Config: Config + Clone + 'static;
fn client(&self) -> &Client<Self::Config>;
fn model(&self) -> &str;
fn provider_name(&self) -> &str;
}
impl<T: OpenAiChatProvider + Send + Sync> StreamingModelProvider for T {
fn stream_response(&self, context: &Context) -> LlmResponseStream {
let client = self.client().clone();
let model = self.model().to_string();
let messages = match map_messages(context.messages()) {
Ok(messages) => messages,
Err(e) => return error_stream(e),
};
let message_count = messages.len();
let tools = if context.tools().is_empty() {
None
} else {
match map_tools(context.tools(), None) {
Ok(t) => Some(t),
Err(e) => return error_stream(e),
}
};
Box::pin(async_stream::stream! {
debug!("Starting chat completion stream for model: {model}");
let req = CreateChatCompletionRequest {
model: model.clone(),
messages,
tools,
stream: Some(true),
..Default::default()
};
debug!(
"Making request to Ollama API with model: {model} and {message_count} messages"
);
let stream = match client.chat().create_stream(req).await {
Ok(stream) => {
debug!("Successfully created stream from Ollama API");
stream
}
Err(e) => {
error!("Failed to create stream from Ollama API: {:?}", e);
if let Some(reqwest_err) =
e.source().and_then(|s| s.downcast_ref::<reqwest::Error>())
{
if let Some(url) = reqwest_err.url() {
error!("Request URL was: {url}");
}
if let Some(status) = reqwest_err.status() {
error!("HTTP status: {status}");
}
}
yield Err(LlmError::from(e));
return;
}
};
let stream = stream.map(|result| {
result.map_err(|e| LlmError::from(ProviderError::stream_interrupted(e.to_string())))
});
let mut shared_stream = Box::pin(process_completion_stream(stream));
while let Some(result) = shared_stream.next().await {
yield result;
}
})
}
fn context_window(&self) -> Option<u32> {
None
}
fn display_name(&self) -> String {
let model = self.model();
if model.is_empty() { self.provider_name().to_string() } else { format!("{} ({model})", self.provider_name()) }
}
}
#[cfg(test)]
mod tests {
use futures::StreamExt;
use super::*;
use crate::providers::local::ollama::OllamaProvider;
use crate::providers::test_capture_server::CaptureServer;
use crate::{ChatMessage, LlmResponse, Result};
#[tokio::test]
async fn local_chat_providers_omit_cache_metadata() {
let mut server = CaptureServer::start_chat_completions().await;
let provider = OllamaProvider::new("test-model", &server.base_url);
let mut context = Context::new(vec![ChatMessage::user("Hello")], vec![]);
context.set_prompt_cache_key(Some("prefix-abc".to_string()));
context.set_session_affinity_key(Some("conversation-abc".to_string()));
let responses = provider.stream_response(&context).collect::<Vec<_>>().await;
let captured = server.captured().await;
assert!(responses.iter().all(Result::is_ok), "{responses:?}");
assert!(responses.iter().any(|response| matches!(response, Ok(LlmResponse::Done { .. }))));
assert_eq!(captured.path, "/v1/chat/completions");
assert!(captured.body.get("prompt_cache_key").is_none());
assert!(captured.body.get("session_id").is_none());
assert!(captured.body.get("user").is_none());
}
}