{
"//": "Copy to steeldb.json (or ~/.steeldb/config.json) to point SteelDB at any LLM provider.",
"//default": "With no config, SteelDB uses the bundled tuned Qwen3-1.7B (local server on :8001, else ollama).",
"//openrouter": "One key, hundreds of models (Claude/GPT/Llama/…). provider 'openai' = the OpenAI-compatible client.",
"llm": {
"provider": "openai",
"base_url": "https://openrouter.ai/api/v1",
"model": "anthropic/claude-3.5-sonnet",
"api_key": "sk-or-..."
},
"//examples": {
"openai": { "provider": "openai", "base_url": "https://api.openai.com/v1", "model": "gpt-4o-mini", "api_key": "sk-..." },
"together": { "provider": "openai", "base_url": "https://api.together.xyz/v1", "model": "meta-llama/Llama-3.3-70B-Instruct-Turbo", "api_key": "..." },
"groq": { "provider": "openai", "base_url": "https://api.groq.com/openai/v1", "model": "llama-3.3-70b-versatile", "api_key": "gsk-..." },
"local": { "provider": "local", "base_url": "http://localhost:11434/v1", "model": "qwen3:1.7b" },
"bedrock": { "provider": "bedrock", "model": "us.anthropic.claude-sonnet-4-5-20250929-v1:0" },
"native": { "provider": "native" },
"needle": { "provider": "needle", "needle_url": "http://localhost:8080" }
},
"//native": "Fully offline in-process inference (feature `native`): tuned Qwen3-1.7B + shipped LoRA, quantized to a cached GGUF on first run. No server.",
"//needle": "Cactus Needle 26M tool-use-native model (feature `needle`) via its /generate server (needle-code). Env: STEELDB_LLM=needle, STEELDB_NEEDLE_URL=http://localhost:8080"
}