updated = "2026-09-05"
source = "https://www.anthropic.com/pricing and https://ai.google.dev/gemini-api/docs/pricing"
[server_tools]
web_search = 10.0
[[model]]
prefix = "claude-fable-5-1"
input = 10.0
output = 50.0
cache_read = 0.25
[[model]]
prefix = "claude-mythos-5-1"
input = 10.0
output = 50.0
cache_read = 0.25
[[model]]
prefix = "claude-fable-5"
input = 10.0
output = 50.0
cache_read = 1.0
[[model]]
prefix = "claude-mythos-5"
input = 10.0
output = 50.0
cache_read = 1.0
[[model]]
prefix = "claude-opus-5"
input = 5.0
output = 25.0
cache_read = 0.5
[[model]]
prefix = "claude-opus-4-8"
input = 5.0
output = 25.0
cache_read = 0.5
[[model]]
prefix = "claude-opus-4-7"
input = 5.0
output = 25.0
cache_read = 0.5
[[model]]
prefix = "claude-opus-4-6"
input = 5.0
output = 25.0
cache_read = 0.5
[[model]]
prefix = "claude-sonnet-5"
input = 2.0
output = 10.0
cache_read = 0.2
[[model]]
prefix = "claude-sonnet-4-6"
input = 3.0
output = 15.0
cache_read = 0.3
[[model]]
prefix = "claude-haiku-4-5"
input = 1.0
output = 5.0
cache_read = 0.1
[[model]]
prefix = "gemini-2.5-pro"
input = 1.25
output = 10.0
cache_read = 0.125
cache_write_5m = 1.25
cache_write_1h = 1.25
[[model]]
prefix = "gemini-2.5-flash"
input = 0.30
output = 2.50
cache_read = 0.03
cache_write_5m = 0.30
cache_write_1h = 0.30
[[model]]
prefix = "gemini-2.5-flash-lite"
input = 0.10
output = 0.40
cache_read = 0.01
cache_write_5m = 0.10
cache_write_1h = 0.10
[[model]]
prefix = "gemini-3-flash"
input = 0.50
output = 3.0
cache_read = 0.05
cache_write_5m = 0.50
cache_write_1h = 0.50
[[model]]
prefix = "gemini-3.1-pro"
input = 2.0
output = 12.0
cache_read = 0.20
cache_write_5m = 2.0
cache_write_1h = 2.0
[[model]]
prefix = "gemini-3.1-flash-lite"
input = 0.25
output = 1.50
cache_read = 0.025
cache_write_5m = 0.25
cache_write_1h = 0.25
[[model]]
prefix = "gemini-3.5-flash"
input = 1.50
output = 9.0
cache_read = 0.15
cache_write_5m = 1.50
cache_write_1h = 1.50
[[model]]
prefix = "gemini-3.5-flash-lite"
input = 0.30
output = 2.50
cache_read = 0.03
cache_write_5m = 0.30
cache_write_1h = 0.30
[[model]]
prefix = "gemini-3.6-flash"
input = 0.75
output = 3.75
cache_read = 0.075
cache_write_5m = 0.75
cache_write_1h = 0.75
[[model]]
prefix = "gemini-3.7-flash"
input = 0.75
output = 3.75
cache_read = 0.075
cache_write_5m = 0.75
cache_write_1h = 0.75
[[model]]
prefix = "gemini-3.8-flash"
input = 0.75
output = 3.75
cache_read = 0.075
cache_write_5m = 0.75
cache_write_1h = 0.75
[[model]]
prefix = "gpt-5.6-sol"
input = 4.0
output = 20.0
cache_read = 0.40
cache_write_5m = 4.0
cache_write_1h = 4.0
[[model]]
prefix = "gpt-5.6-terra"
input = 2.0
output = 12.0
cache_read = 0.20
cache_write_5m = 2.0
cache_write_1h = 2.0
[[model]]
prefix = "gpt-5.6-luna"
input = 0.20
output = 1.20
cache_read = 0.02
cache_write_5m = 0.20
cache_write_1h = 0.20
[[model]]
prefix = "gpt-5.5-pro"
input = 30.0
output = 180.0
cache_read = 30.0
cache_write_5m = 30.0
cache_write_1h = 30.0
[[model]]
prefix = "gpt-5.5"
input = 5.0
output = 30.0
cache_read = 0.50
cache_write_5m = 5.0
cache_write_1h = 5.0
[[model]]
prefix = "gpt-5.4-mini"
input = 0.75
output = 4.50
cache_read = 0.075
cache_write_5m = 0.75
cache_write_1h = 0.75
[[model]]
prefix = "gpt-5.4-nano"
input = 0.20
output = 1.25
cache_read = 0.02
cache_write_5m = 0.20
cache_write_1h = 0.20
[[model]]
prefix = "gpt-5.4-pro"
input = 30.0
output = 180.0
cache_read = 30.0
cache_write_5m = 30.0
cache_write_1h = 30.0
[[model]]
prefix = "gpt-5.4"
input = 2.50
output = 15.0
cache_read = 0.25
cache_write_5m = 2.50
cache_write_1h = 2.50
[[model]]
prefix = "gpt-5.2-pro"
input = 21.0
output = 168.0
cache_read = 21.0
cache_write_5m = 21.0
cache_write_1h = 21.0
[[model]]
prefix = "gpt-5.2"
input = 1.75
output = 14.0
cache_read = 0.175
cache_write_5m = 1.75
cache_write_1h = 1.75
[[model]]
prefix = "gpt-5.1"
input = 1.25
output = 10.0
cache_read = 0.125
cache_write_5m = 1.25
cache_write_1h = 1.25
[[model]]
prefix = "gpt-5-mini"
input = 0.25
output = 2.0
cache_read = 0.025
cache_write_5m = 0.25
cache_write_1h = 0.25
[[model]]
prefix = "gpt-5-nano"
input = 0.05
output = 0.40
cache_read = 0.005
cache_write_5m = 0.05
cache_write_1h = 0.05
[[model]]
prefix = "gpt-5-pro"
input = 15.0
output = 120.0
cache_read = 15.0
cache_write_5m = 15.0
cache_write_1h = 15.0
[[model]]
prefix = "gpt-5"
input = 1.25
output = 10.0
cache_read = 0.125
cache_write_5m = 1.25
cache_write_1h = 1.25