fix(pricing): update Codex Auto-review rates

This commit is contained in:
Zven
2026-07-31 21:16:06 +08:00
parent d29acc29a5
commit f54e9827a0
2 changed files with 21 additions and 18 deletions
@@ -531,7 +531,7 @@ func TestDefaultPricingIncludesGemini36FlashRates(t *testing.T) {
}
}
func TestDefaultPricingIncludesCodexAutoReview(t *testing.T) {
func TestDefaultPricingUsesReducedCodexAutoReviewRates(t *testing.T) {
data, err := os.ReadFile(filepath.Join("..", "..", "resources", "model-pricing", "model_prices_and_context_window.json"))
require.NoError(t, err)
@@ -542,9 +542,12 @@ func TestDefaultPricingIncludesCodexAutoReview(t *testing.T) {
got := svc.GetModelPricing("codex-auto-review")
require.NotNil(t, got)
require.InDelta(t, 5e-6, got.InputCostPerToken, 1e-12)
require.InDelta(t, 3e-5, got.OutputCostPerToken, 1e-12)
require.InDelta(t, 5e-7, got.CacheReadInputTokenCost, 1e-12)
require.InDelta(t, 0.2e-6, got.InputCostPerToken, 1e-12)
require.InDelta(t, 0.4e-6, got.InputCostPerTokenPriority, 1e-12)
require.InDelta(t, 1.2e-6, got.OutputCostPerToken, 1e-12)
require.InDelta(t, 2.4e-6, got.OutputCostPerTokenPriority, 1e-12)
require.InDelta(t, 0.02e-6, got.CacheReadInputTokenCost, 1e-12)
require.InDelta(t, 0.04e-6, got.CacheReadInputTokenCostPriority, 1e-12)
}
func TestGetModelPricing_Gpt54MiniUsesDedicatedStaticFallbackWhenRemoteMissing(t *testing.T) {
@@ -709,25 +709,25 @@
"tool_use_system_prompt_tokens": 346
},
"codex-auto-review": {
"cache_read_input_token_cost": 5e-07,
"cache_read_input_token_cost_above_272k_tokens": 1e-06,
"cache_read_input_token_cost_flex": 2.5e-07,
"cache_read_input_token_cost_priority": 1e-06,
"input_cost_per_token": 5e-06,
"input_cost_per_token_above_272k_tokens": 1e-05,
"input_cost_per_token_batches": 2.5e-06,
"input_cost_per_token_flex": 2.5e-06,
"input_cost_per_token_priority": 1e-05,
"cache_read_input_token_cost": 2e-08,
"cache_read_input_token_cost_above_272k_tokens": 4e-08,
"cache_read_input_token_cost_flex": 1e-08,
"cache_read_input_token_cost_priority": 4e-08,
"input_cost_per_token": 2e-07,
"input_cost_per_token_above_272k_tokens": 4e-07,
"input_cost_per_token_batches": 1e-07,
"input_cost_per_token_flex": 1e-07,
"input_cost_per_token_priority": 4e-07,
"litellm_provider": "openai",
"max_input_tokens": 1050000,
"max_output_tokens": 128000,
"max_tokens": 128000,
"mode": "chat",
"output_cost_per_token": 3e-05,
"output_cost_per_token_above_272k_tokens": 4.5e-05,
"output_cost_per_token_batches": 1.5e-05,
"output_cost_per_token_flex": 1.5e-05,
"output_cost_per_token_priority": 6e-05,
"output_cost_per_token": 1.2e-06,
"output_cost_per_token_above_272k_tokens": 1.8e-06,
"output_cost_per_token_batches": 6e-07,
"output_cost_per_token_flex": 6e-07,
"output_cost_per_token_priority": 2.4e-06,
"supported_endpoints": [
"/v1/chat/completions",
"/v1/batch",