daily brief ·
Gemini 3.7 Flash doubles to $1.5/$7.5 per MTok; Replit Core cut to $20/mo
Prices Google/Vertex Gemini 3.7 Flash aliases doubled uniformly to $1.5 input/$7.5 output per MTok across edenai (evt 68598,68597,68596,68595,68594,68593) and kilo (evt 68587).
DeepSeek v4 gateways diverged: edenai's v4-flash rose to $0.44/$1.32 (evt 68592) and v4-pro to $1.32/$3.96 (evt 68581); merge-gateway's v4-pro hit $0.66/$1.98 (evt 68578,68308) and v4-flash $0.22/$0.66 (evt 68567,68307); llmgateway instead cut v4-flash to $0.05/$0.09 (evt 68238).
GLM-5.2 split by gateway: OpenRouter batch doubled to $1.4/$4.4 (evt 68558), OpenRouter spot rose to $0.966/$3.036 (evt 68458); vercel cut to $0.8/$2.55 (evt 68371), hyper cut to $1.1/$3.851 (evt 68334), ambient cut to $0.6/$2 (evt 68245).
Kimi-k2.5 fell to $0.45/$2.25 on models.dev (evt 68463) but rose to $0.5744/$3.005 on hyper (evt 68323); Kimi-k2.7-code batch doubled to $0.95/$4 (evt 68559).
nano-gpt cut GPT-latest, gpt-5.6-sol/sol-pro, and gpt-chat-latest 50% to $2.5/$15 (evt 68234,68233,68232,68231).
OpenRouter batch models minimax-m3 ($0.3/$1.2, evt 68561), nemotron-3-ultra ($0.6/$3.6, evt 68560) and thinkingmachines inkling ($1/$4.05, evt 68555) all doubled; llmgateway trimmed nemotron-3-ultra output to $2.2 (evt 68243).
Qwen models mostly cut: qwen3-next-80b -10% (evt 68417), qwen3.5-122b -10.3% (evt 68415), qwen3.6-27b -50% (evt 68400), gemma-4-31b -10% (evt 68380); but qwen3.8-27B-TEE on chutes rose +12.5% (evt 68617), qwen3-coder-480b on llmgateway rose +26.7% (evt 68237), minimax-m2.7 on hyper rose +14.6% (evt 68333), and glm-5.1 on hyper fell -10.8% (evt 68314).
Plans Replit cut Replit Core to $20/mo from $25, trimming monthly credits to $20, and now lists a $0/yr Starter tier (evt 68832).
events in this brief
On the tape
- pricemodels.dev ↗
nano-gpt/openai/gpt-chat-latest input price cut $5→$2.5/MTok (-50%) on models.dev; output $30→$15
- pricemodels.dev ↗
nano-gpt/openai/gpt-5.6-sol input price cut $5→$2.5/MTok (-50%) on models.dev; output $30→$15
- pricemodels.dev ↗
nano-gpt/openai/gpt-5.6-sol-pro input price cut $5→$2.5/MTok (-50%) on models.dev; output $30→$15
- pricemodels.dev ↗
nano-gpt/openai/gpt-latest input price cut $5→$2.5/MTok (-50%) on models.dev; output $30→$15
- pricemodels.dev ↗
- pricemodels.dev ↗
- pricemodels.dev ↗
llmgateway/nemotron-3-ultra-550b output price cut $2.5→$2.2/MTok (-12%) on models.dev
- pricemodels.dev ↗
ambient/ambient/large input price cut $1.05→$0.6/MTok (-42.9%) on models.dev; output $4.4→$2
- pricemodels.dev ↗
ambient/z-ai/glm-5.2 input price cut $1.05→$0.6/MTok (-42.9%) on models.dev; output $4.4→$2
- pricemodels.dev ↗
- pricemodels.dev ↗
- pricemodels.dev ↗
hyper/glm-5.1 input price cut $1.5243→$1.36/MTok (-10.8%) on models.dev; output $4.7907→$4.4
- pricemodels.dev ↗
hyper/kimi-k2.5 input price raised $0.51→$0.5744/MTok (+12.6%) on models.dev; output $2.7→$3.005
- pricemodels.dev ↗
hyper/minimax-m2.7 input price raised $0.41→$0.47/MTok (+14.6%) on models.dev; output $1.52→$1.76
- pricemodels.dev ↗
hyper/glm-5.2 input price cut $1.4→$1.1/MTok (-21.4%) on models.dev; output $4.4→$3.851
- pricemodels.dev ↗
vercel/zai/glm-5.2 input price cut $1.1→$0.8/MTok (-27.3%) on models.dev; output $3.851→$2.55
- pricemodels.dev ↗
openrouter/google/gemma-4-31b-it input price cut $0.1→$0.09/MTok (-10%) on models.dev
- pricemodels.dev ↗
openrouter/qwen/qwen3.6-27b input price cut $0.6→$0.3/MTok (-50%) on models.dev; output $3.6→$2
- pricemodels.dev ↗
openrouter/qwen/qwen3.5-122b-a10b input price cut $0.29→$0.26/MTok (-10.3%) on models.dev; output $2.4→$2.08
- pricemodels.dev ↗
openrouter/qwen/qwen3-next-80b-a3b-instruct input price cut $0.1→$0.09/MTok (-10%) on models.dev
- pricemodels.dev ↗
- pricemodels.dev ↗
- priceopenrouter.ai ↗
thinkingmachines/inkling:batch input price raised $0.5→$1/MTok (+100%) on OpenRouter; output $2.025→$4.05
- priceopenrouter.ai ↗
z-ai/glm-5.2:batch input price raised $0.7→$1.4/MTok (+100%) on OpenRouter; output $2.2→$4.4
- priceopenrouter.ai ↗
- priceopenrouter.ai ↗
- priceopenrouter.ai ↗
minimax/minimax-m3:batch input price raised $0.15→$0.3/MTok (+100%) on OpenRouter; output $0.6→$1.2
- pricemodels.dev ↗
- pricemodels.dev ↗
- pricemodels.dev ↗
- pricemodels.dev ↗
kilo/google/gemini-3.7-flash input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
- pricemodels.dev ↗
edenai/google/gemini-flash-latest input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
edenai/google/gemini-3.7-flash input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
edenai/vertex/gemini-3.7-flash@us input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
edenai/vertex/gemini-flash-latest input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
edenai/vertex/gemini-3.7-flash@eu input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
edenai/vertex/gemini-3.7-flash input price raised $0.75→$1.5/MTok (+100%) on models.dev; output $3.75→$7.5
- pricemodels.dev ↗
chutes/Qwen/Qwen3.8-27B-TEE input price raised $0.4→$0.45/MTok (+12.5%) on models.dev; output $3→$3.2
- planreplit.com ↗
Replit plans changed: Starter price now listed: $0/yr; Replit Core $25→$20/mo
40 detected events · each links its primary source