Together AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...
Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached); Provisioned Throughput per-PTU capacity increased: MiniMax M3 TPM/PTU rose from 138,840/694,200/23,140 to 166,667/833,333/41,667; GLM-5.2 output TPM/PTU rose 9,620 to 11,364. Price unchanged, $0.0
What changed
Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached)
Provisioned Throughput per-PTU capacity increased: MiniMax M3 TPM/PTU rose from 138,840/694,200/23,140 to 166,667/833,333/41,667; GLM-5.2 output TPM/PTU rose 9,620 to 11,364. Price unchanged, $0.05/PTU/min.
Before and after
Aug 10, 2026 vs Aug 17, 2026Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached)
Sign in to view the full comparison
See the before/after screenshots and every marked-up change.
More from Together AI
Full history →- Week 41, 2026·improvedTogether AI adds Tev1 4B Experimental at $0.04 input with free output
- Week 39, 2026·increaseTogether AI: Qwen3.7-Max inference price increased 25% ($2.00→$2.50)
- Week 38, 2026·increaseTogether AI: Qwen3.7-Max price hike + new DeepSeek V4.1 Flash model
- Week 32, 2026·improvedTogether AI: HGX H100 GPU price increase + Kimi K3 & Inkling Small models added
- Week 31, 2026·packagingTogether AI: LFM2.5-8B-A1B model removed from Serverless Inference
