Pricing change·Jun 15 → Jun 22, 2026·Week 26, 2026·AI & Machine Learning
Together AI slashes GPU and AI inference prices up to 25%
What changed
Price decrease
GPU Clusters on-demand rates cut across all hardware: H100 $5.49→$4.79, H200 $6.79→$5.99, B200 $9.95→$8.19/hour. Reserved rates also reduced 12–25% across H100, H200, and B200 tiers.
Price decrease
DeepSeek V4 Pro serverless inference prices reduced: input from $2.10 to $1.74/1M tokens (~17% cut) and output from $4.40 to $3.48/1M tokens (~21% cut). Cached input unchanged at $0.20.
Before and after
Jun 15, 2026 vs Jun 22, 2026Pulse.
100%
Change 1 of 2 · price decreased
GPU Clusters on-demand rates cut across all hardware: H100 $5.49→$4.79, H200 $6.79→$5.99, B200 $9.95→$8.19/hour. Reserved rates also reduced 12–25% across H100, H200, and B200 tiers.
Sign in to view the full comparison
See the before/after screenshots and every marked-up change.
Week 25, 2026 · Together AI reveals cached input pricing for GLM-5.1 and Qwen3.5Together AI: new flagship models added, Llama 4 Maverick + Kimi K2.5 removed · Q2 2026
More from Together AI
Full history →- Week 41, 2026·improvedTogether AI adds Tev1 4B Experimental at $0.04 input with free output
- Week 39, 2026·increaseTogether AI: Qwen3.7-Max inference price increased 25% ($2.00→$2.50)
- Week 38, 2026·increaseTogether AI: Qwen3.7-Max price hike + new DeepSeek V4.1 Flash model
- Week 34, 2026·improvedTogether AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...
- Week 32, 2026·improvedTogether AI: HGX H100 GPU price increase + Kimi K3 & Inkling Small models added
