Open-weight models · served via Fireworks |
DeepSeek V4 Flash 0731 Fireworks | Open-weight | 0.025x (40x cheaper) | 952,400 | 595,200 | 6.0M | 1.2M | Served via Fireworks. 07/31 snapshot variant of DeepSeek V4 Flash. |
Llama 3.3 70B Fireworks | Open-weight | 0.036x (28x cheaper) | 493,800 | 617,300 | 6.2M | 617,300 | Meta; served via Fireworks. |
DeepSeek V4.1 Flash Fireworks | Open-weight | 0.04x (25x cheaper) | 606,100 | 252,500 | 23.8M | 757,600 | Multimodal DeepSeek model with native vision; served via Fireworks. $0.22/$0.007/$0.66 per 1M in/cached/out. |
Qwen 3.7 Plus Fireworks | Open-weight | 0.071x (14x cheaper) | 333,300 | 104,200 | 4.2M | 416,700 | Alibaba, vision-capable; served via Fireworks. |
Mistral Large 3 Fireworks | Open-weight | 0.077x (13x cheaper) | 333,300 | 83,300 | 4.2M | 416,700 | Mistral AI; served via Fireworks. |
Kimi K2.7 Fireworks | Open-weight | 0.17x (5.8x cheaper) | 140,400 | 41,700 | 1.8M | 175,400 | Moonshot AI 1T-param MoE; served via Fireworks. |
GLM-5.2 Fireworks | Open-weight | 0.23x (4.3x cheaper) | 95,200 | 37,900 | 1.2M | 119,000 | Z.ai (Zhipu), MIT-licensed; served via Fireworks. |
DeepSeek V4 Pro 0813 Fireworks | Open-weight | 0.24x (4.2x cheaper) | 101,000 | 42,100 | 3.6M | 126,300 | Official GA snapshot (0813) of DeepSeek V4 Pro; served via Fireworks. Supersedes the preview. $1.32/$0.044/$3.96 per 1M in/cached/out. |
DeepSeek V4 Pro (Fireworks) Fireworks | Open-weight | 0.25x (4x cheaper) | 76,600 | 47,900 | 1.1M | 95,800 | Preview (deepseek-v4-pro), still billed at 0.25x / $1.74/$0.145/$3.48 per 1M in/cached/out; superseded by 0813. Served via Fireworks (what PromptQL uses for open-weight). |
Kimi K3 Fireworks | Open-weight | 0.6x (1.7x cheaper) | 44,400 | 11,100 | 555,600 | 44,400 | Moonshot AI flagship; served via Fireworks. |
Proprietary models |
GPT-5.6 Luna OpenAI | Proprietary | 0.04x (25x cheaper) | 133,300 | 33,300 | 1.7M | 166,700 | Cost-efficient GPT-5.6 tier. |
Gemini 3.7 Flash Google | Proprietary | 0.15x (6.7x cheaper) | 177,800 | 44,400 | 2.2M | 222,200 | Google Gemini Flash tier; ~2x cheaper than Gemini 3.6 Flash. |
Gemini 3.8 Flash Google | Proprietary | 0.15x (6.7x cheaper) | 177,800 | 44,400 | 2.2M | 222,200 | Latest Google Gemini Flash tier; same introductory pricing as Gemini 3.7 Flash through Dec 31, 2026. |
Claude Haiku 4.5 Anthropic | Proprietary | 0.2x (5x cheaper) | 133,300 | 33,300 | 1.7M | 133,300 | Fast tier. |
GPT-5 OpenAI | Proprietary | 0.3x (3.4x cheaper) | 106,700 | 16,700 | 1.3M | 133,300 | GPT-5 base. |
GPT-5.1 OpenAI | Proprietary | 0.3x (3.4x cheaper) | 106,700 | 16,700 | 1.3M | 133,300 | Same rate as GPT-5. |
Grok 4.5 SpaceXAI | Proprietary | 0.37x (2.7x cheaper) | 66,700 | 22,200 | 666,700 | | SpaceXAI (xAI) frontier coding/agentic model. No cache-creation pricing. |
Grok 4.6 SpaceXAI | Proprietary | 0.37x (2.7x cheaper) | 66,700 | 22,200 | 666,700 | | SpaceXAI (xAI) frontier coding/agentic model. Same pricing as Grok 4.5. No cache-creation pricing. |
Gemini 3.1 Pro Google | Proprietary | 0.42x (2.4x cheaper) | 66,700 | 13,900 | 833,300 | 83,300 | Google flagship Pro. |
GPT-5.2 OpenAI | Proprietary | 0.42x (2.4x cheaper) | 76,200 | 11,900 | 952,400 | 95,200 | Flagship step-up. |
GPT-5.6 Terra OpenAI | Proprietary | 0.42x (2.4x cheaper) | 53,300 | 11,100 | 666,700 | 66,700 | Balanced GPT-5.6 tier. |
GPT-5.4 OpenAI | Proprietary | 0.52x (1.9x cheaper) | 53,300 | 11,100 | 666,700 | 66,700 | Reasoning/coding/agentic gains. |
Claude Sonnet 4.5 Anthropic | Proprietary | 0.6x (1.7x cheaper) | 44,400 | 11,100 | 555,600 | 44,400 | Balanced tier. (Sonnet 4.6 is blocklisted in PromptQL.) |
Claude Opus 4.6 Anthropic | Proprietary | 1.0x (baseline) | 26,700 | 6,700 | 333,300 | 26,700 | Anchor (1.0x). |
Claude Opus 4.8 Anthropic | Proprietary | 1.0x (baseline) | 26,700 | 6,700 | 333,300 | 26,700 | Current GA Opus; PromptQL Powerful tier. Same rate as 4.6/4.7. |
Claude Opus 5 Anthropic | Proprietary | 1.0x (baseline) | 26,700 | 6,700 | 333,300 | 26,700 | Latest GA Opus. Same rate as 4.8/4.6. |
GPT-5.5 OpenAI | Proprietary | 1.0x (baseline) | 26,700 | 5,600 | 333,300 | 33,300 | Latest flagship. >272K-context billed 2x in / 1.5x out. |
GPT-5.6 Sol OpenAI | Proprietary | 1.0x (baseline) | 26,700 | 5,600 | 333,300 | 33,300 | GPT-5.6 flagship. GA July 9, 2026. |
Claude Fable 5 Anthropic | Proprietary | 2x (2x cost) | 13,300 | 3,300 | 166,700 | 13,300 | New frontier flagship (Jun 2026); most capable, highest cost. |
GPT-6 Astra OpenAI | Proprietary | 2x (2x cost) | 13,300 | 3,300 | 166,700 | 13,300 | OpenAI GPT-6; $10/$50 per MTok in/out. Formula (10 + 0.05*50)/6.25 = 2.00. |
GPT-5 Pro OpenAI | Proprietary | 7.22x (7.2x cost) | 8,900 | 1,400 | 11,100 | 11,100 | Pro reasoning. No prompt-cache discount. |
GPT-5.2 Pro OpenAI | Proprietary | 10.11x (10.1x cost) | 6,300 | 992 | 7,900 | 7,900 | Pro reasoning. No prompt-cache discount. |
GPT-5.4 Pro OpenAI | Proprietary | 13.53x (13.5x cost) | 4,400 | 926 | 5,600 | 5,600 | Pro reasoning. No prompt-cache discount. |
GPT-5.5 Pro OpenAI | Proprietary | 13.53x (13.5x cost) | 4,400 | 926 | 5,600 | 5,600 | Top GPT pro tier. No prompt-cache discount. |