Simple ways to
start building.
Use the model API at published rates. Reserve dedicated compute with a quote shaped around your workload.
Find your model. See your rate.
Published prices in USD. Token prices below are per one million tokens; other models use their listed billing unit. Check the model's supported options before sending a request.
544 models
| Model | Type | Input / 1M tokens | Output / 1M tokens | Other billing unit |
|---|---|---|---|---|
DeepSeek: DeepSeek V4 Pro 0813deepseek/deepseek-v4-pro-0813 |
Language | $0.66 | $1.98 | Token based |
DeepSeek: R1deepseek/deepseek-r1 |
Language | $0.7 | $2.5 | Token based |
DeepSeek: R1 0528deepseek/deepseek-r1-0528 |
Language | $0.5 | $2.15 | Token based |
Dots Studio: Dots3-Note Preview (free)dots-studio/dots-3-note-preview:free |
Language | $0.0 | $0.0 | Token based |
Fireworks: Ember-1fireworks/ember-1 |
Language | $3.0 | $15.0 | Token based |
Google: Gemini 2.5 Flashgoogle/gemini-2.5-flash |
Language | $0.3 | $2.5 | Token based |
Google: Gemini 2.5 Flash (batch)google/gemini-2.5-flash:batch |
Language | $0.15 | $1.25 | Token based |
Google: Gemini 2.5 Flash Litegoogle/gemini-2.5-flash-lite |
Language | $0.1 | $0.4 | Token based |
Google: Gemini 2.5 Flash Lite (batch)google/gemini-2.5-flash-lite:batch |
Language | $0.05 | $0.2 | Token based |
Google: Gemini 2.5 Progoogle/gemini-2.5-pro |
Language | $1.25 | $10.0 | Token based |
Google: Gemini 2.5 Pro (batch)google/gemini-2.5-pro:batch |
Language | $0.625 | $5.0 | Token based |
Google: Gemini 2.5 Pro Preview 06-05google/gemini-2.5-pro-preview |
Language | $1.25 | $10.0 | Token based |
Google: Gemini 3.1 Flash Litegoogle/gemini-3.1-flash-lite |
Language | $0.25 | $1.5 | Token based |
Google: Gemini 3.1 Flash Lite (batch)google/gemini-3.1-flash-lite:batch |
Language | $0.125 | $0.75 | Token based |
Google: Gemini 3.1 Flash Lite Previewgoogle/gemini-3.1-flash-lite-preview |
Language | $0.25 | $1.5 | Token based |
Google: Gemini 3.1 Pro Previewgoogle/gemini-3.1-pro-preview |
Language | $2.0 | $12.0 | Token based |
Google: Gemini 3.1 Pro Preview (batch)google/gemini-3.1-pro-preview:batch |
Language | $1.0 | $6.0 | Token based |
Google: Gemini 3.1 Pro Preview Custom Toolsgoogle/gemini-3.1-pro-preview-customtools |
Language | $2.0 | $12.0 | Token based |
Google: Gemini 3.5 Flashgoogle/gemini-3.5-flash |
Language | $1.5 | $9.0 | Token based |
Google: Gemini 3.5 Flash (batch)google/gemini-3.5-flash:batch |
Language | $0.75 | $4.5 | Token based |
Reported cached input tokens are billed at 10% of the published input rate. Model availability can change. Read the quickstart or open the catalog API (JSON).
Bring your own model.
A dedicated-compute option, custom quoted
Deploy private weights on Actaserve-owned infrastructure, subject to model, licence and runtime qualification. Bring your checkpoint and serving requirements so we can scope model bring-up.
Reserve capacityReady for your first call?
Explore the docs