Simple ways to
start building.
Use the model API at published rates. Reserve dedicated compute with a quote shaped around your workload.
Find your model. See your rate.
Published prices in USD. Token prices below are per one million tokens; other models use their listed billing unit. Check the model's supported options before sending a request.
533 models
| Model | Type | Input / 1M tokens | Output / 1M tokens | Other billing unit |
|---|---|---|---|---|
Qwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instruct |
Language | $0.15 | $0.6 | Token based |
Qwen: Qwen3 VL 30B A3B Thinkingqwen/qwen3-vl-30b-a3b-thinking |
Language | $0.29 | $1.0 | Token based |
Qwen: Qwen3 VL 8B Instructqwen/qwen3-vl-8b-instruct |
Language | $0.25 | $0.75 | Token based |
Qwen: Qwen-Plusqwen/qwen-plus |
Language | $0.26 | $0.78 | Token based |
Reka Edgerekaai/reka-edge |
Language | $0.1 | $0.1 | Token based |
Reka Flash 3rekaai/reka-flash-3 |
Language | $0.1 | $0.2 | Token based |
Relace: Relace Apply 3relace/relace-apply-3 |
Language | $0.85 | $1.25 | Token based |
Relace: Relace Searchrelace/relace-search |
Language | $1.0 | $3.0 | Token based |
ReMM SLERP 13Bundi95/remm-slerp-l2-13b |
Language | $0.35 | $0.65 | Token based |
Sakana: Fugu Maxsakana/fugu-max |
Language | $2.0 | $6.0 | Token based |
Sakana: Fugu Ultrasakana/fugu-ultra |
Language | $5.0 | $30.0 | Token based |
Sakana: Fugu Ultra v2sakana/fugu-ultra-v2 |
Language | $5.0 | $30.0 | Token based |
Sakana: Sakana Namazusakana/sakana-namazu |
Language | $0.95 | $4.0 | Token based |
Sao10K: Llama 3.1 Euryale 70B v2.2sao10k/l3.1-euryale-70b |
Language | $0.85 | $0.85 | Token based |
Sao10K: Llama 3.3 Euryale 70Bsao10k/l3.3-euryale-70b |
Language | $0.65 | $0.75 | Token based |
Sao10K: Llama 3 8B Lunarissao10k/l3-lunaris-8b |
Language | $0.04 | $0.05 | Token based |
SpaceXAI: Grok 4.20x-ai/grok-4.20 |
Language | $1.25 | $2.5 | Token based |
SpaceXAI: Grok 4.20 Multi-Agentx-ai/grok-4.20-multi-agent |
Language | $1.25 | $2.5 | Token based |
SpaceXAI: Grok 4.3x-ai/grok-4.3 |
Language | $1.25 | $2.5 | Token based |
SpaceXAI: Grok 4.3 (batch)x-ai/grok-4.3:batch |
Language | $1.0 | $2.0 | Token based |
Reported cached input tokens are billed at 10% of the published input rate. Model availability can change. Read the quickstart or open the catalog API (JSON).
Bring your own model.
A dedicated-compute option, custom quoted
Deploy private weights on Actaserve-owned infrastructure, subject to model, licence and runtime qualification. Bring your checkpoint and serving requirements so we can scope model bring-up.
Reserve capacityReady for your first call?
Explore the docs