Simple ways to
start building.
Use the model API at published rates. Reserve dedicated compute with a quote shaped around your workload.
Find your model. See your rate.
Published prices in USD. Token prices below are per one million tokens; other models use their listed billing unit. Check the model's supported options before sending a request.
533 models
| Model | Type | Input / 1M tokens | Output / 1M tokens | Other billing unit |
|---|---|---|---|---|
Qwen: Qwen3.6 27Bqwen/qwen3.6-27b |
Language | $0.32 | $3.2 | Token based |
Qwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3b |
Language | $0.1 | $0.95 | Token based |
Qwen: Qwen3.6 Flashqwen/qwen3.6-flash |
Language | $0.1875 | $1.125 | Token based |
Qwen: Qwen3.6 Plusqwen/qwen3.6-plus |
Language | $0.325 | $1.95 | Token based |
Qwen: Qwen3.7 Flashqwen/qwen3.7-flash |
Language | $0.03 | $0.13 | Token based |
Qwen: Qwen3.7 Maxqwen/qwen3.7-max |
Language | $1.475 | $4.425 | Token based |
Qwen: Qwen3.7 Plusqwen/qwen3.7-plus |
Language | $0.32 | $1.28 | Token based |
Qwen: Qwen3.8 2.4T A95Bqwen/qwen3.8-2.4t-a95b |
Language | $2.0 | $6.0 | Token based |
Qwen: Qwen3.8 27Bqwen/qwen3.8-27b |
Language | $0.04 | $2.3 | Token based |
Qwen: Qwen3.8 Flashqwen/qwen3.8-flash |
Language | $0.15 | $0.47 | Token based |
Qwen: Qwen3.8 Max (0902)qwen/qwen3.8-max-0902 |
Language | $2.0 | $6.0 | Token based |
Qwen: Qwen3.8 Max Primeqwen/qwen3.8-max-prime |
Language | $4.0 | $12.0 | Token based |
Qwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flash |
Language | $0.15 | $0.47 | Token based |
Qwen: Qwen3 Coder 30B A3B Instructqwen/qwen3-coder-30b-a3b-instruct |
Language | $0.07 | $0.28 | Token based |
Qwen: Qwen3 Coder 480B A35Bqwen/qwen3-coder |
Language | $0.3 | $1.0 | Token based |
Qwen: Qwen3 Coder Flashqwen/qwen3-coder-flash |
Language | $0.195 | $0.975 | Token based |
Qwen: Qwen3 Coder Nextqwen/qwen3-coder-next |
Language | $0.12 | $0.8 | Token based |
Qwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instruct |
Language | $0.1 | $1.1 | Token based |
Qwen: Qwen3 Next 80B A3B Thinkingqwen/qwen3-next-80b-a3b-thinking |
Language | $0.15 | $1.2 | Token based |
Qwen: Qwen3 VL 235B A22B Instructqwen/qwen3-vl-235b-a22b-instruct |
Language | $0.21 | $1.9 | Token based |
Reported cached input tokens are billed at 10% of the published input rate. Model availability can change. Read the quickstart or open the catalog API (JSON).
Bring your own model.
A dedicated-compute option, custom quoted
Deploy private weights on Actaserve-owned infrastructure, subject to model, licence and runtime qualification. Bring your checkpoint and serving requirements so we can scope model bring-up.
Reserve capacityReady for your first call?
Explore the docs