Qwen3.5-397B-A17B
Qwen3.5-397B-A17B is Qwen's flagship Mixture-of-Experts model with 397 billion total parameters and 17 billion activated parameters. It delivers state-of-the-art performance across knowledge, reasoning, coding, mathematics, multilingual understanding, instruction following, long context, and agent tasks.
| Provider | Status | Input | Output | Limits | Uptime | Speed | Notes |
|---|---|---|---|---|---|---|---|
| Alibaba | available | $0.39/Mtok | $2.34/Mtok | 262K tokens context | 99.8% | 1,116 ms p50 TTFT | |
| Chutes | available | $0.45/Mtok | $3.00/Mtok | 262K tokens context | 99.9% | 2,259 ms p50 TTFT | fp8 |
| DeepInfra | available | $0.45/Mtok | $3.00/Mtok | 262K tokens context | 100.0% | 1,420 ms p50 TTFT | fp8 |
| Parasail | available | $0.50/Mtok | $3.60/Mtok | 262K tokens context | 100.0% | 1,260 ms p50 TTFT | fp8 |
| AtlasCloud | available | $0.55/Mtok | $3.50/Mtok | 262K tokens context | 99% | 2,057 ms p50 TTFT | fp8 |
| Phala | available | $0.55/Mtok | $3.50/Mtok | 262K tokens context | 99.9% | 2,765 ms p50 TTFT | |
| Novita | available | $0.60/Mtok | $3.60/Mtok | 262K tokens context | 99% | 2,351 ms p50 TTFT | |
| Venice | available | $0.75/Mtok | $4.50/Mtok | 128K tokens context | — | 1,456 ms p50 TTFT | |
| DigitalOcean | -5 | $0.39/Mtok | $2.45/Mtok | 131K tokens context | 3% | — | |
| GMICloud | -5 | $0.60/Mtok | $3.60/Mtok | 262K tokens context | — | — | fp8 |
| StreamLake | -2 | $0.60/Mtok | $3.60/Mtok | 256K tokens context | 89% | 2,657 ms p50 TTFT |