Qwen3.5-35B-A3B
Qwen3.5-35B-A3B is a multimodal Mixture-of-Experts model with 35 billion total parameters and 3 billion activated parameters. It combines strong reasoning, coding, agentic, and visual understanding performance with production-friendly efficiency and a native 262K context window.
| Provider | Status | Input | Output | Limits | Uptime | Speed | Notes |
|---|---|---|---|---|---|---|---|
| AkashML | available | $0.14/Mtok | $1.00/Mtok | 262K tokens context | 100.0% | 830 ms p50 TTFT | fp8 |
| DeepInfra | available | $0.14/Mtok | $1.00/Mtok | 262K tokens context | 100.0% | 486 ms p50 TTFT | fp8 |
| Parasail | available | $0.15/Mtok | $1.00/Mtok | 262K tokens context | 100.0% | 1,889 ms p50 TTFT | fp8 |
| Alibaba | available | $0.16/Mtok | $1.30/Mtok | 262K tokens context | 100.0% | 618 ms p50 TTFT | |
| AtlasCloud | available | $0.22/Mtok | $1.80/Mtok | 262K tokens context | 100.0% | 2,646 ms p50 TTFT | fp8 |
| NextBit | available | $0.23/Mtok | $1.60/Mtok | 262K tokens context | 100.0% | 1,948 ms p50 TTFT | fp8 |
| SiliconFlow | available | $0.24/Mtok | $1.80/Mtok | 262K tokens context | 96% | 4,802 ms p50 TTFT | fp8 |
| WandB | available | $0.25/Mtok | $1.25/Mtok | 262K tokens context | 99% | 924 ms p50 TTFT | fp8 |
| Venice | available | $0.31/Mtok | $1.25/Mtok | 256K tokens context | 100.0% | 3,122 ms p50 TTFT |