FFree
AlibabaOpen Weights

Qwen3.8 2.4T A95B

Qwen/Qwen3.8-2.4T-A95B

Best Input Price

$1.95 / 1M

Open-weight sparse MoE (2.4T total, 95B active), the open-weight twin of Qwen3.8 Max for coding, research, complex reasoning, and agentic workflows

Context Window

1,049,000 tokens

Reasoning

Supported

Tool Calling

Supported

Released

2026-08-12

Inference Providers (21)

ProviderModel IDContextInput / 1MOutput / 1MAction
IteraComputeqwen/qwen3.8-2.4t-a95b970,000$1.95$5.95Docs ↗
Deep InfraQwen/Qwen3.8-2.4T-A95B262,144$2.00$6.00Docs ↗
SiliconFlowQwen/Qwen3.8-2.4T-A95B1,049,000$2.00$6.00Docs ↗
LLM Gatewaydeepinfra/qwen3.8-2.4t-a95b262,144$2.00$6.00Docs ↗
Kilo Gatewayqwen/qwen3.8-2.4t-a95b1,000,000$2.00$6.00Docs ↗
OpenRouterqwen/qwen3.8-2.4t-a95b1,048,576$2.00$6.00Docs ↗
ModalQwen/Qwen3.8-2.4T-A95B1,010,000$2.00$6.00Docs ↗
Vercel AI Gatewayalibaba/qwen3.8-2.4t-a95b262,144$2.00$6.00Docs ↗
Charm Hyperqwen3.8-2.4t-a95b1,000,000$2.00$6.00Docs ↗
Fireworks AIaccounts/fireworks/models/qwen3p8-2p4t-a95b262,144$2.00$6.00Docs ↗
AIHubMixqwen3.8-2.4t-a95b262,000$2.00$6.00Docs ↗
Eden AIqwen/qwen3.8-2.4t-a95b1,000,000$2.00$6.00Docs ↗
DevPass (LLM Gateway)qwen3.8-2.4t-a95b1,010,000$2.00$6.00Docs ↗
RunInfraInferact/Qwen3.8-2.4T-A95B-NVFP4262,144$2.00$6.00Docs ↗
Venice AIqwen-3-8-2-4t-a95b262,144$2.50$7.50Docs ↗
Hugging FaceQwen/Qwen3.8-2.4T-A95B262,144$2.50$6.25Docs ↗
Merge Gatewayqwen/qwen3.8-2.4t-a95b262,144$2.50$6.25Docs ↗
Opperqwen3.8-2.4t-a95b262,144$2.50$6.00Docs ↗
TensorXqwen/qwen3.8-2.4t-a95b262,144$2.50$6.00Docs ↗
Requestyqwen3.8-2.4T-A95B@eu1,000,000$2.50$6.00Docs ↗
Cortecsqwen3.8-2.4t-a95b262,144$2.50$6.00Docs ↗