Alibaba
Qwen3.5 4B (Reasoning)
Quality Score16.6
Value Score22.0
Reliability20.8
Cache Discountnot available
Model specification
- Reasoning
- reasoning
- Input modalities
- text, image, video
- Output modalities
- text
- Context window
- 262,144 tokens
- Weights
- open weights
Token prices USD per 1M tokens
- Input
- $0.030
- Output
- $0.150
- Cached Input
- not available
- Cached Output
- not available
- Cost per task
- not available
Capability
- Intelligence
- 20.4
- Coding
- 22.6
- Agentic
- not available
- Omniscience
- -58.4
- Correct
- 15.1%
- Blended price
- $0.042
Answer outcomes
Correct 15.1%Incorrect 73.5%Abstained 11.4%
Artificial Analysis benchmarks
- τ³-Banking
- 7%
- Terminal-Bench v2.1
- 26%
- SciCode
- 16%
- Humanity’s Last Exam
- 10%
- GPQA Diamond
- 77%
- CritPt
- 0%
- AA-Omniscience
- 21%
- AA-LCR
- 61%
Similar models
- Qwen3.5 9B (Reasoning)AlibabaQuality Score 18.2Value Score 21.8
- Qwen3 Next 80B A3B (Reasoning)AlibabaQuality Score 15.5Value Score 17.5
- Qwen3 Omni 30B A3B (Reasoning)AlibabaQuality Score 10.0Value Score 10.5
- Qwen3.5 2B (Reasoning)AlibabaQuality Score 6.5Value Score not available
- Qwen3.5 122B A10B (Reasoning)AlibabaQuality Score 30.4Value Score 27.7
- Qwen3.5 9B (Non-reasoning)AlibabaQuality Score 15.3Value Score 19.6