Qwen3 VL 32B Thinking
MultimodalQwen3-VL is a large multimodal model combining vision, language, and reasoning to achieve human-level perception and cognitive abilities. The 33B parameter Thinking version leads in multimodal reasoning and STEM tasks with OCR support, video understanding, and agentic interaction.
Key Specifications
Parameters
33.0B
Context
-
Release Date
September 21, 2025
Average Score
74.6%
Timeline
Key dates in the model's history
Announcement
September 21, 2025
Last Update
February 17, 2026
Today
September 10, 2026
Technical Specifications
Parameters
33.0B
Training Tokens
-
Knowledge Cutoff
-
Family
-
Capabilities
MultimodalZeroEval
Benchmark Results
Model performance metrics across various tests and benchmarks
General Knowledge
Tests on general knowledge and understanding
MMLU
Self-reported by the model provider • Self-reported
Reasoning
Logical reasoning and analysis
GPQA
Self-reported by the model provider • Self-reported
Multimodal
Working with images and visual data
AI2D
TEST • Self-reported
Other Tests
Specialized benchmarks
OCRBench
• Self-reported
MM-MT-Bench
• Self-reported
DocVQAtest
• Self-reported
ScreenSpot
• Self-reported
MMLU-Redux
• Self-reported
MMBench-V1.1
EN_V1.1 • Self-reported
AIME 2025
Self-reported by the model provider • Self-reported
AndroidWorld_SR
Self-reported by the model provider • Self-reported
Arena-Hard v2
Self-reported by the model provider • Self-reported
BFCL-v3
Self-reported by the model provider • Self-reported
BLINK
Self-reported by the model provider • Self-reported
CharadesSTA
Self-reported by the model provider • Self-reported
CharXiv-D
Self-reported by the model provider • Self-reported
CharXiv-R
Self-reported by the model provider • Self-reported
Creative Writing v3
Self-reported by the model provider • Self-reported
ERQA
Self-reported by the model provider • Self-reported
Hallusion Bench
Self-reported by the model provider • Self-reported
IFEval
Self-reported by the model provider • Self-reported
Include
Self-reported by the model provider • Self-reported
InfoVQAtest
Self-reported by the model provider • Self-reported
LiveBench 20241125
Self-reported by the model provider • Self-reported
LiveCodeBench v6
Self-reported by the model provider • Self-reported
LVBench
Self-reported by the model provider • Self-reported
MathVision
Self-reported by the model provider • Self-reported
MathVista-Mini
testmini • Self-reported
MMLU-Pro
Self-reported by the model provider • Self-reported
MMLU-ProX
Self-reported by the model provider • Self-reported
MMMU-Pro
full • Self-reported
MMMU (val)
Self-reported by the model provider • Self-reported
MMStar
Self-reported by the model provider • Self-reported
MuirBench
Self-reported by the model provider • Self-reported
Multi-IF
Self-reported by the model provider • Self-reported
MVBench
Self-reported by the model provider • Self-reported
OCRBench-V2 (en)
Self-reported by the model provider • Self-reported
OCRBench-V2 (zh)
Self-reported by the model provider • Self-reported
OSWorld
Self-reported by the model provider • Self-reported
PolyMATH
Self-reported by the model provider • Self-reported
RealWorldQA
Self-reported by the model provider • Self-reported
ScreenSpot Pro
Self-reported by the model provider • Self-reported
SimpleQA
Self-reported by the model provider • Self-reported
SuperGPQA
Self-reported by the model provider • Self-reported
VideoMME w/o sub.
Self-reported by the model provider • Self-reported
VideoMMMU
Self-reported by the model provider • Self-reported
WritingBench
Self-reported by the model provider • Self-reported
License & Metadata
License
apache-2.0
Announcement Date
September 21, 2025
Last Updated
February 17, 2026
Similar Models
All ModelsQwen3.6-27B
Alibaba
MM27.8B
Best score:0.9 (GPQA)
Released:Apr 2026
Price:$0.60/1M tokens
Qwen3.6-35B-A3B
Alibaba
MM35.0B
Best score:0.9 (GPQA)
Released:Apr 2026
Qwen3.8-27B
Alibaba
MM27.8B
Best score:0.9 (GPQA)
Released:Aug 2026
Qwen2-VL-72B-Instruct
Alibaba
MM73.4B
Released:Aug 2024
Qwen2.5 VL 72B Instruct
Alibaba
MM72.0B
Released:Jan 2025
QvQ-72B-Preview
Alibaba
MM73.4B
Released:Dec 2024
Qwen3.5-4B
Alibaba
MM4.0B
Best score:0.8 (GPQA)
Released:Mar 2026
Qwen2.5 VL 32B Instruct
Alibaba
MM33.5B
Best score:0.9 (HumanEval)
Released:Feb 2025
Recommendations are based on similarity of characteristics: developer organization, multimodality, parameter size, and benchmark performance. Choose a model to compare or go to the full catalog to browse all available AI models.