The best open LLMs for your use case:
Qwen's native multimodal MoE model with 397B total parameters and 17B active, featuring hybrid Gated Delta Networks for strong reasoning and vision capabilities.
Speed:
Intelligence:
Price: (1M Tokens)
$0.60 / 3.60Context: (tokens)
262,144Inputs:
Benchmarks:
Multilingual MMLU
Multilingual
MMLU-Pro
General Knowledge
AA-LCR
Summarization
LongBenchv2
Summarization
MMMU
Multimodal - Vision
TAU2-Bench
Agents and Function Calling
BFCL
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
Multilingual MMLU
Multilingual
MMLU-Pro
General Knowledge
AA-LCR
Summarization
LongBenchv2
Summarization
MMMU
Multimodal - Vision
TAU2-Bench
Agents and Function Calling
BFCL
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
Google's open multimodal model with strong multilingual coverage, 256K context, and text + image input.
Speed:
Intelligence:
Price: (1M Tokens)
$0.39 / 0.97Context: (tokens)
262,144Inputs:
Benchmarks:
Multilingual MMLU
Multilingual
MRCR 128k
Summarization
MMLU-Pro
General Knowledge
TAU2-Bench
Agents and Function Calling
LiveCodeBench
Coding Agents
MMMU-Pro
Multimodal - Vision
HLE
General Knowledge
GPQA-Diamond
General Knowledge
Multilingual MMLU
Multilingual
MRCR 128k
Summarization
MMLU-Pro
General Knowledge
TAU2-Bench
Agents and Function Calling
LiveCodeBench
Coding Agents
MMMU-Pro
Multimodal - Vision
HLE
General Knowledge
GPQA-Diamond
General Knowledge
Use case:
Multilingual
Features:
Long Context Handling