The best open LLMs for your use case:
1T-parameter MoE flagship from Moonshot with long-horizon coding, agent swarms scaling to 300 sub-agents, and state-of-the-art reasoning.
Speed:
Intelligence:
Price: (1M Tokens)
$1.20 / 4.50Cached input: (1M Tokens)
$0.20Context: (tokens)
262,144Inputs:
Benchmarks:
EQBench
Creative Writing
SciCode
Coding Agents
MCP-Mark
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
Apex Agents
Agents and Function Calling
FrontierCode
Coding Agents
LiveCodeBench
Coding Agents
Terminal-Bench 2.0
Coding Agents
EQBench
Creative Writing
SciCode
Coding Agents
MCP-Mark
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
Apex Agents
Agents and Function Calling
FrontierCode
Coding Agents
LiveCodeBench
Coding Agents
Terminal-Bench 2.0
Coding Agents
Qwen's native multimodal MoE model with 397B total parameters and 17B active, featuring hybrid Gated Delta Networks for strong reasoning and vision capabilities.
Speed:
Intelligence:
Price: (1M Tokens)
$0.60 / 3.60Context: (tokens)
262,144Inputs:
Benchmarks:
MMLU-Pro
General Knowledge
AA-LCR
Summarization
LongBenchv2
Summarization
Multilingual MMLU
Multilingual
MMMU
Multimodal - Vision
TAU2-Bench
Agents and Function Calling
BFCL
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
MMLU-Pro
General Knowledge
AA-LCR
Summarization
LongBenchv2
Summarization
Multilingual MMLU
Multilingual
MMMU
Multimodal - Vision
TAU2-Bench
Agents and Function Calling
BFCL
Agents and Function Calling
MMMU-Pro
Multimodal - Vision
Use case:
Creative Writing
Features:
Long Context Handling