10M-token context with MoE efficiency
Llama 4 Scout sets a record with its 10 million-token context window — enough to process entire large codebases in a single prompt. Its 16-expert MoE architecture makes it surprisingly efficient for its capability level.
Try Llama 4 ScoutSourced from official model cards and academic papers. Higher is better.