O modelo chinês que derrubou o Claude no terminal
A Alibaba lançou o Qwen 3.6 Plus silenciosamente no OpenRouter e o benchmark que mais importa para devs agentic mudou de dono. Com 1 milhão de tokens de contexto, arquitetura híbrida MoE e pesos abert
A Alibaba lançou o Qwen 3.6 Plus silenciosamente no OpenRouter e o benchmark que mais importa para devs agentic mudou de dono. Com 1 milhão de tokens de contexto, arquitetura híbrida MoE e pesos abertos, ele entrega mais velocidade e menos custo do que qualquer frontier model ocidental. Aqui está o que os números realmente mostram.
Os benchmarks que importam de verdade
No Terminal-Bench 2.0, que testa operações reais de shell, gerenciamento de processos e workflows multi-etapa, o Qwen 3.6 Plus marca 61.6% contra 59.3% do Claude 4.5 Opus. No OmniDocBench v1.5 ele lidera com 91.2 e no RealWorldQA dispara para 85.4 contra 77.0 do Claude. A exceção é o SWE-bench Verified, onde Claude ainda segura 80.8% contra 78.8% do Qwen, uma diferença de apenas 2 pontos.

Arquitetura e velocidade: o que muda na prática
O Qwen 3.6 Plus usa uma arquitetura híbrida que combina atenção linear eficiente com roteamento sparse MoE, permitindo uma janela de contexto nativa de 1 milhão de tokens sem o custo quadrático de memória da atenção padrão. O resultado em velocidade é concreto: 158 tokens por segundo na mediana, contra ~52 tok/s do Claude Opus 4.6, aproximadamente 3× mais rápido. O raciocínio chain-of-thought está sempre ativo e foi calibrado para ser mais decisivo do que no Qwen 3.5, reduzindo o problema de overthinking em tarefas simples.

O pivot closed-source e o que ele revela
Pela primeira vez, um modelo flagship da Alibaba chegou sem pesos públicos, apenas via API. Esse movimento sinaliza que os labs chineses não precisam mais subsidiar o ecossistema global com open-weights para ganhar relevância. Ao mesmo tempo, o checkpoint open-weight Qwen3.6-35B-A3B foi lançado sob Apache 2.0 com apenas 3B de parâmetros ativos de 35B totais, rodando em hardware consumer e marcando 73.4% no SWE-bench Verified contra 52.0% do Gemma 4-31B, o rival open-weight mais próximo.

O que você deve fazer agora
Use este checklist para integrar o Qwen 3.6 Plus de forma inteligente no seu stack.
