IA

O modelo de IA da Alibaba custa US$ 2 por milhão de tokens — pesos abertos chegam em 10 de agosto

Adrian Kessler

Um modelo de IA com 2,4 trilhões de parâmetros acaba de chegar ao mercado a US$ 2 por milhão de tokens de entrada e US$ 6 para saída. Ele roda em uma arquitetura esparsa de mixture-of-experts que mantém os custos por token baixos ao ativar apenas 95 bilhões de parâmetros por vez, mantendo o restante ocioso. O modelo é o Qwen 3.8 Max, e vem da Alibaba.

A diferença de preço em relação aos principais modelos dos EUA é gritante. O Qwen 3.8 Max apresenta resultados competitivos em vários benchmarks padrão: 93,0 no PaperBench e 86,1 no OSWorld-Verified, colocando-o acima do Fable 5 e do GPT-5.6 Sol nessas métricas específicas. Sua janela de contexto chega a um milhão de tokens — aproximadamente um milhão de palavras de entrada em um único prompt — o que cobre análise de documentos longos, bases de código extensas e cadeias de raciocínio prolongadas. O modelo também é multimodal, aceitando imagens e vídeo junto com texto, em um nível de preço que era exclusivo de modelos proprietários há um ano.

O desenvolvimento mais consequente pode ser o que a Alibaba prometeu para a próxima semana. A empresa afirma que liberará os pesos do modelo publicamente, o que significa que qualquer equipe com infraestrutura computacional suficiente poderá executar o Qwen 3.8 Max localmente sem taxas de API, sem enviar dados para um servidor da Alibaba e sem um acordo de uso. Esse compromisso, se cumprido no prazo, colocaria um modelo de 2,4 trilhões de parâmetros nas mãos de quem faz self-hosting pela primeira vez. A Alibaba também está liberando um checkpoint menor, de 27 bilhões de parâmetros, para organizações com poder computacional mais limitado.

As ressalvas são reais. No leaderboard Chatbot Arena, focado em texto, o Qwen 3.8 Max ocupa o quinto lugar — atrás de quatro modelos da linha atual da Anthropic. No SWE-bench Pro, a avaliação de agentes de código que mais importa para equipes empresariais de IA, ele marca 67,7 contra 80,0 do Fable 5. A liberação dos pesos abertos está prometida para a semana de 10 de agosto, mas até o momento desta publicação nenhum peso apareceu no Hugging Face ou no ModelScope. Para organizações que lidam com requisitos de residência de dados na UE ou regras de controle de exportação dos EUA, o Qwen 3.8 Max carrega as mesmas questões de jurisdição que têm acompanhado outros modelos de laboratórios chineses.

A janela de 10 de agosto para a liberação pública dos pesos é o primeiro marco definitivo. Se a Alibaba entregar, a estrutura de custos da inferência de IA de fronteira cai substancialmente para qualquer equipe disposta a rodar sua própria infraestrutura. Se a liberação atrasar ou chegar com restrições, o preço de US$ 2 pela API ainda o torna um dos modelos de fronteira mais agressivamente precificados atualmente disponíveis.

Tags: , , , , ,

Discussão

Há 0 comentários.