✕
draft 158 cover

OpenAI lança GPT-6 e agente Astra: novo patamar de capacidade com preço de token 2,5x maior

22 de setembro de 2026
draft 166 cover

Collusion.wiki e o segundo incidente não divulgado de agent swarm da OpenAI

22 de setembro de 2026

Alibaba confirma que Qwen 4 está em treinamento, mas sem data de lançamento

22 de setembro de 2026

A Alibaba subiu ao palco da conferência Apsara nesta terça-feira (22 de setembro de 2026) para fazer o tipo de anúncio que costuma gerar mais dúvidas do que certezas: o Qwen 4 está em treinamento. A informação veio accompanied by menções a Qwen 4.5 e até Qwen 5, com a casa chinesa обещания entre 5 e 10 trilhões de parâmetros. Sem data. Sem tamanho confirmado.

O que a Alibaba disse (e o que não disse)

O anúncio aconteceu no palco do Apsara Conference, evento tradicional da Alibaba Cloud que funciona como vitrine estratégica para a empresa. O que se ouviu foi direto: a próxima iteração da família Qwen já está rodando em treinamento, e os números discutidos nos bastidores indicam uma escalada massiva de capacidade.

Parameters — nesse contexto, os pesos matemáticos e conexões neurais que definem a capacidade de um modelo de linguagem — entre 5 e 10 trilhões representariam um salto considerável mesmo para uma fronteira que já vem sendo empurrada por outros laboratórios. Mas a empresa não cravou nem o número exato, nem quando essa próxima geração chega ao mercado.

Por que importa agora

O Qwen se consolidou nos últimos anos como um dos pilares do ecossistema chinês de IA, competindo de frente com modelos abertos e proprietários lançados por outras big techs. Quando a Alibaba fala em "próxima geração", o restante da indústria presta atenção, porque o ritmo de更新 do Qwen costuma ditar parte do calendário competitivo chinês — e, por extensão, influencia lançamentos globais.

A menção simultânea a Qwen 4, Qwen 4.5 e Qwen 5 sugere uma estratégia de pipeline escalonado, com iterações intermediárias antes do salto geracional completo. É um movimento semelhante ao que outras labs vêm adotando para manter relevância entre marcos grandes.

O que ainda não sabemos

A falta de cronograma não é acidental. Anunciar que um modelo está "em treinamento" gera expectativa sem comprometer a empresa com uma janela de lançamento. Isso dá à Alibaba flexibilidade para acelerar ou ajustar conforme o cenário competitivo.

Tampouco ficou claro se os 5 a 10 trilhões de parâmetros citados se referem ao Qwen 4, ao 4.5 ou ao 5 — ou se cada um deles teria uma escala diferente. Sem detalhamento técnico, qualquer projeção de capacidade fica no campo da especulação.

O contexto mais amplo

A indústria entrou em 2026 discutindo abertamente o teto prático de escala dos LLMs (Large Language Models, ou grandes modelos de linguagem). Laboratórios como os EUA e a China seguem caminhos distintos: alguns apostam em modelos densos cada vez maiores, enquanto outros migram para arquiteturas Mixture of Experts (MoE — sistemas que dividem o trabalho entre "especialistas" neurais e ativam apenas parte dos pesos em cada consulta, ganhando eficiência). A Alibaba historicamente já explorou ambas as abordagens.

O silêncio sobre a arquitetura do Qwen 4 deixa em aberto qual rota a empresa seguirá.

Por que acompanhar de perto

Mesmo sem data, o anúncio importa por três motivos práticos:

  • Sinaliza intenção competitiva da Alibaba num momento em que múltiplos players anunciam novas gerações.
  • Indica que a fronteira de parâmetros continua subindo, contrariando expectativas de platô.
  • Mantém o Qwen como referência para quem acompanha open weights chineses — modelos cujos pesos são publicamente distribuídos e podem ser executados localmente.

A conferir nos próximos meses se o treinamento vira release.


Fonte consultada: https://cellcog.ai/blog/qwen-4-release-date/

Topics:
Read next
25 de setembro de 2026

Decodificação Especulativa DFlash na AMD Instinct MI355X: Inferência do Qwen3.5 até 5 vezes mais rápida

Post técnico da AMD demonstra DFlash, um drafter block-diffusion rodando via vLLM no ROCm, batendo de frente com o MTP nativo do Qwen3.5 e ainda empilhando quantização mxfp4.
25 de setembro de 2026

Qwen2.5-Omni: o modelo multimodal que enxerga, escuta e fala em tempo real

A Alibaba liberar Qwen2.5-Omni, um modelo end-to-end que processa texto, imagem, áudio e vídeo e devolve respostas em texto e fala natural com streaming. Veja o que muda na corrida multimodal.
25 de setembro de 2026

Qwen2.5-VL-32B: a Alibaba aperta o parafuso em modelos multimodais leves

Alibaba open-sourcing o Qwen2.5-VL-32B-Instruct sob Apache 2.0, com escala de 32B de parametros e foco em visao-linguagem. O que muda frente a geracao anterior e por que o tamanho importa.