Pular para o conteúdo
    Notícia

    Qwen 4 está em treinamento: Alibaba confirma modelo e projeta até 10 trilhões de parâmetros

    Alibaba oficializa a existência do Qwen 4 na conferência Apsara, detalha roadmap para modelos trilionários e esclarece o status real de desenvolvimento.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    7 de out. de 2026 · 3 min de leitura

    Seguir no Google
    Corredor monumental de data center de alta densidade com fileiras de racks pretos foscos em perspectiva profunda, tubulações de resfriamento líquido metálicas e iluminação sutil em tons de azul e âmbar sobre piso perfurado.
    Infraestrutura avançada de supercomputação e resfriamento líquido para o treinamento de modelos de linguagem de escala trilionária.

    A Alibaba subiu ao palco para confirmar o modelo mais aguardado de sua história recente sem entregar uma única linha de código. Durante a abertura da conferência Apsara, em Hangzhou, a gigante chinesa encerrou especulações ao admitir formalmente a existência do Qwen 4. O modelo existe, mas ninguém fora dos servidores internos da empresa pode utilizá-lo. Não há links para download, arquivos técnicos disponíveis ou dia marcado no calendário. A confirmação oficial resume-se a uma declaração direta: a nova geração está em fase ativa de treinamento.

    A expectativa da comunidade técnica vinha sendo alimentada por vazamentos que sugeriam uma estreia pronta para uso em setembro. Fóruns de desenvolvedores e plataformas de previsão chegaram a projetar probabilidades elevadas para a chegada imediata dos arquivos. Essa expectativa encontrou um freio técnico. Liu Dayiheng, líder do projeto Qwen, explicou que o desenvolvimento adota uma arquitetura reformulada. A equipe promete uma liberação pública rápida, mas evitou estipular prazos fechados.

    Uma amostra preliminar dessa estrutura interna já havia sido distribuída no fim de agosto sob o nome de Qwen 3.8-Flash-Next. Esse lançamento experimental serviu de teste prático para os alicerces que sustentarão o modelo definitivo. Os parâmetros, que funcionam como conexões matemáticas que definem a capacidade de aprendizado de uma inteligência artificial, ainda não foram divulgados para o novo sistema. O maior modelo mantido em operação pela companhia hoje alcança 2,4 trilhões de parâmetros no total, com 95 bilhões ativados durante as respostas.

    O anúncio oficial estabeleceu quatro categorias para a futura família: a variante Flash para processamento rápido de grandes volumes, a versão Plus equilibrada para múltiplos formatos de conteúdo, a edição Max projetada para disputar o topo do mercado e um modelo de 27 bilhões de parâmetros distribuído em pesos abertos. Pesos abertos indicam que o arquivo do modelo pode ser baixado e executado em computadores próprios, sem depender dos servidores da Alibaba. Nenhuma dessas quatro opções recebeu especificações técnicas detalhadas ou preços de operação.

    Essa movimentação compõe um plano de longo prazo delineado pelo diretor-executivo Eddie Wu. Nas projeções para as gerações seguintes, identificadas como Qwen 4.5 e Qwen 5, a Alibaba planeja treinar sistemas que variam entre 5 trilhões e 10 trilhões de parâmetros. Para fornecer sustentação física a esse volume de processamento, a divisão de semicondutores T-Head apresentou o acelerador Zhenwu V900. O chip conta com 216 gigabytes de memória dedicada e taxa de transferência de 1.200 gigabytes por segundo, entregando o triplo do desempenho do chip anterior da linha.

    A fabricação comercial desse processador está programada para o primeiro trimestre de 2027. Em paralelo, a divisão de computação em nuvem estabeleceu como meta ultrapassar 20 gigawatts em capacidade operacional energética até 2032. Trata-se de uma escala industrial contínua: um chip especializado, uma infraestrutura elétrica massiva, um modelo intermediário e sistemas que alcançam a escala dos trilhões.

    A estratégia consolida uma situação peculiar. A empresa que construiu prestígio técnico global ao distribuir ferramentas acessíveis agora ancora suas promessas em sistemas que o público não pode tocar. O plano desenha metas ambiciosas para os próximos anos, enquanto o momento exato em que o usuário comum poderá executar o Qwen 4 continua reservado aos laboratórios da companhia.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    Ver perfil completo