A Qwen lançou no último domingo, 2, o seu modelo de linguagem mais avançado. Batizado como Qwen Max 3.8, o LLM foi feito para atuar em longas tarefas (por vários dias) e como um agente autônomo, o que é baseado em dois pilares:
- Otimização sustentável de longo horizonte – o agente não se perde e não muda o foco, mas mantém a tarefa e até pode reescrever por vários dias até atingir o objetivo;
- Melhoria em circuito fechado baseado em feedback – o agente aprende testando de forma automatizada em um ciclo de criar, testar, analisar e corrigir, sem precisar de intervenção humana.
A empresa de IA apresentou uma prova com um agente rodando atividades de codificação em 16 dias até a entrega do projeto. Nesse período, a IA criou projetos do zero, corrigiu erros, adicionou melhorias, leu um artigo científico e recriou o código baseado na informação, testou 18 versões até encontrar a ideal.
Entre os casos de uso testados estão:
- Design de chip de computador;
- Gerenciamento de uma loja de e-commerce em uma simulação acelerada de um ano, o que inclui negociação de preço com fornecedores, e tomada de decisões de estocagem de produtos;
- Execução de tarefas de profissionais, como criar 26 menus em um restaurante no lugar de um chefe de cozinha, ou reconstruir a planta de um prédio de 30 andares em substituição a um engenheiro civil.
Disponibilidade do Qwen Max 3.8
Como um modelo de código aberto e baseado na versão 3.5, Qwen Max 3.8 funciona de forma multimodal (texto, voz, imagem e vídeo). Inicialmente, o LLM está disponível para integração com agentes ou assistentes de código via QwenCloud, a plataforma de computação em nuvem da empresa de IA que possui compatibilidade com Anthropic, Codex e OpenClaw.
A companhia informou que adicionará o LLM nas próximas semanas nas plataformas Hugging Face e ModelScope.
O modelo tem 2,4 trilhões de parâmetros, mas apenas 95 bilhões são ativos, em um formato de Mixture of Experts (MoE), uma arquitetura inteligente feita para ter o conhecimento dos 2,4 trilhões, mas com o consumo de apenas 95 bilhões. Ou seja, o MoE traz mais velocidade, eficiência e grande capacidade, com um custo pequeno.