Alibaba lança o Qwen3.8-Omni-Flash, multimodal com 1 milhão de tokens de contexto
A equipe Qwen, da Alibaba, lançou o Qwen3.8-Omni-Flash, modelo multimodal nativo que processa texto, imagens, áudio e vídeo num só fluxo, com janela de contexto de 1 milhão de tokens. Ele está disponível na plataforma Qwen AI.
Segundo a Alibaba, o modelo melhorou sua pontuação média em mais de 26% em 30 avaliações em relação ao Qwen3.5-Omni-Plus, com ganhos em agentes de áudio e vídeo, programação, tarefas de contexto longo e interação multimodal em tempo real. A empresa cita usos como análise de vídeos longos, resumos de reuniões e pesquisa em vídeo, e lançou também ferramentas para fluxos longos e em tempo real.
Produto disponível
Modelo disponível na plataforma da empresa; ganhos informados pela própria Alibaba.
Critério: Qualquer pessoa pode usar hoje (pago ou grátis).
Fontes originais
Resumo escrito com palavras próprias a partir destas fontes. Nenhum trecho é reproduzido.
O que muda pra você
- Dev
- Contexto de 1 milhão de tokens com vídeo permite analisar reuniões e gravações inteiras numa chamada.
- PM
- Resumo de reuniões e análise de vídeo viram recursos baratos com modelos multimodais rápidos.
- Executivo
- Modelos chineses competem em multimodalidade e contexto longo a preço baixo.
- Investidor
- A Alibaba mantém ritmo intenso de lançamentos para monetizar sua nuvem.
- Educador
- Exemplo de modelo que entende vídeo e áudio, não só texto.