Alibaba lança Qwen3.8-Omni-Flash, modelo multimodal com 1 milhão de tokens de contexto
A nova versão do Qwen processa texto, imagem, áudio e vídeo em um único fluxo, com janela de contexto de até 1 milhão de tokens — suficiente para até uma hora de áudio e vídeo contínuos. Em cerca de 30 avaliações, o modelo superou o antecessor Qwen3.5-Omni-Plus em mais de 26% na média, além de custar até 98% menos para processar áudio. O modelo já está disponível via API na QwenCloud e no Alibaba Cloud Model Studio, mas os pesos ainda não foram abertos.
Fonte: TechNode