AIPortal da AILer artigos
Portal da AI

Alibaba lança Qwen-Audio 3.1 e corta preço de APIs de voz em até 95%

Por Bruno Danello23 de setembro de 2026

A equipe do Qwen, da Alibaba, lançou o Qwen-Audio 3.1, nova geração de modelos de áudio que evolui as três frentes principais da linha: reconhecimento de fala (ASR), síntese de voz (TTS) e interação de voz em tempo real. Junto com o lançamento, a empresa cortou drasticamente o preço das APIs correspondentes.

Corte de preço e novos modelos

Segundo a Alibaba, o preço da API de reconhecimento de fala caiu até 95%, o de síntese de voz (TTS) cerca de 70%, e o do modelo de voz em tempo real (Realtime) cerca de 85%. A linha ganhou dois modelos inéditos: o Qwen-Audio-3.1-TTS-Next, voltado à criação de voz, efeitos sonoros e áudio de fundo numa única passagem, e o Qwen-Audio-3.1-ASR-Next, de compreensão de áudio, capaz de identificar múltiplos falantes com marcação de tempo, detectar emoção na fala e reconhecer som ambiente.

Para quem usa IA de voz no dia a dia

Cortes de preço dessa magnitude tendem a baixar o custo de produtos que dependem de transcrição, dublagem ou narração automatizada em escala — o mesmo tipo de ferramenta que já discutimos em IA para áudio: criar podcasts e narrações profissionais.

Por que isso importa

O movimento acirra a disputa por modelos de áudio cada vez mais baratos e capazes entre grandes provedores de IA, num momento em que ferramentas de voz sintética ganham espaço em atendimento ao cliente, criação de conteúdo e produtos de acessibilidade — mas também alimentam preocupações sobre uso indevido de clonagem de voz, reforçando a importância de mecanismos claros de consentimento e rastreabilidade à medida que esse tipo de tecnologia fica mais barato e acessível.

Fonte original: Alibaba Cloud
Publicidade