terça-feira, 1 de setembro de 2026 📬 Resumo no TelegramPortaisSobre🌓
🇧🇷 BR ▾
ÚLTIMAS
Tecnologia

Meta lança IA que transcreve conversas em tempo real e muito mais

Olhar Digital ·
Meta lança IA que transcreve conversas em tempo real e muito mais

A Meta apresentou nesta terça-feira (1) o Muse Voice Transcribe, seu primeiro modelo de inteligência artificial (IA) voltado à percepção de áudio em tempo real.

A tecnologia consegue transcrever conversas enquanto elas acontecem, distinguir quem está falando e lidar com mais de 20 pessoas simultaneamente.

O modelo foi desenvolvido pelo Meta Superintelligence Labs (MSL) e também consegue trabalhar com diferentes idiomas em uma mesma conversa.

Segundo a empresa, ele foi treinado com mais de 70 idiomas , sendo que 25 deles foram amplamente validados para o lançamento.

Muse Voice Transcribe is MSL's first real-time audio perception model — rolling out today.

SOTA in streaming speech-to-text, it handles speaker diarization, and endpointing natively in a single model. pic.twitter.com/LViMDSkbim — Mark Zuckerberg (@finkd) September 1, 2026 Uma das características mais interessantes do Muse Voice Transcribe é a capacidade de realizar o chamado code-switching, quando uma pessoa alterna entre idiomas durante uma conversa.

A tecnologia consegue reconhecer essa mudança mesmo no meio de uma frase.

Em uma demonstração divulgada pela Meta, oito pessoas conversam simultaneamente e o sistema consegue identificar cada participante e associar corretamente suas falas.

A IA também consegue lidar com interrupções, sobreposição de vozes e diferentes sotaques.

A tecnologia combina três funções principais em um único modelo: reconhecimento automático de fala em fluxo contínuo (ASR, na sigla em inglês), identificação dos diferentes participantes da conversa, conhecida como speaker diarization, e identificação dos momentos em que uma fala começa ou termina.

Leia mais: Zuckerberg quer que TikTok e YouTube sigam novas regras para adolescentes impostas à Meta Meta corrige falha de privacidade em óculos inteligentes e tenta impedir gravação indevida Dez anos depois, startup acusa Meta de roubar ideia que virou o Instagram Shopping Modelo também consegue trabalhar com diferentes idiomas em uma mesma conversa – Imagem: Reprodução/Meta IA decide quanto tempo deve ouvir O Muse Voice Transcribe processa o áudio em blocos de 80 milissegundos.

A cada novo trecho, o modelo decide se deve continuar ouvindo ou começar a produzir o texto; A Meta chama esse mecanismo de “atraso adaptativo”.

Na prática, a IA pode esperar um pouco mais quando encontra uma palavra difícil e produzir a transcrição mais rapidamente quando identifica uma palavra simples; A estratégia busca equilibrar velocidade e precisão.

Ler a notícia completa no Olhar Digital ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em olhardigital.com.br — o conteúdo pertence a Olhar Digital.

Mais de Olhar Digital

Ver tudo ›

Mais em Tecnologia

Ver tudo ›