Google Lança Gemini 3.5 Transcribe, Seu Modelo Mais Preciso
O sistema identifica mais de 85 idiomas sozinho, distingue até três vozes com marcação de tempo e processa áudio ao vivo 70% mais rápido que o Chirp 3.
- Transcrição em tempo real erra em média 4,0% das palavras, a gravada cai para 2,6%, segundo a Artificial Analysis.
- Duas APIs distintas: gemini-3.5-transcribe-live para tempo real, gemini-3.5-transcribe para áudio gravado.
- Agora, LiveKit, LangChain, Vercel e Pipecat já testam os modelos como parceiros iniciais.
Por que importa: Uma máquina que nunca esquece o que ouve transforma cada conversa em registro permanente nas mãos do Google.