News, Fast

Atom Brief

26 авг. 2026 г. · Архив
Tech

Google представила Gemini 3.5 Transcribe — свою самую точную речевую модель

Система автоматически распознает более 85 языков, определяет до трех спикеров с временными метками и транскрибирует аудио на 70% быстрее Chirp 3.

  • По данным Artificial Analysis, потоковая транскрипция имеет погрешность 4,0%, а офлайн-режим — 2,6%.
  • Выпущены два API: gemini-3.5-transcribe-live для реального времени и gemini-3.5-transcribe для записей.
  • Среди первых партнеров, тестирующих модель — Agora, LiveKit, LangChain, Vercel и Pipecat.

Почему это важно: Речевая модель, которая помнит все услышанное, превращает любой разговор в постоянный архив под контролем Google.

Google DeepMind ↗ · 26 авг. 2026 г.26.08.26