غوغل تطلق جيميني 3.5 ترانسكرايب، نموذجها الصوتي الأكثر دقة
يكشف النظام عن أكثر من 85 لغة تلقائياً، ويصنف ما يصل إلى ثلاثة متحدثين مع طوابع زمنية، ويبث الصوت بشكل أسرع بنسبة 70% مقارنة بنموذج تشيرب 3.
- يبلغ معدل الخطأ في الكلمات أثناء البث المباشر 4.0%، بينما يصل إلى 2.6% في التسجيلات غير المباشرة، وفقاً لتحليلات أرتيفيشال أناليسيس.
- يتم إطلاق واجهتي برمجة تطبيقات منفصلتين وهما جيميني-3.5-ترانسكرايب-لايف للبث المباشر، وجيميني-3.5-ترانسكرايب للتسجيلات.
- تشمل قائمة الشركاء الأوائل لاختبار النماذج شركات أغورا وليفكيت ولانغتشين وفسيل وبيبكات.
لماذا هذا مهم: نموذج صوتي لا ينسى أبداً ما يسمعه يحول المحادثة إلى سجل دائم تحتفظ به شركة غوغل.