Google تكشف عن نموذج Gemini 3.5 Transcribe لتحويل الصوت إلى نصوص

اليوم 7 0 تعليق ارسل طباعة تبليغ حذف

أطلقت شركة Google رسميًا أحدث نماذجها المتخصصة في المعالجة الصوتية Gemini 3.5 Transcribe، والذي يمثل قفزة نوعية في تحويل الكلام الصوتي إلى نصوص مكتوبة بدقة استثنائية، ونجح النموذج البرمجي الجديد في تسجيل معدل خطأ منخفض للغاية بلغ 2.6% عبر 85 لغة ولهجة مختلفة، مما يجعله واحدًا من أكثر النماذج الصوتية كفاءة وقدرة على فهم اللهجات المحلية والضوضاء المحيطة وتوفير تفريغ نصي فوري للاجتماعات والمكالمات.

 

استيعاب فوري للهجات والبيئات الصوتية الصاخبة

وفقًا لتقرير منشور بموقع MarkTechPost، يمثل هذا التطور البرمجي خطوة رائدة لتسهيل التواصل العالمي ودمج تقنيات الترجمة الفورية داخل التطبيقات الذكية والمساعدات الرقمية، حيث يعتمد النموذج على بنية عصبية متطورة تمكنه من تمييز الأصوات المتعددة في الغرفة الواحدة وعزل التشويش بدقة فائقة، وأكدت الشركة أن النموذج متاح للمطورين عبر واجهات برمجة التطبيقات السحابية لدعم أدوات خدمة العملاء والتعليم الرقمي وأتمتة التوثيق الطبي والقانوني في مختلف القطاعات الحساسة.

 

مستقبل المحادثات التفاعلية والترجمة الفورية

تسعى الشركة الأمريكية إلى تعزيز تجربة المستخدمين من خلال دمج النموذج في خدماتها اليومية، وسوف يسهم هذا الابتكار في كسر حواجز اللغة وتوفير أدوات إنتاجية متطورة تمكن المؤسسات من الوصول إلى جماهيرها العالمية بسلاسة واحترافية تامة.

إخترنا لك

أخبار ذات صلة

0 تعليق