Google تكشف عن نموذج Gemini 3.5 Transcribe لتحويل الصوت إلى نصوص

(MENAFN- Youm7) أطلقت شركة Google رسميًا أحدث نماذجها المتخصصة في المعالجة الصوتية Gemini 3.5 Transcribe، والذي يمثل قفزة نوعية في تحويل الكلام الصوتي إلى نصوص مكتوبة بدقة استثنائية، ونجح النموذج البرمجي الجديد في تسجيل معدل خطأ منخفض للغاية بلغ 2.6% عبر 85 لغة ولهجة مختلفة، مما يجعله واحدًا من أكثر النماذج الصوتية كفاءة وقدرة على فهم اللهجات المحلية والضوضاء المحيطة وتوفير تفريغ نصي فوري للاجتماعات والمكالمات.

استيعاب فوري للهجات والبيئات الصوتية الصاخبة

وفقًا لتقرير منشور بموقع MarkTechPost، يمثل هذا التطور البرمجي خطوة رائدة لتسهيل التواصل العالمي ودمج تقنيات الترجمة الفورية داخل التطبيقات الذكية والمساعدات الرقمية، حيث يعتمد النموذج على بنية عصبية متطورة تمكنه من تمييز الأصوات المتعددة في الغرفة الواحدة وعزل التشويش بدقة فائقة، وأكدت الشركة أن النموذج متاح للمطورين عبر واجهات برمجة التطبيقات السحابية لدعم أدوات خدمة العملاء والتعليم الرقمي وأتمتة التوثيق الطبي والقانوني في مختلف القطاعات الحساسة.

مستقبل المحادثات التفاعلية والترجمة الفورية

تسعى الشركة الأمريكية إلى تعزيز تجربة المستخدمين من خلال دمج النموذج في خدماتها اليومية، وسوف يسهم هذا الابتكار في كسر حواجز اللغة وتوفير أدوات إنتاجية متطورة تمكن المؤسسات من الوصول إلى جماهيرها العالمية بسلاسة واحترافية تامة.



MENAFN28082026000132011024ID1111593056

إخلاء المسؤولية القانونية:
تعمل شركة "شبكة الشرق الأوسط وشمال أفريقيا للخدمات المالية" على توفير المعلومات "كما هي" دون أي تعهدات أو ضمانات... سواء صريحة أو ضمنية.إذ أن هذا يعد إخلاء لمسؤوليتنا من ممارسات الخصوصية أو المحتوى الخاص بالمواقع المرفقة ضمن شبكتنا بما يشمل الصور ومقاطع الفيديو. لأية استفسارات تتعلق باستخدام وإعادة استخدام مصدر المعلومات هذه يرجى التواصل مع مزود المقال المذكور أعلاه.

البحث