أطلقت شركة Google نموذجها الجديد Gemini 3.5 Transcribe المتخصص في تحويل الكلام الصوتي إلى نصوص مكتوبة، حيث حقق معدل خطأ منخفض بلغ 2.6% عبر 85 لغة ولهجة مختلفة.

ويتميز النموذج بقدرته على فهم اللهجات المحلية والعمل في البيئات المليئة بالضوضاء، مع توفير تفريغ نصي فوري للاجتماعات والمكالمات، ودعم تطبيقات مثل خدمة العملاء والتعليم الرقمي والتوثيق الطبي والقانوني.

ويعتمد النموذج على تقنيات ذكاء اصطناعي متقدمة تمكنه من تمييز الأصوات المتعددة وعزل التشويش، في خطوة تهدف Google من خلالها إلى تطوير أدوات المحادثة والترجمة الفورية والمساعدات الرقمية.