تخطي إلى المحتوى الرئيسي

بازينجا

جوجل تطلق تقنية ترجمة لغة الإشارة بالذكاء الاصطناعي

Written by

Picture of فريقنا

فريقنا

Communications Consultant

كشفت شركة جوجل ديب مايند عن نموذج الذكاء الاصطناعي المبتكر اس إل تو تي المخصص لترجمة لغة الإشارة إلى نصوص مكتوبة فورية. وتعد هذه المرة الأولى التي يُدمج فيها نموذج ذكاء اصطناعي للغة الإشارة كميزة استهلاكية أساسية داخل الهواتف الذكية عبر سلسلة بكسل 11.

تم إعداد هذا التقرير الصحفي المتقدم لتغطية كواليس وتفاصيل جوجل تطلق تقنية ترجمة لغة الإشارة بالذكاء الاصطناعي والمواضيع ذات الصلة بالقطاع التكنولوجي والتنظيمي العالمي.

فهرس المقال:

دمج ترجمة لغة الإشارة في هواتف بكسل 11

أعلنت شركة جوجل ديب مايند رسمياً عن إطلاق نموذج الذكاء الاصطناعي المخصص لترجمة لغة الإشارة إلى نصوص، والذي يحمل اسم اس إل تو تي، لتكون المرة الأولى التي تشحن فيها ميزة ذكاء اصطناعي مخصصة للغة الإشارة داخل تطبيق استهلاكي على الهواتف الذكية. ويدعم النموذج الإملاء من الإشارة إلى النص المكتوب عبر لوحة إدخال جوجل وتطبيق التدوين الصوتي المباشر على سلسلة هواتف بكسل 11 الجديدة، حيث يبدأ العمل بترجمة لغة الإشارة الأمريكية إلى اللغة الإنجليزية المكتوبة. وتتيح هذه الميزة الفريدة للمستخدمين الصم وضعاف السمع توجيه كاميرا الهاتف والإشارة إليها في أي مكان يعتادون فيه على الكتابة؛ سواء عند البحث على شبكة الويب، أو صياغة الرسائل والبريد، أو توجيه الاستفسارات لنظام جيميناي، أو حتى الرد الفوري في المحادثات المباشرة وجه لوجه عبر تطبيق التدوين الحاضر. وأكدت جوجل أن مجربي التقنية وجدوا استخدام لغة الإشارة أسرع وأكثر طبيعية مقارنة بالكتابة التقليدية بالإنجليزية.

كيفية عمل النموذج وتحليل النقاط المرجعية

تم تدريب نموذج اس إل تو تي على أكثر من 100 ألف ساعة من بيانات لغة الإشارة المتنوعة التي تغطي أكثر من 50 لغة إشارة حول العالم، حيث شكّلت لغة الإشارة الأمريكية حوالي ربع تلك البيانات. وبدلاً من معالجة مقاطع الفيديو الخام التي تستهلك قدرات معالجة كبيرة وتحفها مخاطر الخصوصية، يعتمد النظام على نموذج محلي يعمل داخل الجهاز يُدعى ميديا بايب هولستيك لتتبع 130 نقطة رئيسية على وجه الشخص وجسمه ويديه، ثم يرسل فقط الإحداثيات الهندسية المترتبة إلى خوادم جوجل المتقدمة، مع التخلص الفوري والكامل من تغذية الكاميرا الأصلية لمنع أي انتهاك لخصوصية المستخدمين وضمان الأمان الصارم.

الترجمة المباشرة وتجاوز المعايير التقليدية

يترجم النموذج مباشرة من إحداثيات وضعية الجسم والنقاط المرجعية إلى النصوص المكتوبة، متجاوزاً التدوينات التوضيحية المتوسطة التي اعتمدت عليها الأنظمة السابقة. وتؤكد ديب مايند أن التدوينات التوضيحية القديمة كانت تفشل في التقاط الأبعاد الغنية وغير الخطيّة للغة الإشارة مثل تعابير الوجه والتركيبات الفضائية وحركة الجسد. وتتيح الترجمة المباشرة من النقاط المرجعية رفع جودة الترجمة بشكل ملحوظ مع زيادة حجم البيانات المتاحة بدون حدود مفروضة. وعلى مقياس التقييم المرجعي المخصص للغة الإشارة الأمريكية، حقق النموذج نتيجة استثنائية بلغت 70 نقطة، وهي نتيجة تتفوق بفارق كبير على أي نتائج سابقة تم تسجيلها في هذا المجال.

الحوكمة والقيود التنظيمية ومبادئ الاستخدام

لتأمين الاستخدام المسؤول للتقنية، أنشأت جوجل اللجنة الاستشارية للذكاء الاصطناعي للغة الإشارة، والتي تضم منظمات عالمية بارزة مثل الجمعية الوطنية للصم والاتحاد العالمي للصم. وأكد تقرير الأثر الصادر عن الشركة أن النسخة الأولى من النموذج تُعد أداة مساعدة مخصصة للسياقات غير الحرجة فقط، واستبعد التقرير بشكل صريح استخدام الميزة في الأطر الطبية أو القانونية أو الشرطية أو القرارات الوظيفية والصحية. كما أوضح التقرير أن الميزة لا تعتبر بديلاً قانونياً للالتزامات الرسمية بموجب قانون ذوي الإعاقة الأمريكي التزاماً بالسلامة العامة.

القيود الفنية وتطلعات التوسع المستقبلي

تشمل القيود الفنية الحالية انخفاض الدقة في الإضاءة الخافتة، وعدم دعم التفاعل مع عدة أشخاص يشيرون في وقت واحد، إضافة إلى سقف زمني محدد بـ 60 ثانية لكل مقطع مع عدم وجود ذاكرة للمحادثة عبر المقاطع المتعددة. كما لم يتم تدريب النموذج على فئات صغار السن تحت سن 18 عاماً. وتجدر الإشارة إلى أن المشروع بدأ بمبادرة من مهندس أصم داخل جوجل يدعى سام سيباه، حيث شاركت كفاءات من الصم في كل مرحلة من مراحل جمع البيانات والتطوير والنشر. وتخطط جوجل لتوسيع التقنية لتشمل لغات إشارة جديدة وأجهزة إضافية بدون أي تكاليف إضافية على المستخدمين مع استمرار الأبحاث النشطة لتوليد لغة الإشارة مستقبلاً.

أسئلة شائعة

السؤال: ما هي التقنية الجديدة التي أطلقتها جوجل ديب مايند للغة الإشارة؟
الإجابة: أطلقت جوجل نموذج اس إل تو تي لترجمة لغة الإشارة مباشرة إلى نصوص مكتوبة عبر كاميرا هواتف بكسل 11.

السؤال: كيف يحمي نموذج ترجمة لغة الإشارة خصوصية المستخدمين؟
الإجابة: يقوم النموذج بتحليل نقاط هندسية مرجعية للوجه واليدين وإرسال إحداثياتها فقط مع حذف فيديو الكاميرا الأصلي فوراً.

السؤال: هل يمكن استخدام الميزة في الفحوصات الطبية أو المحاكم القانونية؟
الإجابة: لا، تم تصنيف الميزة رسمياً كأداة مساعدة يومية ويُحظر استخدامها في الأطر الطبية والقانونية والشرطية والقرارات الرسمية.

السؤال: ما هي حدود التفاعل الزمني وسن المستخدمين المتاح حالياً؟
الإجابة: الحد الأقصى للمقطع هو 60 ثانية، مع التركيز حالياً على المستخدمين أكبر من 18 عاماً لضمان دقة النموذج.

شارك هذا الموضوع:

شارك هذا الموضوع:

اترك رد

الفئات

المنشورات الأخيرة

اكتشاف المزيد من بازينجا

اشترك الآن للاستمرار في القراءة والحصول على حق الوصول إلى الأرشيف الكامل.

متابعة القراءة