OpenAI تطلق أداة ثورية لتحويل محتوى يوتيوب إلى نص
أطلق مختبر OpenAI أداة جديدة تدعى Whisper، والتي تظهر قدرات متقدمة في التعرف على الكلام من خلال نسخ الصوت من مقاطع الفيديو على يوتيوب.
كيفية تحويل الصوت إلى نص
هذه الخطوة تعد ثورية في تحويل المحتوى الصوتي إلى نصوص، مما يمكن الأنظمة الذكية من تعلم وفهم اللغة البشرية بشكل أعمق.
ومع ذلك، أثارت هذه الخطوة جدلًا بين موظفي OpenAI حول مدى توافقها مع سياسات يوتيوب، التي تحظر استخدام المحتوى لأغراض خارج منصتها. وفقًا لتقرير “نيويورك تايمز”، يعد استخدام مقاطع الفيديو من يوتيوب في تطبيقات خارجية مخالفًا لقوانين المنصة.
تجدر الإشارة إلى أن فريق OpenAI قد قام بنسخ أكثر من مليون ساعة من مقاطع الفيديو من يوتيوب. ولضمان أفضل تجربة لتحويل الصوت إلى نص شارك غريغ بروكمان، رئيس OpenAI، بشكل شخصي في هذه العملية. وقد تم استخدام هذه البيانات لتدريب نظام GPT-4، الذي يعتبر واحدًا من أقوى أنظمة الذكاء الاصطناعي عالميًا.
في السابق، كانت OpenAI قد استخدمت مصادر بيانات متنوعة مثل الأكواد البرمجية من Github. والواجبات المدرسية من Quizlet لتدريب نماذجها. مما يظهر التزام الشركة بالبحث عن أفضل الموارد لتحسين تقنياتها. ويعد تحويل المحتوى الصوتي من يوتيوب إلى نصوص خطوة جديدة في هذا الاتجاه. مما يعزز من قدرات الذكاء الاصطناعي في فهم وتحليل اللغة البشرية.
مقالات ذات صلة:
التعليقات مغلقة.