سعودی پریس ایجنسی کے مطابق کمپیوٹنگ اور مصنوعی ذہانت کی عالمی کمپنی انویڈیا نے اپنے ڈویلپر بلاگ پر شائع ایک تکنیکی مطالعے میں بتایا ہے کہ اس نے خودکار تقریر شناسی ماڈل ’Nemotron 3.5 ASR‘ کی تربیت کے لیے سعودی صوتی ڈیٹا سیٹ ’صدیٰ‘ (SADA) استعمال کیا، جسے سعودی اتھارٹی برائے ڈیٹا و مصنوعی ذہانت (سدایا) نے ریڈیو و ٹیلی وژن اتھارٹی کے تعاون سے جاری کیا تھا۔

یہ ماڈل عربی سمیت تقریباً 40 زبانوں اور لہجوں میں فوری تحریری منتقلی کرتا ہے۔ تربیت سے قبل یہ سعودی لہجے کے ہر 100 الفاظ میں تقریباً 55 غلط سمجھتا تھا، جبکہ ’صدیٰ‘ سے نجدی اور حجازی لہجوں کی تقریباً 133.7 گھنٹے کی آواز پر تربیت کے بعد یہ تعداد تقریباً 30 رہ گئی۔ پورے ڈیٹا سیٹ پر غلطی کی شرح 58.8% سے کم ہو کر 35.6% اور حروف کی سطح پر 31.6% سے کم ہو کر 12.2% ہو گئی، جبکہ انگریزی اور فصیح عربی میں بھی کارکردگی بہتر ہوئی۔ تربیت دو گرافکس پروسیسنگ یونٹس پر صرف تقریباً ساڑھے چار گھنٹے میں مکمل ہوئی۔

انویڈیا کے مطابق یہ ماڈل 80 ملی سیکنڈ سے شروع ہونے والے ردعمل کے وقت کے ساتھ فوری تعامل والی ایپلی کیشنز، جیسے صوتی معاونین، گفتگو کرنے والے ایجنٹس، براہِ راست نشریات کے سب ٹائٹلز اور کال سینٹرز، میڈیا اور اجلاسوں کے ریکارڈ کی تحریری منتقلی کے لیے موزوں ہے۔ کمپنی نے ڈویلپرز کو یہی طریقہ دیگر زبانوں پر آزمانے کے لیے ضروری اوزار اور مراحل بھی فراہم کیے ہیں۔

’صدیٰ‘ ڈیٹا سیٹ عالمی پلیٹ فارم Kaggle پر محققین کے لیے دستیاب ہے۔ اس میں عربی تحریری متن کے ساتھ تقریباً 667 گھنٹے کی آواز شامل ہے، جس کا بیشتر حصہ سعودی لہجوں پر مشتمل ہے؛ 600 گھنٹے سے زائد مواد ریڈیو و ٹیلی وژن اتھارٹی نے 57 سے زائد پروگراموں اور ڈراموں سے فراہم کیا، اور 20 گھنٹے جانچ کے لیے مختص ہیں۔ ڈیٹا دس سے زائد لہجوں اور 125,000 سے زیادہ درجہ بند صوتی کلپس پر مشتمل ہے۔

سعودی عرب میں مقیم افراد روزمرہ زندگی میں مقامی لہجوں سے واسطہ رکھنے والی ڈیجیٹل خدمات استعمال کرتے ہیں، اس لیے ان ٹیکنالوجیز میں بہتری ان کے لیے بھی مفید ہے۔