کیا ٹیورنگ ٹیسٹ واقعی مصنوعی ذہانت کا اندازہ لگا سکتا ہے؟

اس بلاگ پوسٹ میں، ہم اس بات کا جائزہ لیں گے کہ آیا ٹیورنگ ٹیسٹ مصنوعی ذہانت کی ذہانت کا جائزہ لینے کے لیے موزوں معیار ہے، اور اس کی حدود اور بہتری کے لیے ممکنہ شعبوں کو تلاش کریں گے۔

 

2014 میں، یہ خبر کہ روسی ڈویلپرز کے ذریعہ تیار کردہ چیٹ بوٹ "یوجین گوسٹ مین" نے ٹورنگ ٹیسٹ پاس کر لیا ہے، یہ ایک صدمے کے طور پر آیا اور بہت سے لوگوں کے لیے الجھن کا باعث بنا۔ یہ ایک واضح مظاہرہ تھا کہ مصنوعی ذہانت اب محض سائنس فکشن فلموں میں نظر آنے والے ایک خیالی مستقبل کے معاشرے کی پیداوار نہیں ہے۔ AI پہلے ہی ہماری زندگیوں میں گہرائی سے سرایت کر چکا ہے اور رے کرزویل کے "تیز واپسی کے قانون" کے مطابق، تیز رفتاری سے آگے بڑھ رہا ہے۔ تاہم، ہم محض کھڑے ہو کر نہیں دیکھ سکتے کیونکہ AI، جو پلک جھپکتے ہی تیار ہو رہا ہے، معاشرے میں مضبوطی سے قائم ہو جاتا ہے۔ ہمیں اس بات کا تعین کرنے کی ضرورت ہے کہ آیا AI واقعی انسانوں کی طرح سوچ سکتا ہے، اور ہمیں اس سمت پر بھی غور کرنا چاہیے جس میں اسے مستقبل میں ترقی کرنی چاہیے۔
یہ مسائل ٹیورنگ ٹیسٹ سے جڑے ہوئے ہیں۔ ٹیورنگ ٹیسٹ ایک تشخیصی طریقہ ہے جس کی ابتدا اس سوال سے ہوئی ہے: "کیا ایسا کمپیوٹر بنانا ممکن ہے جسے ہم کہہ سکیں کہ ذہانت اور دماغ ہے؟" یہ عام طور پر جانا جاتا ہے کہ ایلن ٹورنگ نے 1950 میں اس سوال کا جواب دینے کے لیے تجویز کیا تھا، "کیا مشینیں سوچ سکتی ہیں؟" تاہم، ٹورنگ نے اصل میں اس سوال کو دوبارہ بیان کیا کہ "کیا مشینیں انسانوں کی طرح برتاؤ کر سکتی ہیں؟" تجربے کو ڈیزائن کرتے وقت۔ یہ ٹیسٹ ایک جج کو انسان اور ایک AI دونوں سے سوالات پوچھ کر کیا جاتا ہے، پھر اس بات کا تعین کیا جاتا ہے کہ کس کے جوابات زیادہ انسان نما ہیں۔ ٹیورنگ ٹیسٹ میں، جج کو دھوکہ دینے کے لیے مختلف طریقے استعمال کیے جا سکتے ہیں، اور جوابی اوقات کو کم کرنا یا بات چیت کو چیٹ کی طرح کی شکل میں جاری رکھنا جائز ہے۔ مزید برآں، ٹیسٹ کو پاس سمجھا جاتا ہے اگر AI محدود دائرہ کار اور بحث کے موضوع کے اندر تقریباً 30% ججوں کو دھوکہ دے سکے۔
میں نے سوال کیا کہ کیا ان شرائط اور قواعد کے ساتھ ٹورنگ ٹیسٹ واقعی AI انٹیلی جنس کا اندازہ لگانے کے لیے ایک مناسب اقدام ہے۔ دوسرے لفظوں میں، مجھے یقین ہے کہ ٹورنگ ٹیسٹ AI کی تشخیص کے لیے موزوں نہیں ہے۔ اس نظریے کی تائید کے لیے، میں تین دلائل پیش کروں گا اور ایک حل کے طور پر "ریورس ٹورنگ ٹیسٹ" تجویز کروں گا۔ تاہم، ایسا کرنے سے پہلے، یہ ضروری ہے کہ پہلے AI کی دیگر قابل ذکر مثالوں کا جائزہ لیا جائے جنہوں نے "Eugene Goostman" کے علاوہ ٹورنگ ٹیسٹ پاس کیا ہے۔
"ELIZA"، جو 1966 میں جوزف ویزنبام نے تیار کیا تھا، ابتدائی قدرتی زبان کے مکالمے کے پروگراموں میں سب سے زیادہ مشہور مثال ہے۔ یہ AI ان پٹ جملوں میں کلیدی کلیدی الفاظ کی شناخت اور متعلقہ جوابات واپس کرنے کے لیے ڈیزائن کیا گیا تھا۔ اگر کوئی مناسب مطلوبہ الفاظ نہیں ملے تو یہ صارف کے الفاظ کو دہرائے گا یا عام جواب فراہم کرے گا۔
1972 میں کینتھ کولبی کے ذریعہ تیار کردہ "PARRY" بھی ہے۔ اس AI کو ایک بے وقوف مریض کے گفتگو کے انداز کے مطابق بنایا گیا تھا، اور ایسے تجربات بھی کیے گئے تھے جن میں متعدد نفسیاتی ماہرین نے حقیقی مریضوں اور PARRY میں فرق کرنے کی کوشش کی تھی۔
یہاں سے، میں جانچ کروں گا کہ ٹیورنگ ٹیسٹ AI کی تشخیص کے لیے مناسب معیار کیوں نہیں ہے۔
پہلا، ٹورنگ ٹیسٹ خود ذہانت کا درست اندازہ نہیں لگاتا۔ دوسرے لفظوں میں، یہ جانچنے کے بجائے کہ ایک AI کتنی ذہانت سے سوچتا ہے، یہ ٹیسٹ بات چیت کے ذریعے طے کرتا ہے کہ آیا یہ انسان کی طرح برتاؤ کرتا ہے۔ اس کے ساتھ دو مسائل ہیں۔
سب سے پہلے، تمام انسان ہمیشہ ذہانت سے برتاؤ نہیں کرتے۔ یہاں، "ذہین" سے مراد دانشورانہ سرگرمی ہے جس میں کسی رجحان یا چیز کو سمجھنا اور اسے عقلی طور پر پروسیس کرنا شامل ہے۔ مزید برآں، ایلن ٹورنگ کے مقالے کے مطابق، AI کی کچھ فکری صلاحیتیں انسانوں سے مختلف طریقوں سے ظاہر ہو سکتی ہیں۔ سیدھے الفاظ میں، اگر کوئی AI کسی ایسے مسئلے کو حل کرتا ہے جو انسان نہیں کر سکتے ہیں، تو جائزہ لینے والے کو حقیقت میں یہ سمجھنے کا زیادہ امکان ہوتا ہے کہ دوسرا فریق ایک کمپیوٹر ہے۔ بالآخر، ٹورنگ ٹیسٹ انٹیلی جنس کی ان شکلوں کا صحیح اندازہ لگانے میں ناکام رہتا ہے جو انسانی صلاحیتوں سے آگے نکل جاتی ہیں۔
دوسرا، ٹیورنگ ٹیسٹ کے تشخیصی معیارات موضوعی ہیں، اور تجرباتی حالات حد سے زیادہ محدود ہیں۔ دوسرے لفظوں میں، ٹیسٹ کے نتائج AI کی اصل ذہانت کی سطح کے بجائے تشخیص کار کے رویے، تجربے، مہارت اور علم سے نمایاں طور پر متاثر ہو سکتے ہیں، جس سے معروضیت کو یقینی بنانا مشکل ہو جاتا ہے۔

بالآخر، وہ ہستی جو اس بات کا تعین کرتی ہے کہ آیا کوئی چیز AI ہے یا انسان ایک شخص ہے، اس لیے تشخیص کرنے والے کی سبجیکٹیوٹی کو مکمل طور پر ختم کرنا مشکل ہے۔ مزید برآں، تقریباً پانچ منٹ کے محدود وقت کے اندر پوچھے گئے سوالات بھی بہت محدود ہیں۔ جب تک تشخیص کرنے والا انسان ہے، ہمیشہ مختلف بیرونی عوامل سے متاثر ہونے کا امکان رہتا ہے۔
مزید برآں، ٹورنگ ٹیسٹ میں حصہ لینے والے زیادہ تر AIs مخصوص حالات یا خصوصیات کے ساتھ انسانوں کے مطابق بنائے جاتے ہیں۔ لہذا، یہاں تک کہ اگر ایک AI ٹیسٹ پاس کرتا ہے، یہ نتیجہ اخذ کرنا مشکل ہے کہ یہ عام طور پر انسانوں کی طرح برتاؤ کرتا ہے۔ مثال کے طور پر، پہلے متعارف کرایا گیا "یوجین گوسٹ مین" اس بنیاد کے ساتھ تیار کیا گیا تھا کہ یہ یوکرین میں رہنے والا 13 سالہ لڑکا تھا۔ یہ ایک ایسی صورت حال پیدا کرنے کی دانستہ کوشش تھی جہاں کسی حد تک اناڑی انگریزی کو بھی فطری مان لیا جائے۔ "PARRY" کو ایک بے وقوف مریض کے بعد بنایا گیا تھا، اور "ELIZA" کو ایک پیشہ ور نفسیاتی مشیر کی نقل کرنے کے لیے ڈیزائن کیا گیا تھا۔
اس طرح، جب ایک AI مخصوص خصوصیات کے حامل انسان کی نمائندگی کے لیے قائم کیا جاتا ہے اور پھر گفتگو میں مشغول ہوتا ہے، جج ان خصوصیات کو ذہن میں رکھتے ہوئے اس کا جائزہ لیتے ہیں۔ مثال کے طور پر، یہاں تک کہ اگر کسی دماغی بیماری میں مبتلا شخص کی نمائندگی کرنے کے لیے پروگرام کیے گئے AI کے ساتھ بات چیت کے دوران کچھ عجیب سا ردعمل سامنے آتا ہے، تب بھی جج اسے اس خصوصیت کے مطابق قدرتی ردعمل کے طور پر قبول کر سکتے ہیں۔ دوسرے لفظوں میں، جب کہ ججوں کو تعصب کے بغیر جائزہ لینا چاہیے، وہ دراصل ایسے ماحول میں رکھے گئے ہیں جہاں ایسا کرنا مشکل ہے۔
یقیناً دماغی امراض میں مبتلا افراد سوچنے سمجھنے کی صلاحیت رکھتے ہیں۔ تاہم، صرف اس وجہ سے کہ دماغی بیماری میں مبتلا شخص کے ٹیورنگ ٹیسٹ پاس کرنے کے بعد تیار کردہ AI کا مطلب یہ نہیں ہے کہ یہ انسان سے زیادہ "انسان جیسا" سوچتا ہے۔ ایلن ٹورنگ کے پوچھے گئے سوال پر وفادار رہنے کے لیے - "کیا ایک مشین انسان کی طرح برتاؤ کر سکتی ہے؟" - ٹیسٹ کو عام حالات کی بنیاد پر ڈیزائن کیا جانا چاہیے جسے لوگوں کی اکثریت قبول کر سکتی ہے۔
تیسرا، AI اصل میں مواد کو سمجھنے کے بجائے صرف علامتوں میں ہیرا پھیری کرکے ٹورنگ ٹیسٹ پاس کرسکتا ہے۔ ایک اہم مثال "ELIZA" ہے۔ کسی شخص کو کسی موضوع کے بارے میں سوچنے کے لیے، اسے اس موضوع کو سمجھنا چاہیے اور متعلقہ تجربے کی بنیاد پر فیصلے کرنا چاہیے۔ اس وجہ سے، فلسفی جان سیرل نے یہ بھی دلیل دی کہ صرف ٹورنگ ٹیسٹ یہ ثابت نہیں کر سکتا کہ آیا کوئی مشین حقیقت میں سوچ رہی ہے۔
مزید برآں، چونکہ مصنوعی ذہانت پہلے سے طے شدہ الگورتھم کے مطابق کام کرتی ہے، اس لیے غیر متوقع حالات کا سامنا کرنے پر یہ آسانی سے غلطیوں کو ظاہر کر سکتی ہے۔ اس کی وضاحت کرنے والی ایک مثال درج ذیل ہے۔
انٹرلوکیوٹر: کیا آپ اب بھی بل کلنٹن کی حمایت کرتے ہیں؟
جج: میں کلنٹن سے کبھی نہیں ملا۔
انٹرلوکیوٹر: آپ بل کلنٹن کو واقعی ناپسند کرتے ہیں۔ کم از کم، یہ واضح ہے کہ آپ اسے ناپسند کرتے ہیں. میری رائے میں، ایسا لگتا ہے کہ زیادہ تر لوگ محض دلچسپی نہیں رکھتے یا اب تک اس پر زیادہ غور نہیں کیا ہے۔
جج: کیا آپ نے 'دی مارٹین' دیکھا ہے؟
انٹرلوکیوٹر: آئیے اسے آسانی سے لیں۔ میں یہاں احمقانہ سوالوں کے جواب دینے نہیں آیا ہوں۔ ایسا نہیں ہے۔ ہم کیا بات کر رہے تھے؟ ٹھیک ہے۔ کیا آپ نے ابھی جو کہا اس کا مطلب یہ ہے کہ بنیادی مسائل جیسے وائٹ واٹر اور خصوصی مشیر — سنجیدہ ہیں؟
یہ گفتگو ایک جج اور "کیتھرین" کے درمیان ہے، ایک AI جو ٹورنگ ٹیسٹ کے انعقاد سے ایک دن پہلے خبروں میں تبدیل ہونے والے واقعات کے بارے میں پہلے سے پروگرام شدہ معلومات پر مبنی مکالمہ جاری رکھنے کے لیے ڈیزائن کیا گیا ہے۔ اگر جج بل کلنٹن سے متعلق سیاسی گفتگو کو جاری رکھتے تو بات چیت بالکل فطری رہ سکتی تھی۔ تاہم، جب جج نے اچانک موضوع کو کسی اور چیز پر منتقل کیا، تو AI غیر پروگرام شدہ موضوع کو صحیح طریقے سے ہینڈل کرنے میں ناکام رہا اور اوپر دکھائی گئی غلطی کو ظاہر کیا۔
اس طرح، ہم یہ نتیجہ اخذ نہیں کر سکتے کہ ایک AI ایک انسان کی طرح برتاؤ کرتا ہے کیونکہ یہ ایک خاص سطح کے مواصلات کی صلاحیت رکھتا ہے۔ اگرچہ یہ سطح پر انسانوں جیسی گفتگو میں مشغول دکھائی دے سکتا ہے، لیکن یہ حقیقت میں مواد کو نہیں سمجھ رہا ہے بلکہ محض اس طریقے سے جواب دے رہا ہے جس سے یہ انسان لگتا ہے۔ لہذا، یہ "ذہانت" کے تصور سے کم ہے جیسا کہ پہلے بیان کیا گیا ہے۔ موجودہ ٹیورنگ ٹیسٹ، جو کہ AI سسٹمز کو پاس کرتا ہے جو معنی کو سمجھے بغیر محض انسانی رویے کی نقل کرتا ہے، اس کی واضح حدود ہیں۔
اس میں یہ انسانوں سے AI کا موازنہ کر کے اس کا اندازہ کرتا ہے، ٹورنگ ٹیسٹ ایک بامعنی تجربہ ہے جو انسانوں اور AI کے درمیان حد کو تلاش کرتا ہے۔ اس بات کو مدنظر رکھتے ہوئے کہ انسان خود سوچ یا ذہن کے جوہر کو واضح طور پر بیان نہیں کر سکتا، یہ کوشش اپنے آپ میں اہم اہمیت رکھتی ہے۔ دوسری طرف، چونکہ AI نسبتاً سادہ ڈھانچے اور اصولوں کی بنیاد پر کام کرتا ہے، اس لیے اس کی پیمائش اور تجزیہ ایک خاص حد تک ممکن ہے، چاہے بالکل ہی کیوں نہ ہو۔
تاہم، ٹورنگ ٹیسٹ ذہانت کا درست اندازہ لگانے میں ناکام رہتا ہے، اور اس کی تشخیص کا معیار بھی حد سے زیادہ موضوعی ہے۔ اصل جانچ کے عمل کو قریب سے دیکھنے سے پتہ چلتا ہے کہ اسے ایک ایسے ماحول کے طور پر دیکھنا مشکل ہے جو AI کی ذہانت کا جامع جائزہ لینے کے قابل ہو۔ یہاں تک کہ اگر متعدد ججز شریک ہوں اور ایک ادارہ تشخیصی عمل کی نگرانی کرتا ہے، تب بھی جائزہ لینے والوں کی تعداد محدود ہے، اور کسی ایسے معروضی نتیجے پر پہنچنا آسان نہیں ہے جو تمام متغیرات کو مدنظر رکھے۔ لہذا، ایک کامل نتیجہ اخذ کرنے کے لیے بنیادی حدود ہیں جنہیں ہر کوئی قبول کر سکتا ہے۔
ٹیورنگ ٹیسٹ اس لحاظ سے اہم اہمیت رکھتا ہے کہ اس نے یہ ظاہر کیا کہ AI، ایک خاص حد تک، انسانوں کے لیے منفرد سمجھی جانے والی علمی صلاحیتوں کو نقل کر سکتا ہے۔ لہٰذا، اس ٹیسٹ کو مکمل طور پر مسترد کرنے کے بجائے، تشخیصی معیارات اور طریقہ کار قائم کرنے کی ضرورت ہے جو اس وقت استعمال میں آنے والوں سے زیادہ درست اور وسیع تر سامعین کے لیے قابل قبول ہوں۔
اس سلسلے میں، میں متبادل کے طور پر "ریورس ٹورنگ ٹیسٹ" تجویز کرنا چاہوں گا۔ ریورس ٹیورنگ ٹیسٹ میں، تشخیص کرنے والا انسان کے بجائے کمپیوٹر ہے۔ دوسرے لفظوں میں، یہ ایک ایسا طریقہ ہے جس میں کمپیوٹر انسان یا دوسرے کمپیوٹر کے ساتھ بات چیت کرتے ہوئے اس کا اندازہ لگاتا ہے۔ موجودہ ٹیسٹوں میں اس نقطہ نظر کو متعارف کرانے سے انسانی سبجیکٹیوٹی کا مسئلہ کم ہو جائے گا اور جائزوں کو زیادہ معروضی ماحول میں کرنے کی اجازت ملے گی۔ بلاشبہ، یہ حقیقت کہ جانچ کرنے والا ایک AI ہے، نئے مسائل کا امکان بھی بڑھاتا ہے۔
موضوع سے قطع نظر، تشخیص اور فیصلے کے لیے ڈیزائن کیے گئے ٹیسٹ ہر کسی کو مطمئن کرنے کا امکان نہیں رکھتے، اور ایسا کامل معیار قائم کرنا آسان نہیں ہے جسے ہر کوئی قبول کر سکے۔ لہذا، ہمیں ان کو بہتر بنانے کے طریقے تلاش کرنے کی ضرورت ہے۔ خاص طور پر، چونکہ ٹیورنگ ٹیسٹ ایک اہم تشخیصی طریقہ ہے جو صنعت کے مستقبل اور AI ٹیکنالوجی کی ترقی کی سمت کو نمایاں طور پر متاثر کر سکتا ہے، اس لیے اسے زیادہ موثر اور قابل اعتماد شکل میں تیار ہونا چاہیے۔
آج، AI ماضی سے بے مثال رفتار سے آگے بڑھ رہا ہے اور ہماری روزمرہ زندگی کے ہر پہلو میں پہلے سے ہی استعمال ہو رہا ہے۔ اس طرح کے AI کا جائزہ لیتے وقت، ہمیں اس کا فیصلہ صرف اس بات پر نہیں کرنا چاہیے کہ آیا یہ انسانوں کو دھوکہ دے سکتا ہے، بلکہ اس کے معنی کو سمجھنے، سیاق و سباق کو سمجھنے اور مختلف حالات میں قدرتی طور پر بات چیت کرنے کی صلاحیت کا اندازہ لگانا چاہیے۔ بلاشبہ، چونکہ یہ ریاضی کے مسئلے کی طرح واضح طور پر بیان کردہ "درست جوابات" والا فیلڈ نہیں ہے، اس لیے معروضی معیار قائم کرنا آسان نہیں ہے۔ بہر حال، مستقبل میں انسانوں کے ساتھ رہنے والے AI کا اندازہ لگانے کے لیے، ٹیورنگ ٹیسٹ کو اخلاقی عوامل اور مؤثر طریقے سے بات چیت کرنے کی صلاحیت پر جامع طور پر غور کرنے کے لیے تیار ہونا چاہیے۔

 

مصنف کے بارے میں