ട്യൂറിംഗ് ടെസ്റ്റിന് കൃത്രിമബുദ്ധിയെ ശരിക്കും വിലയിരുത്താൻ കഴിയുമോ?

ഈ ബ്ലോഗ് പോസ്റ്റിൽ, ട്യൂറിംഗ് ടെസ്റ്റ് കൃത്രിമബുദ്ധിയുടെ ബുദ്ധി വിലയിരുത്തുന്നതിന് അനുയോജ്യമായ ഒരു മാനദണ്ഡമാണോ എന്ന് നമ്മൾ പരിശോധിക്കും, കൂടാതെ അതിന്റെ പരിമിതികളും മെച്ചപ്പെടുത്താനുള്ള സാധ്യതയുള്ള മേഖലകളും പര്യവേക്ഷണം ചെയ്യും.

 

2014-ൽ, റഷ്യൻ ഡെവലപ്പർമാർ സൃഷ്ടിച്ച ഒരു ചാറ്റ്ബോട്ട് "യൂജിൻ ഗൂസ്റ്റ്മാൻ" ട്യൂറിംഗ് ടെസ്റ്റ് വിജയിച്ചു എന്ന വാർത്ത ഒരു ഞെട്ടലുണ്ടാക്കുകയും പലർക്കും ആശയക്കുഴപ്പമുണ്ടാക്കുകയും ചെയ്തു. കൃത്രിമബുദ്ധി ഇനി സയൻസ് ഫിക്ഷൻ സിനിമകളിൽ മാത്രം കാണുന്ന ഒരു സാങ്കൽപ്പിക ഭാവി സമൂഹത്തിന്റെ ഒരു ഉൽപ്പന്നമല്ല എന്നതിന്റെ വ്യക്തമായ പ്രകടനമായിരുന്നു ഇത്. റേ കുർസ്‌വീലിന്റെ "ലാ ഓഫ് ആക്സിലറേറ്റിംഗ് റിട്ടേൺസ്" എന്ന തത്വത്തിന് അനുസൃതമായി AI ഇതിനകം നമ്മുടെ ജീവിതത്തിൽ ആഴത്തിൽ ഉൾച്ചേർന്നിട്ടുണ്ട്, കൂടാതെ അതിവേഗം മുന്നേറുകയും ചെയ്യുന്നു. എന്നിരുന്നാലും, ഒരു കണ്ണിമവെട്ടൽ കൊണ്ട് പരിണമിച്ചുകൊണ്ടിരിക്കുന്ന AI, സമൂഹത്തിൽ ഉറച്ചുനിൽക്കുന്നത് നമുക്ക് വെറുതെ നോക്കി നിൽക്കാനാവില്ല. മനുഷ്യർ ചിന്തിക്കുന്നതുപോലെ AI-ക്ക് ചിന്തിക്കാൻ കഴിയുമോ എന്ന് നമ്മൾ നിർണ്ണയിക്കേണ്ടതുണ്ട്, കൂടാതെ ഭാവിയിൽ അത് ഏത് ദിശയിൽ വികസിക്കണമെന്ന് പരിഗണിക്കുകയും വേണം.
ഈ പ്രശ്നങ്ങൾ ട്യൂറിംഗ് ടെസ്റ്റുമായി ബന്ധപ്പെട്ടിരിക്കുന്നു. "ബുദ്ധിയും മനസ്സും ഉണ്ടെന്ന് നമുക്ക് പറയാൻ കഴിയുന്ന ഒരു കമ്പ്യൂട്ടർ സൃഷ്ടിക്കാൻ കഴിയുമോ?" എന്ന ചോദ്യത്തിൽ നിന്ന് ഉത്ഭവിച്ച ഒരു വിലയിരുത്തൽ രീതിയാണ് ട്യൂറിംഗ് ടെസ്റ്റ്. "യന്ത്രങ്ങൾക്ക് ചിന്തിക്കാൻ കഴിയുമോ?" എന്ന ചോദ്യത്തിന് ഉത്തരം നൽകാൻ 1950-ൽ അലൻ ട്യൂറിംഗ് ഇത് നിർദ്ദേശിച്ചുവെന്ന് പൊതുവെ അറിയപ്പെടുന്നു. എന്നിരുന്നാലും, പരീക്ഷണം രൂപകൽപ്പന ചെയ്യുമ്പോൾ ട്യൂറിംഗ് യഥാർത്ഥത്തിൽ ചോദ്യം തന്നെ "മനുഷ്യർ ചെയ്യുന്ന അതേ രീതിയിൽ യന്ത്രങ്ങൾക്ക് പെരുമാറാൻ കഴിയുമോ?" എന്ന് പുനർനിർമ്മിച്ചു. ഒരു ജഡ്ജി ഒരു മനുഷ്യനോടും ഒരു AI-യോടും ചോദ്യങ്ങൾ ചോദിക്കുകയും, ആരുടെ പ്രതികരണങ്ങൾ കൂടുതൽ മനുഷ്യനെപ്പോലെയാണെന്ന് നിർണ്ണയിക്കുകയും ചെയ്തുകൊണ്ടാണ് ഈ പരിശോധന നടത്തുന്നത്. ട്യൂറിംഗ് ടെസ്റ്റിൽ, ജഡ്ജിയെ കബളിപ്പിക്കാൻ വിവിധ രീതികൾ ഉപയോഗിക്കാം, കൂടാതെ പ്രതികരണ സമയം മന്ദഗതിയിലാക്കാനോ ചാറ്റ് പോലുള്ള ഫോർമാറ്റിൽ സംഭാഷണം തുടരാനോ അനുവാദമുണ്ട്. കൂടാതെ, ചർച്ചയുടെ പരിമിതമായ പരിധിയിലും വിഷയത്തിലും ഏകദേശം 30% ജഡ്ജിമാരെ വഞ്ചിക്കാൻ AI-ക്ക് കഴിയുമെങ്കിൽ ടെസ്റ്റ് വിജയിച്ചതായി കണക്കാക്കപ്പെടുന്നു.
ഈ വ്യവസ്ഥകളും നിയമങ്ങളുമുള്ള ട്യൂറിംഗ് ടെസ്റ്റ് AI ഇന്റലിജൻസ് വിലയിരുത്തുന്നതിന് ശരിക്കും ഉചിതമായ അളവുകോലാണോ എന്ന് ഞാൻ ചോദിച്ചു. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, ട്യൂറിംഗ് ടെസ്റ്റ് AI വിലയിരുത്തുന്നതിന് അനുയോജ്യമല്ലെന്ന് ഞാൻ വിശ്വസിക്കുന്നു. ഈ വീക്ഷണത്തെ പിന്തുണയ്ക്കുന്നതിന്, ഞാൻ മൂന്ന് വാദങ്ങൾ അവതരിപ്പിക്കുകയും ഒരു പരിഹാരമായി "റിവേഴ്സ് ട്യൂറിംഗ് ടെസ്റ്റ്" നിർദ്ദേശിക്കുകയും ചെയ്യും. എന്നിരുന്നാലും, അങ്ങനെ ചെയ്യുന്നതിന് മുമ്പ്, "യൂജിൻ ഗൂസ്റ്റ്മാൻ" കൂടാതെ ട്യൂറിംഗ് ടെസ്റ്റ് വിജയിച്ച AI യുടെ മറ്റ് ശ്രദ്ധേയമായ ഉദാഹരണങ്ങൾ ആദ്യം പരിശോധിക്കേണ്ടത് ആവശ്യമാണ്.
1966-ൽ ജോസഫ് വീസൻബോം വികസിപ്പിച്ചെടുത്ത “ELIZA”, ആദ്യകാല സ്വാഭാവിക ഭാഷാ സംഭാഷണ പ്രോഗ്രാമുകളിൽ ഏറ്റവും വ്യാപകമായി അറിയപ്പെടുന്ന ഉദാഹരണമാണ്. ഇൻപുട്ട് വാക്യങ്ങളിലെ പ്രധാന കീവേഡുകൾ തിരിച്ചറിയുന്നതിനും അനുബന്ധ പ്രതികരണങ്ങൾ നൽകുന്നതിനുമായി ഈ AI രൂപകൽപ്പന ചെയ്‌തിരിക്കുന്നു; ഉചിതമായ കീവേഡുകൾ കണ്ടെത്തിയില്ലെങ്കിൽ, അത് ഉപയോക്താവിന്റെ വാക്കുകൾ ആവർത്തിക്കുകയോ പൊതുവായ ഒരു മറുപടി നൽകുകയോ ചെയ്യും.
1972-ൽ കെന്നത്ത് കോൾബി വികസിപ്പിച്ചെടുത്ത "PARRY" എന്നൊരു സംവിധാനവുമുണ്ട്. ഒരു ഭ്രാന്തൻ രോഗിയുടെ സംഭാഷണ ശൈലിയെ മാതൃകയാക്കിയാണ് ഈ AI രൂപകൽപ്പന ചെയ്തിരിക്കുന്നത്, കൂടാതെ നിരവധി മനോരോഗവിദഗ്ദ്ധർ യഥാർത്ഥ രോഗികളെയും PARRY-യെയും തമ്മിൽ വേർതിരിച്ചറിയാൻ ശ്രമിച്ച പരീക്ഷണങ്ങൾ പോലും നടത്തി.
ഇനി മുതൽ, ട്യൂറിംഗ് ടെസ്റ്റ് AI വിലയിരുത്തുന്നതിന് അനുയോജ്യമായ ഒരു മാനദണ്ഡമല്ലാത്തത് എന്തുകൊണ്ടെന്ന് ഞാൻ പരിശോധിക്കും.
ഒന്നാമതായി, ട്യൂറിംഗ് ടെസ്റ്റ് ബുദ്ധിശക്തിയെ തന്നെ കൃത്യമായി വിലയിരുത്തുന്നില്ല. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, ഒരു AI എത്രത്തോളം ബുദ്ധിപരമായി ചിന്തിക്കുന്നുവെന്ന് വിലയിരുത്തുന്നതിനുപകരം, സംഭാഷണത്തിലൂടെ അത് ഒരു മനുഷ്യനെപ്പോലെ പെരുമാറുന്നുണ്ടോ എന്ന് ഈ പരിശോധന നിർണ്ണയിക്കുന്നു. ഇതിൽ രണ്ട് പ്രശ്നങ്ങളുണ്ട്.
ഒന്നാമതായി, എല്ലാ മനുഷ്യരും എല്ലായ്പ്പോഴും ബുദ്ധിപരമായി പെരുമാറണമെന്നില്ല. ഇവിടെ, "ബുദ്ധിയുള്ളവൻ" എന്നത് ഒരു പ്രതിഭാസത്തെയോ വസ്തുവിനെയോ മനസ്സിലാക്കുകയും യുക്തിസഹമായി പ്രോസസ്സ് ചെയ്യുകയും ചെയ്യുന്ന ബൗദ്ധിക പ്രവർത്തനത്തെയാണ് സൂചിപ്പിക്കുന്നത്. കൂടാതെ, അലൻ ട്യൂറിംഗിന്റെ പ്രബന്ധം അനുസരിച്ച്, AI-യുടെ ചില ബൗദ്ധിക കഴിവുകൾ മനുഷ്യരുടേതിൽ നിന്ന് വ്യത്യസ്തമായ രീതിയിൽ പ്രകടമായേക്കാം. ലളിതമായി പറഞ്ഞാൽ, ഒരു AI മനുഷ്യർക്ക് പരിഹരിക്കാൻ കഴിയാത്ത ഒരു പ്രശ്നം പരിഹരിക്കുകയാണെങ്കിൽ, മറ്റേ കക്ഷി ഒരു കമ്പ്യൂട്ടറാണെന്ന് വിലയിരുത്തുന്നയാൾ യഥാർത്ഥത്തിൽ മനസ്സിലാക്കാൻ സാധ്യതയുണ്ട്. ആത്യന്തികമായി, മനുഷ്യ കഴിവുകളെ മറികടക്കുന്ന ബുദ്ധിശക്തിയുടെ രൂപങ്ങളെ ശരിയായി വിലയിരുത്തുന്നതിൽ ട്യൂറിംഗ് ടെസ്റ്റ് പരാജയപ്പെടുന്നു.
രണ്ടാമതായി, ട്യൂറിംഗ് ടെസ്റ്റിന്റെ മൂല്യനിർണ്ണയ മാനദണ്ഡങ്ങൾ ആത്മനിഷ്ഠമാണ്, കൂടാതെ പരീക്ഷണ സാഹചര്യങ്ങൾ അമിതമായി നിയന്ത്രണമുള്ളതുമാണ്. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, AI യുടെ യഥാർത്ഥ ബുദ്ധിശക്തിയെക്കാൾ, വിലയിരുത്തുന്നയാളുടെ മനോഭാവം, അനുഭവം, കഴിവുകൾ, അറിവ് എന്നിവയാൽ പരിശോധനാ ഫലങ്ങളെ ഗണ്യമായി സ്വാധീനിക്കാൻ കഴിയും, ഇത് വസ്തുനിഷ്ഠത ഉറപ്പാക്കുന്നത് ബുദ്ധിമുട്ടാക്കുന്നു.

ആത്യന്തികമായി, ഒരു AI ആണോ മനുഷ്യനാണോ എന്ന് നിർണ്ണയിക്കുന്ന എന്റിറ്റി ഒരു വ്യക്തിയാണ്, അതിനാൽ വിലയിരുത്തുന്നയാളുടെ ആത്മനിഷ്ഠത പൂർണ്ണമായും ഇല്ലാതാക്കുക പ്രയാസമാണ്. കൂടാതെ, ഏകദേശം അഞ്ച് മിനിറ്റ് എന്ന പരിമിതമായ സമയപരിധിക്കുള്ളിൽ ചോദിക്കുന്ന ചോദ്യങ്ങളും വളരെ പരിമിതമാണ്. വിലയിരുത്തുന്നയാൾ മനുഷ്യനാണെങ്കിൽ, വിവിധ ബാഹ്യ ഘടകങ്ങളാൽ സ്വാധീനിക്കപ്പെടാനുള്ള സാധ്യത എപ്പോഴും ഉണ്ടായിരിക്കും.
കൂടാതെ, ട്യൂറിംഗ് ടെസ്റ്റിൽ പങ്കെടുക്കുന്ന മിക്ക AI-കളും പ്രത്യേക സാഹചര്യങ്ങളോ സ്വഭാവസവിശേഷതകളോ ഉള്ള മനുഷ്യരെ മാതൃകയാക്കിയാണ് നിർമ്മിച്ചിരിക്കുന്നത്. അതിനാൽ, ഒരു AI പരിശോധനയിൽ വിജയിച്ചാലും, അത് പൊതുവെ മനുഷ്യരെപ്പോലെ തന്നെ പെരുമാറുമെന്ന് നിഗമനം ചെയ്യാൻ പ്രയാസമാണ്. ഉദാഹരണത്തിന്, നേരത്തെ അവതരിപ്പിച്ച "യൂജിൻ ഗൂസ്റ്റ്മാൻ", ഉക്രെയ്നിൽ താമസിക്കുന്ന 13 വയസ്സുള്ള ഒരു ആൺകുട്ടിയാണെന്ന് മുൻനിർത്തി വികസിപ്പിച്ചെടുത്തു. അൽപ്പം വിചിത്രമായ ഇംഗ്ലീഷ് പോലും സ്വാഭാവികമായി അംഗീകരിക്കപ്പെടുന്ന ഒരു സാഹചര്യം സൃഷ്ടിക്കാനുള്ള മനഃപൂർവമായ ശ്രമമായിരുന്നു ഇത്. "PARRY" ഒരു പരിഭ്രാന്തനായ രോഗിയുടെ മാതൃകയിലാണ് നിർമ്മിച്ചത്, കൂടാതെ "ELIZA" ഒരു പ്രൊഫഷണൽ മനഃശാസ്ത്ര കൗൺസിലറെ അനുകരിക്കാൻ രൂപകൽപ്പന ചെയ്തിട്ടുള്ളതുമാണ്.
ഈ രീതിയിൽ, പ്രത്യേക സ്വഭാവസവിശേഷതകളുള്ള ഒരു മനുഷ്യനെ പ്രതിനിധീകരിക്കുന്നതിനായി ഒരു AI സജ്ജീകരിച്ച് സംഭാഷണത്തിൽ ഏർപ്പെടുമ്പോൾ, ജഡ്ജിമാർ ആ സവിശേഷതകൾ മനസ്സിൽ വെച്ചുകൊണ്ടാണ് അതിനെ വിലയിരുത്തുന്നത്. ഉദാഹരണത്തിന്, മാനസിക രോഗമുള്ള ഒരു വ്യക്തിയെ പ്രതിനിധീകരിക്കാൻ പ്രോഗ്രാം ചെയ്ത ഒരു AI യുമായി സംഭാഷണം നടത്തുമ്പോൾ അൽപ്പം വിചിത്രമായ ഒരു പ്രതികരണം വന്നാലും, ആ സ്വഭാവരൂപീകരണവുമായി പൊരുത്തപ്പെടുന്ന ഒരു സ്വാഭാവിക പ്രതികരണമായി ജഡ്ജിമാർ അതിനെ അംഗീകരിക്കാൻ സാധ്യതയുണ്ട്. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, ജഡ്ജിമാർ പക്ഷപാതമില്ലാതെ വിലയിരുത്തേണ്ടതാണെങ്കിലും, അങ്ങനെ ചെയ്യാൻ ബുദ്ധിമുട്ടുള്ള ഒരു അന്തരീക്ഷത്തിലാണ് അവർ യഥാർത്ഥത്തിൽ സ്ഥാപിച്ചിരിക്കുന്നത്.
തീർച്ചയായും, മാനസിക രോഗമുള്ള ആളുകൾക്ക് ചിന്തിക്കാൻ കഴിവുണ്ട്. എന്നിരുന്നാലും, മാനസിക രോഗമുള്ള ഒരു വ്യക്തിയുടെ മാതൃകയിൽ നിർമ്മിച്ച ഒരു AI ട്യൂറിംഗ് ടെസ്റ്റ് വിജയിച്ചു എന്നതുകൊണ്ട് അത് ഒരു മനുഷ്യനേക്കാൾ "മനുഷ്യനെപ്പോലെ" ചിന്തിക്കുന്നു എന്നല്ല അർത്ഥമാക്കുന്നത്. അലൻ ട്യൂറിംഗ് ഉന്നയിച്ച ചോദ്യത്തോട് വിശ്വസ്തത പുലർത്താൻ - "ഒരു യന്ത്രത്തിന് ഒരു മനുഷ്യൻ ചെയ്യുന്ന രീതിയിൽ പെരുമാറാൻ കഴിയുമോ?" - ഭൂരിപക്ഷം ആളുകൾക്കും അംഗീകരിക്കാൻ കഴിയുന്ന പൊതുവായ സാഹചര്യങ്ങളെ അടിസ്ഥാനമാക്കിയാണ് പരിശോധന രൂപകൽപ്പന ചെയ്യേണ്ടത്.
മൂന്നാമതായി, ഉള്ളടക്കം യഥാർത്ഥത്തിൽ മനസ്സിലാക്കുന്നതിനുപകരം ചിഹ്നങ്ങൾ കൈകാര്യം ചെയ്തുകൊണ്ട് AI-ക്ക് ട്യൂറിംഗ് ടെസ്റ്റ് വിജയിക്കാൻ കഴിയും. ഒരു പ്രധാന ഉദാഹരണം "ELIZA" ആണ്. ഒരു വ്യക്തി ഒരു വിഷയത്തെക്കുറിച്ച് ചിന്തിക്കണമെങ്കിൽ, അവർ ആ വിഷയം മനസ്സിലാക്കുകയും പ്രസക്തമായ അനുഭവത്തെ അടിസ്ഥാനമാക്കി വിധിന്യായങ്ങൾ എടുക്കുകയും വേണം. ഇക്കാരണത്താൽ, ട്യൂറിംഗ് ടെസ്റ്റിന് മാത്രം ഒരു യന്ത്രം യഥാർത്ഥത്തിൽ ചിന്തിക്കുന്നുണ്ടോ എന്ന് തെളിയിക്കാൻ കഴിയില്ലെന്ന് തത്ത്വചിന്തകനായ ജോൺ സിയർ വാദിച്ചു.
കൂടാതെ, കൃത്രിമബുദ്ധി മുൻകൂട്ടി നിശ്ചയിച്ച അൽഗോരിതങ്ങൾ അനുസരിച്ചാണ് പ്രവർത്തിക്കുന്നതെന്നതിനാൽ, അപ്രതീക്ഷിത സാഹചര്യങ്ങൾ നേരിടുമ്പോൾ അതിന് പിശകുകൾ എളുപ്പത്തിൽ വെളിപ്പെടുത്താൻ കഴിയും. ഇത് വ്യക്തമാക്കുന്ന ഒരു ഉദാഹരണമാണ് താഴെ കൊടുത്തിരിക്കുന്നത്.
സംഭാഷണക്കാരൻ: നിങ്ങൾ ഇപ്പോഴും ബിൽ ക്ലിന്റനെ പിന്തുണയ്ക്കുന്നുണ്ടോ?
ജഡ്ജി: ഞാൻ ക്ലിന്റനെ ഒരിക്കലും കണ്ടിട്ടില്ല.
സംഭാഷണക്കാരൻ: നിങ്ങൾക്ക് ബിൽ ക്ലിന്റണെ ശരിക്കും ഇഷ്ടമല്ല. കുറഞ്ഞപക്ഷം, നിങ്ങൾക്ക് അദ്ദേഹത്തെ ഇഷ്ടമല്ലെന്ന് വ്യക്തമാണ്. എന്റെ അഭിപ്രായത്തിൽ, മിക്ക ആളുകളും ഇതുവരെ അതിനെക്കുറിച്ച് താൽപ്പര്യമില്ലാത്തവരോ അല്ലെങ്കിൽ അധികം ചിന്തിച്ചിട്ടില്ലാത്തവരോ ആണെന്ന് തോന്നുന്നു.
ജഡ്ജി: നീ 'ദി മാർഷ്യൻ' കണ്ടിട്ടുണ്ടോ?
സംഭാഷണക്കാരൻ: നമുക്ക് ശാന്തമായി ചിന്തിക്കാം. മണ്ടത്തരമായ ചോദ്യങ്ങൾക്ക് ഉത്തരം നൽകാൻ ഞാൻ ഇവിടെയില്ല. അതല്ല. നമ്മൾ എന്തിനെക്കുറിച്ചാണ് സംസാരിച്ചത്? ശരിയല്ലേ. വൈറ്റ് വാട്ടറും സ്പെഷ്യൽ കൗൺസലും പോലുള്ള അടിസ്ഥാന പ്രശ്നങ്ങൾ ഗുരുതരമാണെന്നാണോ നിങ്ങൾ ഇപ്പോൾ പറഞ്ഞത്?
ട്യൂറിംഗ് ടെസ്റ്റ് നടക്കുന്നതിന് തൊട്ടുമുമ്പ് വാർത്തയായി മാറിയ സംഭവങ്ങളെക്കുറിച്ചുള്ള മുൻകൂട്ടി പ്രോഗ്രാം ചെയ്ത വിവരങ്ങളെ അടിസ്ഥാനമാക്കി ഒരു സംഭാഷണം തുടരാൻ രൂപകൽപ്പന ചെയ്ത ഒരു AI ആയ "കാതറിനും" ഒരു ജഡ്ജിയും തമ്മിലുള്ള സംഭാഷണമാണിത്. ബിൽ ക്ലിന്റണുമായി ബന്ധപ്പെട്ട രാഷ്ട്രീയ സംഭാഷണം ജഡ്ജി തുടർന്നിരുന്നെങ്കിൽ, സംഭാഷണം വളരെ സ്വാഭാവികമായി തുടരാമായിരുന്നു. എന്നിരുന്നാലും, ജഡ്ജി പെട്ടെന്ന് വിഷയം മറ്റെന്തെങ്കിലും കാര്യത്തിലേക്ക് മാറ്റിയപ്പോൾ, പ്രോഗ്രാം ചെയ്യാത്ത വിഷയം ശരിയായി കൈകാര്യം ചെയ്യാൻ AI-ക്ക് കഴിഞ്ഞില്ല, മുകളിൽ കാണിച്ചിരിക്കുന്ന പിശക് വെളിപ്പെടുത്തി.
അതിനാൽ, ഒരു നിശ്ചിത തലത്തിലുള്ള ആശയവിനിമയത്തിന് കഴിവുള്ളതുകൊണ്ട് മാത്രം ഒരു AI ഒരു മനുഷ്യനെപ്പോലെ പെരുമാറുന്നുവെന്ന് നമുക്ക് നിഗമനം ചെയ്യാൻ കഴിയില്ല. ഉപരിതലത്തിൽ മനുഷ്യതുല്യമായ സംഭാഷണത്തിൽ ഏർപ്പെടുന്നതായി തോന്നുമെങ്കിലും, അത് യഥാർത്ഥത്തിൽ ഉള്ളടക്കം മനസ്സിലാക്കുന്നില്ല, മറിച്ച് അത് മനുഷ്യനാണെന്ന് തോന്നിപ്പിക്കുന്ന രീതിയിൽ പ്രതികരിക്കുന്നു. അതിനാൽ, മുമ്പ് നിർവചിച്ചതുപോലെ "ബുദ്ധി" എന്ന ആശയത്തിൽ നിന്ന് ഇത് വ്യതിചലിക്കുന്നു. അർത്ഥം മനസ്സിലാക്കാതെ മനുഷ്യന്റെ പെരുമാറ്റത്തെ അനുകരിക്കുന്ന AI സംവിധാനങ്ങളെ മറികടക്കുന്ന നിലവിലെ ട്യൂറിംഗ് ടെസ്റ്റിന് വ്യക്തമായ പരിമിതികളുണ്ട്.
മനുഷ്യരുമായി താരതമ്യം ചെയ്തുകൊണ്ട് AI-യെ വിലയിരുത്തുന്നതിനാൽ, ട്യൂറിംഗ് ടെസ്റ്റ് മനുഷ്യരും AI-യും തമ്മിലുള്ള അതിർത്തി പര്യവേക്ഷണം ചെയ്യുന്ന ഒരു അർത്ഥവത്തായ പരീക്ഷണമാണ്. മനുഷ്യർക്ക് ചിന്തയുടെയോ മനസ്സിന്റെയോ സത്ത വ്യക്തമായി നിർവചിക്കാൻ കഴിയില്ല എന്ന വസ്തുത കണക്കിലെടുക്കുമ്പോൾ, ഈ ശ്രമത്തിന് തന്നെ കാര്യമായ മൂല്യമുണ്ട്. മറുവശത്ത്, താരതമ്യേന ലളിതമായ ഘടനകളെയും തത്വങ്ങളെയും അടിസ്ഥാനമാക്കിയാണ് AI പ്രവർത്തിക്കുന്നത് എന്നതിനാൽ, ഒരു പരിധിവരെ അത് അളക്കാനും വിശകലനം ചെയ്യാനും കഴിയും, പൂർണ്ണമായിട്ടല്ലെങ്കിൽ പോലും.
എന്നിരുന്നാലും, ട്യൂറിംഗ് ടെസ്റ്റ് ബുദ്ധിശക്തിയെ കൃത്യമായി വിലയിരുത്തുന്നതിൽ പരാജയപ്പെടുന്നു, കൂടാതെ അതിന്റെ മൂല്യനിർണ്ണയ മാനദണ്ഡങ്ങളും അമിതമായി ആത്മനിഷ്ഠമാണ്. യഥാർത്ഥ പരിശോധനാ പ്രക്രിയയെ സൂക്ഷ്മമായി പരിശോധിക്കുമ്പോൾ, ഒരു AI-യുടെ ബുദ്ധിശക്തിയെ സമഗ്രമായി വിലയിരുത്താൻ കഴിയുന്ന ഒരു അന്തരീക്ഷമായി അതിനെ കാണുന്നത് ബുദ്ധിമുട്ടാണെന്ന് വെളിപ്പെടുത്തുന്നു. ഒന്നിലധികം ജഡ്ജിമാർ പങ്കെടുക്കുകയും ഒരു സ്ഥാപനം മൂല്യനിർണ്ണയ പ്രക്രിയയ്ക്ക് മേൽനോട്ടം വഹിക്കുകയും ചെയ്താലും, മൂല്യനിർണ്ണയക്കാരുടെ എണ്ണം പരിമിതമാണ്, കൂടാതെ എല്ലാ വേരിയബിളുകളും കണക്കിലെടുക്കുന്ന ഒരു വസ്തുനിഷ്ഠമായ നിഗമനത്തിലെത്തുക എളുപ്പമല്ല. അതിനാൽ, എല്ലാവർക്കും അംഗീകരിക്കാൻ കഴിയുന്ന ഒരു പൂർണ്ണ ഫലം നേടുന്നതിന് അടിസ്ഥാനപരമായ പരിമിതികളുണ്ട്.
മനുഷ്യർക്ക് മാത്രമായി കണക്കാക്കപ്പെട്ടിരുന്ന വൈജ്ഞാനിക കഴിവുകൾ ഒരു പരിധിവരെ പകർത്താൻ AI-ക്ക് കഴിയുമെന്ന് തെളിയിച്ചതിനാൽ ട്യൂറിംഗ് ടെസ്റ്റിന് കാര്യമായ പ്രാധാന്യമുണ്ട്. അതിനാൽ, ഈ പരീക്ഷണം പൂർണ്ണമായും തള്ളിക്കളയുന്നതിനുപകരം, നിലവിൽ ഉപയോഗത്തിലുള്ളതിനേക്കാൾ കൂടുതൽ കൃത്യവും സ്വീകാര്യവുമായ വിലയിരുത്തൽ മാനദണ്ഡങ്ങളും നടപടിക്രമങ്ങളും സ്ഥാപിക്കേണ്ടതുണ്ട്.
ഈ കാര്യത്തിൽ, ഒരു ബദലായി "റിവേഴ്സ് ട്യൂറിംഗ് ടെസ്റ്റ്" നിർദ്ദേശിക്കാൻ ഞാൻ ആഗ്രഹിക്കുന്നു. റിവേഴ്സ് ട്യൂറിംഗ് ടെസ്റ്റിൽ, വിലയിരുത്തുന്നയാൾ ഒരു മനുഷ്യനല്ല, മറിച്ച് ഒരു കമ്പ്യൂട്ടറാണ്. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, ഒരു കമ്പ്യൂട്ടർ ഒരു മനുഷ്യനെയോ മറ്റൊരു കമ്പ്യൂട്ടറിനെയോ ഇടപഴകുമ്പോൾ വിലയിരുത്തുന്ന ഒരു രീതിയാണിത്. നിലവിലുള്ള പരിശോധനകളിൽ ഈ സമീപനം അവതരിപ്പിക്കുന്നത് മനുഷ്യന്റെ ആത്മനിഷ്ഠതയുടെ പ്രശ്നം കുറയ്ക്കുകയും കൂടുതൽ വസ്തുനിഷ്ഠമായ അന്തരീക്ഷത്തിൽ വിലയിരുത്തലുകൾ നടത്താൻ അനുവദിക്കുകയും ചെയ്യും. തീർച്ചയായും, വിലയിരുത്തുന്നയാൾ ഒരു AI ആണെന്ന വസ്തുത പുതിയ പ്രശ്നങ്ങളുടെ സാധ്യതയും ഉയർത്തുന്നു.
വിഷയം എന്തുതന്നെയായാലും, മൂല്യനിർണ്ണയത്തിനും വിധിനിർണ്ണയത്തിനുമായി രൂപകൽപ്പന ചെയ്തിട്ടുള്ള പരിശോധനകൾ എല്ലാവരെയും തൃപ്തിപ്പെടുത്താൻ സാധ്യതയില്ല, എല്ലാവർക്കും അംഗീകരിക്കാൻ കഴിയുന്ന പൂർണ്ണമായ മാനദണ്ഡങ്ങൾ സ്ഥാപിക്കുക എളുപ്പവുമല്ല. അതിനാൽ, അവ മെച്ചപ്പെടുത്താനുള്ള വഴികൾ നാം നിരന്തരം പര്യവേക്ഷണം ചെയ്യണം. പ്രത്യേകിച്ചും, ട്യൂറിംഗ് ടെസ്റ്റ് വ്യവസായത്തിന്റെ ഭാവിയെയും AI സാങ്കേതികവിദ്യ വികസനത്തിന്റെ ദിശയെയും ഗണ്യമായി സ്വാധീനിക്കുന്ന ഒരു നിർണായക മൂല്യനിർണ്ണയ രീതിയായതിനാൽ, അത് കൂടുതൽ കാര്യക്ഷമവും വിശ്വസനീയവുമായ ഒരു രൂപത്തിലേക്ക് പരിണമിക്കേണ്ടതുണ്ട്.
ഇന്ന്, AI മുൻകാലങ്ങളെ അപേക്ഷിച്ച് വളരെ വേഗത്തിൽ പുരോഗമിക്കുന്നു, നമ്മുടെ ദൈനംദിന ജീവിതത്തിന്റെ എല്ലാ മേഖലകളിലും അത് ഇതിനകം തന്നെ ഉപയോഗിക്കപ്പെടുന്നു. അത്തരം AI-കളെ വിലയിരുത്തുമ്പോൾ, അതിന് മനുഷ്യരെ വഞ്ചിക്കാൻ കഴിയുമോ എന്നതിനെ മാത്രം അടിസ്ഥാനമാക്കിയല്ല നമ്മൾ അതിനെ വിലയിരുത്തേണ്ടത്, മറിച്ച് അർത്ഥം മനസ്സിലാക്കാനും, സന്ദർഭം മനസ്സിലാക്കാനും, വിവിധ സാഹചര്യങ്ങളിൽ സ്വാഭാവികമായി ആശയവിനിമയം നടത്താനുമുള്ള അതിന്റെ കഴിവ് വിലയിരുത്തണം. തീർച്ചയായും, ഇത് ഒരു ഗണിത പ്രശ്നം പോലെ വ്യക്തമായി നിർവചിക്കപ്പെട്ട "ശരിയായ ഉത്തരങ്ങൾ" ഉള്ള ഒരു മേഖലയല്ലാത്തതിനാൽ, വസ്തുനിഷ്ഠമായ മാനദണ്ഡങ്ങൾ സ്ഥാപിക്കുന്നത് എളുപ്പമല്ല. എന്നിരുന്നാലും, ഭാവിയിൽ മനുഷ്യരുമായി സഹവർത്തിക്കുന്ന AI-യെ വിലയിരുത്തുന്നതിന്, ട്യൂറിംഗ് ടെസ്റ്റ് സമഗ്രമായി ധാർമ്മിക ഘടകങ്ങളും ഫലപ്രദമായി ആശയവിനിമയം നടത്താനുള്ള കഴിവും പരിഗണിക്കുന്ന തരത്തിൽ പരിണമിക്കേണ്ടതുണ്ട്.

 

എഴുത്തുകാരനെ കുറിച്ച്