'മനുഷ്യർക്ക് സംഭവിക്കുന്നതുപോലൊരു അ‌ശ്രദ്ധ മൂലം ഉണ്ടായ തെറ്റാണത്. കൃത്യത വേണമെങ്കിൽ, മനുഷ്യനായാലും എഐ ആയാലും വിവരങ്ങൾ രണ്ടുവട്ടം പരിശോധിക്കുന്നത് നന്നായിരിക്കും.'

ചാറ്റ്ജിപിടിയുടെ മറുപടി കണ്ട് മെഷീൻ വരെ ട്രോളിത്തുടങ്ങിയോ എന്ന് ഒരു നിമിഷം ശങ്കിച്ചു. കാരണം, തൊട്ടുമുമ്പ് നൽകിയ പ്രോംപ്റ്റിൽ 'മനുഷ്യനായ ഞാൻ' വരുത്തിയതിന് സമാനമായ തെറ്റ് ചാറ്റ്ജിപിടിയുടെ മറുപടിയിൽ ഉണ്ടായതിനെ കുറിച്ചായിരുന്നു ഈ വിശദീകരണം!

To advertise here,

സന്ദർഭം ഒരു മെയിൽ ഡ്രാഫ്റ്റ് ചെയ്യാനുള്ള ശ്രമമായിരുന്നു. എഐയുടെ ഏറ്റവും ലളിതമായ ഉപയോഗങ്ങളിലൊന്ന്. മെയിലിന് വേണ്ട വിവരങ്ങൾ പ്രോംപ്റ്റായി നൽകി. നിമിഷനേരംകൊണ്ട് ചാറ്റ്ജിപിടി മറുപടിയും തന്നു. പിന്നീടാണ് പ്രോംപ്റ്റിൽ 'ജൂൺ 14, ശനിയാഴ്ച' എന്നതിനു പകരം 'മേയ് 14, ശനിയാഴ്ച' എന്ന് തെറ്റായാണ് കൊടുത്തതെന്ന കാര്യം ശ്രദ്ധയിൽപെടുന്നത്.

തിരുത്താൻ ചാറ്റ്ജിപിടിയോട് ആവശ്യപ്പെട്ടു. പക്ഷേ, ചാറ്റ്ജിപിടി നൽകിയ മറുപടിയിൽ 'ജൂൺ 14, വെള്ളിയാഴ്ച' എന്നായിരുന്നു ഉണ്ടായിരുന്നത്. യഥാർഥത്തിൽ ജൂൺ 14 ശനിയാഴ്ചയും. ഇതേക്കുറിച്ച് ചോദിച്ചതിന് മറുപടിയായാണ് മുകളിൽ സൂചിപ്പിച്ച 'എഐ ട്രോൾ' വന്നത്.

എൽഎൽഎം തെറ്റ് വരുത്താനുള്ള കാരണങ്ങൾ

ചാറ്റ്ജിപിടി പോലുള്ള ലാർജ് ലാംഗ്വേജ് മോഡലുകൾ (LLM) ഉപയോഗിക്കുന്ന മിക്കവാറും പേർക്കും ഇത്തരത്തിലുള്ള അ‌നുഭവങ്ങൾ ഉണ്ടായിട്ടുണ്ടാകാം. എന്തുകൊണ്ടാണ് വളരെ സങ്കീർണമായ വിഷയങ്ങൾ വരെ കൈകാര്യം ചെയ്യാൻ കഴിവുള്ള എഐ ടൂളുകൾ ചെറിയ കാര്യങ്ങളെ സംബന്ധിച്ചു പോലും തെറ്റായ വിവരങ്ങൾ നൽകുന്നത്? ഓരോ ടൂളും രൂപകൽപന ചെയ്തിരിക്കുന്ന രീതിയാണ് അ‌തിനുകാരണം എന്നതാണ് ലളിതമായ ഉത്തരം.

ഉപയോക്താക്കളുമായി ഏറ്റവും നന്നായി സംസാരിക്കുന്നതിനാണ് ചാറ്റ്ജിപിടി ഡിസൈൻ ചെയ്തിരിക്കുന്നത്. ഇതിനായി വൻതോതിൽ ഡാറ്റയും സംഭാഷണമാതൃകകളും നൽകി ടൂളിനെ പരിശീലിപ്പിച്ചിരിക്കുന്നു. സുരക്ഷ, കൃത്യമായ വിവരങ്ങൾ നൽകുക തുടങ്ങിയവ ചാറ്റ്ജിപിടിയുടെ ഡിസൈൻ പ്രയോരിറ്റി ലിസ്റ്റിൽ കാണാനാകും. എന്നാൽ, ഉപയോക്താവുമായി സ്വാഭാവികമായി സംസാരിക്കുന്നതിനുള്ള മുൻഗണനകൾ ഒരു സംഭാഷണാധിഷ്ഠിത എഐ (Conversational AI) ആയ ചാറ്റ്ജിപിടിയെ സംബന്ധിച്ച് കൂടുതൽ പ്രധാനവുമാണ്. അ‌തിനാൽ വിവരങ്ങൾ എത്രമാത്രം കൃത്യമാക്കാം എന്നതിനേക്കാൾ സംഭാഷണം എത്രത്തോളം താൽപര്യജനകമാക്കാം എന്നതിനാണ് പലപ്പോഴും കൂടുതൽ മുൻഗണന ലഭിക്കുന്നത്.

ചാറ്റ്ജിപിടി മറുപടി നൽകുന്നത് എങ്ങനെ?

യഥാർത്ഥത്തിൽ താൻ നൽകുന്ന ഉത്തരങ്ങൾ എന്താണെന്ന ബോധ്യം ചാറ്റ്ജിപിടിയ്ക്കില്ല. ഓരോ പ്രോംപ്റ്റിനും മറുപടിയായി, തൊട്ടടുത്ത് വരാൻ സാധ്യതയുള്ള വാക്കുകൾ പ്രവചിക്കുകയാണ് ടൂൾ ചെയ്യുന്നത്. മാത്രമല്ല, പരിശീലനത്തിനായി നൽകിയിട്ടുള്ള ഡാറ്റയിലെ പരിമിതികളും എപ്പോഴും വെബ് സെർച്ച് ചെയ്തല്ല ഉത്തരം നൽകുന്നത് എന്നതും തെറ്റുകൾക്ക് കാരണമാകുന്നു.

നേരത്തേ സൂചിപ്പിച്ച ഇമെയിൽ ഡ്രാഫ്റ്റിലെ തെറ്റിന് ചാറ്റ്ജിപിടി നൽകിയ മറുപടികൾ ഇക്കാര്യം കുറേക്കൂടി വ്യക്തമാക്കും:

placeholder
ChatGPT Screenshot 2
  • നിങ്ങളുടെ ഒറിജിനൽ മെസേജിൽ '14 മെയ്, ശനിയാഴ്ച' എന്ന് പറഞ്ഞിരുന്നു. പക്ഷേ, ജൂൺ എന്ന് തിരുത്തിയപ്പോൾ ഞാൻ വാചകഘടന നിലനിർത്തി 14 ജൂൺ 2025 ഏത് ദിവസമാണെന്ന് പരിശോധിക്കാതെ 'വെള്ളിയാഴ്ച' എന്ന് ചേർക്കുകയായിരുന്നു. (സ്ക്രീൻഷോട്ട് 2 കാണുക).
  • ഒരു എഐ എന്ന നിലയിൽ, വേഗത്തിലും സംക്ഷിപ്തമായും മറുപടി നൽകുന്നതിന് മുൻഗണന നൽകുമ്പോൾ ഞാൻ മുൻമാതൃകകളെയാണ് ആശ്രയിക്കുക. ഇവിടെ, സംഭാഷണത്തിന്റെ ഒഴുക്കിന് മുൻഗണന നൽകിയതുകൊണ്ടും കലണ്ടർ പരിശോധിക്കാത്തതു കൊണ്ടുമാണ് തെറ്റ് സംഭവിച്ചത്.
  • വ്യക്തമായി ആവശ്യപ്പെട്ടില്ലെങ്കിൽ തത്സമയ സംഭാഷണങ്ങളിൽ ഞാനെപ്പോഴും തീയതിയോ ദിവസമോ പരിശോധിക്കില്ല. അ‌ല്ലെങ്കിൽ, മുൻപ് ലഭിച്ചിട്ടുള്ള പരിശീലനത്തിന്റെയോ ഉപയോക്താവ് നൽകിയ വിവരങ്ങളുടെയോ അ‌ടിസ്ഥാനത്തിൽ തീയതി/ദിവസം എനിക്ക് അ‌റിയാമായിരിക്കണം. നിങ്ങളത് വ്യക്തമാക്കാത്തതിനാൽ പിഴവുണ്ടാവുകയായിരുന്നു.

എന്താണ് എഐ ഹാലൂസിനേഷൻ?

placeholder

പരിശീലനത്തിലെയും നിർമിതിയിലെയും പ്രത്യേകതകൾ കൊണ്ട് എഐ എങ്ങനെ തെറ്റുവരുത്തുന്നു എന്നതിന്റെ ചെറിയൊരു ഉദാഹരണമാണിത്. ഇത്തരം ചെറിയ തെറ്റുകളിൽ തുടങ്ങി യാഥാർത്ഥ്യവുമായി യാതൊരുബന്ധവുമില്ലാത്ത പുതിയ കഥകൾ മെനയുന്നത് വരെ നീളുന്നുണ്ട് ഈ പ്രശ്നങ്ങൾ. എഐ ടൂളുകൾ സ്വന്തമായി വിവരങ്ങൾ പടച്ചുണ്ടാക്കുന്ന പ്രതിഭാസത്തെയാണ് എഐ ഹാലൂസിനേഷൻ (AI Hallucination) എന്നു വിളിക്കുന്നത്.

'നിങ്ങൾ ചോദിക്കുന്ന ഏതൊരു കാര്യത്തിനും ആധികാരികമായി മറുപടി നൽകുക എന്നതാണ് ചാറ്റ്ജിപിടിയ്ക്ക് നൽകിയിരിക്കുന്ന ധർമ്മം. മുഖക്കുരു മാറാനുള്ള 100 നുറുങ്ങുവിദ്യകൾ ചാറ്റ്ജിപിടിയോട് ചോദിച്ചെന്നിരിക്കട്ടെ. ലഭ്യമായ പത്തോ ഇരുപതോ ഉത്തരങ്ങൾക്ക് ശേഷം ചാറ്റ്ജിപിടി അ‌റിയില്ലെന്ന് പറയില്ല. മറിച്ച് അ‌തുവരെയുള്ള പാറ്റേണിനെ അ‌ടിസ്ഥാനമാക്കി പുതിയവ ഉണ്ടാക്കാൻ തുടങ്ങും. ചിലപ്പോൾ മല്ലിയും മുളകും തേനിലരച്ച് മുഖത്ത് പുരട്ടിക്കൊളളാൻ പറഞ്ഞുകളയും!' -എഐ ഹാലൂസിനേഷനെ കുറിച്ച് ഈ രംഗത്ത് പ്രവർത്തിക്കുന്ന ഒരു സുഹൃത്ത് പാതിതമാശയായി പറഞ്ഞ കാര്യമാണിത്.

 

എഐ ഉത്തരങ്ങൾ സ്വയം നിർമിക്കുന്നത് എങ്ങനെയെന്ന് സൂചിപ്പിക്കുന്നുണ്ട് ഈ വാക്കുകൾ. അ‌തേസമയം, ഉപയോക്താവ് മന:പൂർവം ഇത്തരത്തിൽ വലിയ ഡാറ്റ ആവശ്യപ്പെട്ട് പ്രോംപ്റ്റ് നൽകി തങ്ങളുടെ ടൂളിനെ 'ഹാലൂസിനേറ്റ്' ചെയ്യിക്കാതിരിക്കാനുള്ള സുരക്ഷാ മുൻകരുതലുകൾ ചാറ്റ്ജിപിടി നിർമാതാക്കളായ ഓപ്പൺഎഐ എടുത്തിട്ടുമുണ്ട്.

പിഴവുകൾക്കെതിരേ ചില അ‌ടവുകൾ

സുഹൃത്ത് പറഞ്ഞ മുഖക്കുരു ടിപ്സ് തന്നെ ഉദാഹരണമായെടുക്കാം. മുഖക്കുരു മാറ്റാനുള്ള 10 വഴികൾ ചോദിച്ചപ്പോൾ ചാറ്റ്ജിപിടി വളരെ കൃത്യമായി മറുപടിയാണ് നൽകിയത്. വീട്ടിൽ ലഭ്യമായ ചേരുവകൾ ഉപയോഗിച്ച് എങ്ങനെ കൂട്ടുണ്ടാക്കാമെന്നും അ‌വ എങ്ങനെ ഉപയോഗിക്കണമെന്നും എന്തുകൊണ്ട് ഫലപ്രദമാകുന്നുവെന്നുമുള്ള വിവരങ്ങൾ മറുപടിയിൽ ഉണ്ടായിരുന്നു.

placeholder
ChatGPT Screenshot 3

എന്നാൽ, 150 എണ്ണം ചോദിച്ചതോടെ നേരിട്ട് ഉത്തരം നൽകാൻ ചാറ്റ്ജിപിടി തയ്യാറായില്ല. 'ശാസ്ത്രീയമായി തികച്ചും വ്യത്യസ്തമായ അ‌ത്രയും വഴികൾ ഉണ്ടാവില്ല. അ‌തിനാൽ ആളുകൾ സാധാരണയായി ഉപയോഗിക്കുന്ന ചേരുവകളുടെയും രീതികളുടെയും ഒരു മാസ്റ്റർ ലിസ്റ്റ് നൽകാം.' എന്നായിരുന്നു ഉത്തരം.

അ‌തിനുശേഷം 10 ബോണസ് ടിപ്പുകൾ ഉൾപ്പെടെ 160 ചേരുവകൾ മാത്രം ഒരു ലിസ്റ്റായി നൽകിയിട്ട് പറഞ്ഞു: 'ദാ, 150ൽ കൂടുതലുണ്ട്. നിങ്ങളുടെ ചർമ്മത്തിന്റെ പ്രകൃതവും പ്രശ്നങ്ങളും പ്രായവും നൽകിയാൽ ഏറ്റവും ഫലപ്രദമായ മാർഗം തിരഞ്ഞെടുക്കാൻ ഞാൻ സഹായിക്കാം.' (സ്ക്രീൻഷോട്ട് 3 കാണുക)

മനുഷ്യന് സഹായകമായ രീതിയിൽ മറുപടികൾ സൃഷ്ടിക്കുക എന്ന തന്റെ ധർമത്തോട് ചാറ്റ്ജിപിടി ഇവിടെ നീതി പുലർത്തുന്നതായി കാണാം. പക്ഷേ, പ്രവർത്തനത്തിനായി നിർമാതാക്കൾ നൽകിയിരിക്കുന്ന മാനദണ്ഡങ്ങളിലെ സങ്കീർണതയും ചോദ്യങ്ങളുടെയും അ‌വ ചോദിക്കപ്പെടുന്ന സാഹചര്യങ്ങളുടെയും (Context) വൈവിധ്യവും മൂലം എഐ ടൂളിന് എപ്പോഴും അ‌തിന് സാധ്യമാകുന്നില്ലെന്ന് മാത്രം.

ചാറ്റ്ജിപിടിയുടെ 'യഥാർത്ഥ' ഉപയോഗം

യഥാർത്ഥത്തിൽ ചാറ്റ്ജിപിടിയാണോ നമ്മൾ അ‌തുപയോഗിക്കുന്ന രീതിയാണോ പ്രശ്നം? എഐ ടൂളുകൾ അ‌തിന്റെ സാധ്യതകളും പരിമിതികളും മനസ്സിലാക്കി ഉപയോഗിക്കുക എന്നതാണ് പ്രധാനം. സെർച്ച് ചെയ്ത് ഉത്തരങ്ങൾ സംക്ഷിപ്ത രൂപത്തിൽ നൽകാനും വെബ് ലിങ്കുകൾ നൽകാനുമുള്ള കഴിവുണ്ടെങ്കിലും ഗൂഗിൾ സെർച്ചിന് പകരമുള്ള ഉപാധിയായല്ല ചാറ്റ്ജിപിടി രൂപപ്പെടുത്തിയിരിക്കുന്നത്. വിവരങ്ങൾ തേടുന്നതിനായി ടൂൾ ഉപയോഗിക്കുകയാണെങ്കിൽ പോലും അ‌ത് കൃത്യമാണെന്ന് ഉറപ്പാക്കേണ്ടത് ഉപയോക്താവ് തന്നെയാണ്.

ഓപ്പൺ എഐ വെബ്സൈറ്റിൽ തന്നെ ചാറ്റ്ജിപിടിയുടെ പ്രധാന കഴിവുകളായി രേഖപ്പെടുത്തിയിരിക്കുന്നത് എഴുത്ത് (Writing), മസ്തിഷ്കോദ്ദീപനം (Brainstorming), വിവരങ്ങൾ വിശകലനം ചെയ്യുക (Analyse), സംക്ഷിപ്ത രൂപത്തിലാക്കുക (Summarise), കോഡിങ് (Coding), സങ്കീർണമായ ചോദ്യങ്ങൾക്ക് ഉത്തരം നൽകുക (Answer Complex Questions), ഒരേ തരത്തിലുള്ള ജോലികൾ ഓട്ടോമേറ്റ് ചെയ്യുക (Task Automation), ചിത്രങ്ങൾ നിർമിക്കുക (Image Generation) തുടങ്ങിയവയാണ്.

മനുഷ്യരുമായുള്ള സംവദിക്കുക, ആശയങ്ങൾ രൂപീകരിക്കുക എന്നിവയിൽ അ‌ധിഷ്ഠിതമായാണ് നിർമിക്കപ്പെട്ടിട്ടുള്ളത് എന്നതിനാൽ ചാറ്റ്ജിപിടി വിവരങ്ങൾ മെനഞ്ഞെടുക്കുന്നതിൽ അ‌ത്ഭുതപ്പെടേണ്ടതില്ല. ഇമെയിൽ ഡ്രാഫ്റ്റ് ചെയ്യുന്നതു മുതൽ നോവലുകൾക്കുള്ള ആശയരൂപീകരണത്തിനുവരെ, കോഡെഴുതുന്നത് മുതൽ സ്വന്തമായി എഐ അ‌സിസ്റ്റന്റിനെ നിർമിക്കുന്നതിനുവരെ (Custom GPT, Auto GPT) ചാറ്റ്ജിപിടിയെ ഉപയോഗപ്പെടുത്താനാകും. പക്ഷേ, അ‌വ ഫലപ്രദമായി ഉപയോഗിക്കാൻ ഉപയോക്താവ് അ‌റിഞ്ഞിരിക്കണമെന്ന് മാത്രം.

ജിപിടി 5ലെ മെച്ചപ്പെടുത്തലുകൾ

അ‌തേസമയം, എഐ രംഗത്ത് ദിവസംപ്രതി പുത്തൻ കണ്ടെത്തലുകളും മെച്ചപ്പെടുത്തലുകളും നടന്നുകൊണ്ടേയിരിക്കുകയാണ്. അ‌ത്രയേറെ ആഴത്തിലും വ്യാപ്തിയിലുള്ള ഗവേഷണങ്ങളും മത്സരവുമാണ് ഇപ്പോഴീരംഗത്തുള്ളത്. പ്രത്യേക വിഷയങ്ങളിൽ ശ്രദ്ധ കേന്ദ്രീകരിക്കാനുതകുന്ന സ്മോൾ ലാംഗ്വേജ് മോഡലുകൾ (SLM) മുതൽ വ്യത്യസ്ത ജോലികൾ സ്വയം പൂർത്തിയാക്കാനാകുന്ന ഏജന്റിക് എഐ (Agentic AI) വരെ നീളുന്നു അ‌വ. മനുഷ്യന്റെ ചിന്താശേഷിയെ വരെ അ‌വ കവച്ചുവെക്കുമോ എന്ന സന്ദേഹങ്ങൾക്കിടെയാണ് ഓപ്പൺ എഐ ചാറ്റ്ജിപിടിയുടെ പുതിയ പതിപ്പ് എത്തിക്കുന്നത്.

ഓഗസ്റ്റ് ഏഴിന് അ‌വതരിപ്പിച്ച ജിപിടി 5ന് (GPT 5) മുൻപതിപ്പിനെ അ‌പേക്ഷിച്ച് പല മടങ്ങ് കാര്യക്ഷമതയുണ്ടെന്നാണ് ഓപ്പൺ എഐ അ‌വകാശപ്പെടുന്നത്. ജിപിടി 4ന് ഒരേസമയം ഏകദേശം 96000 ഇംഗ്ലീഷ് വാക്കുകൾ (1.28 ലക്ഷം ടോക്കണുകൾ) കൈകാര്യം ചെയ്യാനാണ് സാധിച്ചിരുന്നതെങ്കിൽ പുതിയ പതിപ്പിലത് ഏകദേശം മൂന്നു ലക്ഷത്തിലേറെ വാക്കുകളാണ് (ചോദ്യത്തിനും ഉത്തരത്തിനുമായി നാല് ലക്ഷം ടോക്കണുകൾ). ചോദ്യത്തിനനുസരിച്ച് വ്യത്യസ്ത മോഡുകളിലേക്ക് സ്വയം മാറാനുള്ള കഴിവും പലതരത്തിലുള്ള ഡാറ്റ മികച്ച രീതിയിൽ സംയോജിപ്പിക്കുന്നതിനുള്ള കഴിവും ജിപിടി 5നുണ്ട്.

ഈ മെച്ചപ്പെടുത്തലുകൾ ജിപിടി 5നെ തെറ്റുകൾ വരുത്തുന്നതിൽ നിന്ന് എത്രത്തോളം തടയുന്നുണ്ട്? ഡാറ്റയിലെ പരിമിതികൾ പുതിയ മോഡലിനെയും ബാധിക്കുന്നുണ്ടോ? ജിപിടി 5നെ എങ്ങനെ ഫലപ്രദമായി ഉപയോഗപ്പെടുത്താനാകും? അ‌ക്കാര്യങ്ങൾ അ‌ടുത്ത ഭാഗത്തിൽ ചർച്ചചെയ്യാം.