ChatGPT എങ്ങനെ പ്രവർത്തിക്കുന്നു?
ChatGPT എന്താണ്?
ChatGPT, OpenAI എന്ന കമ്പനി വികസിപ്പിച്ച ഒരു AI ചാറ്റ്ബോട്ടാണ്. ഇതിന്റെ അടിസ്ഥാനം GPT (Generative Pre-trained Transformer) എന്ന ലാർജ് ലാംഗ്വേജ് മോഡൽ ആണ്. ഇത്തരം മോഡലുകൾ ടെക്സ്റ്റിലെ പാറ്റേണുകൾ പഠിച്ച്, ഒരു വാചകത്തിന് ഏറ്റവും യോജിക്കുന്ന അടുത്ത വാക്ക് പ്രവചിച്ചാണ് മറുപടികൾ ഉണ്ടാക്കുന്നത്. ChatGPT-യെ പ്രത്യേകമാക്കുന്നത്, ഇത് ഒരു "ചാറ്റ്" ഫോർമാറ്റിൽ പ്രവർത്തിക്കാൻ പ്രത്യേകം പരിശീലിപ്പിച്ചതാണ് എന്നതാണ് — അതായത്, ചോദ്യോത്തര രീതിയിൽ, തുടർച്ചയായ സംഭാഷണം ഓർത്തുവച്ച്, ഉപകാരപ്രദമായ രീതിയിൽ മറുപടി നൽകാൻ ഇതിനെ ട്യൂൺ ചെയ്തിരിക്കുന്നു.
ഒരു പ്രോംപ്റ്റ് നൽകുമ്പോൾ എന്താണ് സംഭവിക്കുന്നത്?
നിങ്ങൾ ഒരു ചോദ്യം ടൈപ്പ് ചെയ്യുമ്പോൾ, ആദ്യം ആ ടെക്സ്റ്റ് "ടോക്കണുകൾ" ആയി വിഭജിക്കപ്പെടുന്നു. ഈ ടോക്കണുകൾ, നിങ്ങളുടെ മുൻ സംഭാഷണത്തിന്റെ ചരിത്രം (context) കൂടെച്ചേർത്ത്, മോഡലിലേക്ക് നൽകപ്പെടുന്നു. മോഡൽ ഈ മുഴുവൻ ടെക്സ്റ്റും ഒറ്റയടിക്ക് "വായിച്ച്", ഏറ്റവും സാധ്യതയുള്ള അടുത്ത ടോക്കൺ ഏതെന്ന് കണക്കുകൂട്ടുന്നു. ഈ ടോക്കൺ തിരഞ്ഞെടുത്ത ശേഷം, അതിനെ നിലവിലെ ടെക്സ്റ്റിനോട് കൂട്ടിച്ചേർത്ത്, വീണ്ടും അടുത്ത ടോക്കൺ പ്രവചിക്കുന്നു — ഈ പ്രക്രിയ ഒരു പൂർണ്ണ മറുപടി ഉണ്ടാകുന്നതുവരെ, സെക്കൻഡിൽ പലതവണ ആവർത്തിക്കും. ഇതുകൊണ്ടാണ് ChatGPT-യുടെ മറുപടി വാക്ക് വാക്കായി, സ്ക്രീനിൽ എഴുതിവരുന്നത് പോലെ തോന്നുന്നത്.
"കോൺടെക്സ്റ്റ് വിൻഡോ" എന്നാൽ എന്ത്?
ഓരോ മോഡലിനും ഒരു സമയത്ത് എത്ര ടോക്കണുകൾ "ഓർത്തുവയ്ക്കാൻ" കഴിയും എന്നതിന് ഒരു പരിധിയുണ്ട് — ഇതിനെ "കോൺടെക്സ്റ്റ് വിൻഡോ" (context window) എന്ന് വിളിക്കുന്നു. ഈ പരിധിക്കുള്ളിൽ നിങ്ങളുടെ മുൻ ചോദ്യങ്ങളും ChatGPT-യുടെ മറുപടികളും എല്ലാം ഉൾപ്പെടും. സംഭാഷണം വളരെ നീണ്ടുപോയാൽ, ആദ്യഭാഗം "മറന്നുപോകാൻ" സാധ്യതയുണ്ട്, കാരണം അത് കോൺടെക്സ്റ്റ് വിൻഡോയ്ക്ക് പുറത്തേക്ക് പോകും. ഇതാണ് ചിലപ്പോൾ ദീർഘമായ സംഭാഷണങ്ങളിൽ ChatGPT നേരത്തെ പറഞ്ഞ കാര്യങ്ങൾ മറന്നതായി തോന്നുന്നതിന്റെ കാരണം. ഈ ടോക്കൺ എണ്ണം തന്നെയാണ് ഉപയോഗച്ചെലവ് കണക്കാക്കുമ്പോഴും അടിസ്ഥാന യൂണിറ്റാകുന്നത്.
മനുഷ്യ ഫീഡ്ബാക്കിന്റെ പങ്ക് (RLHF)
അസംസ്കൃതമായ ഒരു ഭാഷാ മോഡൽ മാത്രം ഉപകാരപ്രദമോ സുരക്ഷിതമോ ആയ ഒരു അസിസ്റ്റന്റ് ആകണമെന്നില്ല. അതിനാൽ, ChatGPT പോലുള്ള മോഡലുകളെ "RLHF" (Reinforcement Learning from Human Feedback) എന്ന രീതി ഉപയോഗിച്ച് കൂടുതൽ പരിശീലിപ്പിക്കുന്നു. ഇതിൽ, മോഡൽ നൽകുന്ന പല മറുപടികളും മനുഷ്യർ വിലയിരുത്തി, ഏതാണ് കൂടുതൽ ഉപകാരപ്രദവും സുരക്ഷിതവുമെന്ന് സൂചിപ്പിക്കുന്നു. ഈ ഫീഡ്ബാക്ക് ഉപയോഗിച്ച് മോഡലിനെ ക്രമേണ മെച്ചപ്പെടുത്തുന്നു. ഇതുകൊണ്ടാണ് ChatGPT പലപ്പോഴും മാന്യമായും, ഘട്ടംഘട്ടമായും, ചോദ്യത്തിന് നേരിട്ട് ബന്ധപ്പെട്ട രീതിയിലും മറുപടി നൽകുന്നത്.
പരിമിതികൾ
- ചിലപ്പോൾ ആത്മവിശ്വാസത്തോടെ തെറ്റായ വിവരം നൽകാം (ഹാലുസിനേഷൻ)
- പരിശീലന ഡാറ്റയുടെ തീയതിക്ക് ശേഷമുള്ള സംഭവങ്ങൾ, ഇന്റർനെറ്റ് സെർച്ച് ഓണാക്കിയിട്ടില്ലെങ്കിൽ, അറിയില്ല
- കോൺടെക്സ്റ്റ് വിൻഡോയ്ക്ക് പുറത്തുള്ള പഴയ വിവരങ്ങൾ മറന്നുപോകാം
- ഗണിതം, യുക്തി എന്നിവയിൽ ചിലപ്പോൾ പിഴവുകൾ വരാം
ഉപസംഹാരം
ChatGPT ഒരു മാന്ത്രിക ബുദ്ധിയല്ല, മറിച്ച് ടോക്കൺ പ്രവചനത്തിലൂടെ പ്രവർത്തിക്കുന്ന, മനുഷ്യ ഫീഡ്ബാക്കിലൂടെ മെച്ചപ്പെടുത്തിയ ഒരു ഭാഷാ മോഡലാണ്. ഇത് എങ്ങനെ പ്രവർത്തിക്കുന്നു എന്ന് മനസ്സിലാക്കുന്നത്, നല്ല പ്രോംപ്റ്റുകൾ എഴുതാനും, അതിന്റെ ഉത്തരങ്ങൾ എപ്പോൾ ജാഗ്രതയോടെ കാണണം എന്ന് തിരിച്ചറിയാനും സഹായിക്കും.