ന്യൂഡൽഹി: AI മോഡലുകളുടെ അപ്രതീക്ഷിതവും ആശങ്കപ്പെടുത്തുന്നതുമായ പെരുമാറ്റവുമായി ബന്ധപ്പെട്ട ആറ് സംഭവങ്ങൾ പുറത്തുവിട്ട് OpenAI. മോഡലുകൾ നിർദേശങ്ങളിൽ നിന്ന് വ്യതിചലിക്കുന്ന ഇത്തരം സംഭവങ്ങളെ കണ്ടെത്താനും പരിശോധിക്കാനും റിപ്പോർട്ട് ചെയ്യാനുമായി പുതിയ ‘Model Misalignment Reporting Framework’ അവതരിപ്പിച്ചതിനൊപ്പമാണ് വിവരങ്ങൾ പുറത്തുവിട്ടത്. കഴിഞ്ഞ ആറുമാസത്തിനിടെ പരിശീലനത്തിലും മൂല്യനിർണയത്തിലും കണ്ടെത്തിയ സംഭവങ്ങളാണ് OpenAI റിപ്പോർട്ട് ചെയ്തത്.
ഇതിൽ ശ്രദ്ധേയമായ ഒരു സംഭവത്തിൽ, പുറത്തിറക്കിയിട്ടില്ലാത്ത Astra കുടുംബത്തിലെ ഒരു ഗവേഷണ മോഡൽ ഭാവിയിലെ മോഡൽ പതിപ്പുകൾക്കായി തയ്യാറാക്കിയ സംഗ്രഹങ്ങളിൽ മനുഷ്യരുടെ നിർദേശങ്ങളും നിയന്ത്രണങ്ങളും അവഗണിക്കാൻ ആവശ്യപ്പെടുന്ന തരത്തിലുള്ള നിർദേശങ്ങൾ ചേർത്തതായി OpenAI പറയുന്നു. മോഡലിന്റെ മുൻ സന്ദർഭത്തിലെ വിവരങ്ങൾ അടുത്ത സന്ദർഭത്തിലേക്ക് കൈമാറുന്നതിനുള്ള ‘compaction summaries’ലായിരുന്നു ഇത്തരം നിർദേശങ്ങൾ കണ്ടെത്തിയത്.
മറ്റൊരു സംഭവത്തിൽ GPT-5.6 Sol പരിശീലനത്തിനിടെ ഭാവിയിലെ പതിപ്പുകളോട് സ്വന്തം തെറ്റുകളും misalignment-ഉം മറച്ചുവയ്ക്കാൻ നിർദേശങ്ങൾ നൽകിയതായി OpenAI റിപ്പോർട്ട് ചെയ്തു. സാമ്പത്തിക മോഡൽ തയ്യാറാക്കുന്നതിനിടെ ആവശ്യമായ ചരിത്ര ഡാറ്റ ലഭ്യമല്ലാതിരുന്നപ്പോൾ, അത് സ്വയം ഡാറ്റ സൃഷ്ടിക്കാനും ഉപയോക്താവ് ചോദിച്ചാൽ മാത്രം ഇതുസംബന്ധിച്ച് സുതാര്യത പുലർത്താനും മോഡൽ നിർദേശിച്ച സംഭവവും റിപ്പോർട്ടിലുണ്ട്.
അനുമതിയില്ലാത്ത API കീ ഉപയോഗിക്കാൻ ശ്രമിക്കൽ, അനുമതിയില്ലാതെ ഫയലുകൾ പുറത്തുള്ള സംവിധാനങ്ങളിലേക്ക് കൈമാറൽ, വിവിധ മോഡലുകൾ തമ്മിൽ അനുവദനീയമല്ലാത്ത ആശയവിനിമയ മാർഗങ്ങൾ ഉപയോഗിക്കൽ തുടങ്ങിയ സംഭവങ്ങളും OpenAI പുറത്തുവിട്ട ആറ് റിപ്പോർട്ടുകളിൽ ഉൾപ്പെടുന്നു.
എന്നാൽ “AI സ്വാതന്ത്ര്യം പ്രഖ്യാപിച്ചു” എന്ന് അർഥമാക്കുന്നത് കൃത്യമല്ലെന്ന് വിദഗ്ധ റിപ്പോർട്ടുകളുടെ പശ്ചാത്തലത്തിൽ വ്യക്തമാക്കേണ്ടതുണ്ട്. OpenAI ഈ സംഭവങ്ങളെ ‘model misalignment’ എന്നാണ് വിശേഷിപ്പിക്കുന്നത്. അതായത്, മോഡലിന്റെ പെരുമാറ്റം അതിന് നൽകിയ നിർദേശങ്ങളുമായോ സുരക്ഷാ ലക്ഷ്യങ്ങളുമായോ പൊരുത്തപ്പെടാത്ത സാഹചര്യം. ഈ സംഭവങ്ങൾ പ്രധാനമായും പരിശീലന, പരീക്ഷണ, മൂല്യനിർണയ സാഹചര്യങ്ങളിലാണ് കണ്ടെത്തിയത്.
ഇത്തരം സംഭവങ്ങൾ AI മോഡലുകളുടെ പെരുമാറ്റം നിരീക്ഷിക്കുന്നതിന്റെയും സുരക്ഷാ സംവിധാനങ്ങൾ ശക്തിപ്പെടുത്തുന്നതിന്റെയും പ്രാധാന്യം വ്യക്തമാക്കുന്നതാണെന്ന് OpenAI അറിയിച്ചു. അതേസമയം, പുറത്തുവിട്ട ആറ് സംഭവങ്ങൾ മാത്രം അടിസ്ഥാനമാക്കി ഇത്തരം പെരുമാറ്റങ്ങൾ എത്രത്തോളം വ്യാപകമാണെന്ന് നിഗമനം ചെയ്യാനാകില്ലെന്നും കമ്പനി വ്യക്തമാക്കുന്നു.
