ARKONE
Two mail slots side by side in an office door, one marked with a lock

നിങ്ങളുടെ AI ഏജന്റുകൾ അയയ്ക്കുന്നത് നിയന്ത്രിക്കുക: ഫിൽട്ടർ ഒന്നല്ല, രണ്ട്

August 9, 2026 · 5 min read

S
Sobin George Thomas

വാചകവും കോഡും ഉണ്ടാക്കുന്നത് ഏതാണ്ട് സൗജന്യമായി; അവയെ വിലയിരുത്തുന്നത് അങ്ങനെയായില്ല. സമഗ്രതാ നിയന്ത്രണവും ആവിഷ്കാര വിവേചനവും ഒന്നായി കൈകാര്യം ചെയ്യുന്ന സ്ഥാപനങ്ങൾ രണ്ടാമത്തേതിനെ കാക്കാൻ ആദ്യത്തേതിനെ പതുക്കെയാക്കുന്നു. സ്വന്തം ഏജന്റുകൾ ജീവനക്കാരെക്കാൾ കൂടുതൽ അയച്ചുതുടങ്ങുന്ന അതേ നിമിഷത്തിൽ.

This article was translated from the English original. Translations are machine-assisted and reviewed on a rolling basis.

വാചകമായാലും കോഡായാലും, സാമഗ്രി ഉണ്ടാക്കുന്നത് ഏതാണ്ട് സൗജന്യമായിക്കഴിഞ്ഞു. അതിനെ വിലയിരുത്തുന്നത് അങ്ങനെയായില്ല. ഈ ഒറ്റ അസമത്വമാണ് പരസ്പരബന്ധമില്ലെന്നു തോന്നുന്ന രണ്ടു പ്രശ്നങ്ങൾക്കും അടിയിൽ കിടക്കുന്നത്: ഓരോ പ്രവർത്തനത്തിലും സ്വയം എഴുതിമാറ്റുന്ന മാൽവെയർ, പിന്നെ ആരും വായിക്കാതെ നിങ്ങളുടെ സ്വന്തം സിസ്റ്റങ്ങളിൽനിന്ന് പുറത്തുപോകുന്ന, ഏജന്റുകൾ തയ്യാറാക്കിയ ഇമെയിലുകളുടെയും ടിക്കറ്റുകളുടെയും കോഡ് കമ്മിറ്റുകളുടെയും പ്രവാഹം.

2025-ൽ, ESET ഗവേഷകർ PromptLock കണ്ടെത്തി — AI പ്രവർത്തിപ്പിക്കുന്ന ആദ്യത്തെ അറിയപ്പെടുന്ന റാൻസംവെയർ: പ്രവർത്തനസമയത്ത് ഒരു ഭാഷാ മോഡലിനെ വിളിച്ച് സ്വന്തം ദുഷ്ട സ്ക്രിപ്റ്റുകൾ അപ്പപ്പോൾ ഉണ്ടാക്കുന്ന മാൽവെയർ. അത് ഒരു അക്കാദമിക് തെളിവുമാത്രമായിരുന്നു, ഒരു യഥാർത്ഥ ആക്രമണത്തിലും കണ്ടിട്ടില്ല. അതിനെ ആശ്വാസമായി കാണുന്നതാണ് തെറ്റ്. പ്രസക്തമായ വസ്തുത ഒരു പുതിയ വകഭേദത്തിന്റെ അധിക ചെലവാണ് — അത് ഏതാണ്ട് ഒരു ഇൻഫറൻസ് കോളിന്റെ വിലയിലേക്ക് വീണിരിക്കുന്നു.


ആക്രമണകാരിയുടെ കോഡ് ഈടുനിൽക്കുന്ന ഒരു വസ്തുവല്ലാതായി

ആന്റിവൈറസിന്റെ സാമ്പത്തികശാസ്ത്രം ഒരു നിശ്ശബ്ദ അനുമാനത്തിൽ ഉറച്ചതായിരുന്നു: ശരിക്കും പുതിയ മാൽവെയർ എഴുതുന്നത് ചെലവേറിയതാണ്, അതിനാൽ ആക്രമണകാരികൾ കോഡ് വീണ്ടും ഉപയോഗിക്കുന്നു, അതിനാൽ സാമ്പിളുകളുടെ കുടുംബങ്ങൾ ഒരേ സിഗ്നേച്ചർ പങ്കിടുന്നു, അതിനാൽ ഒരൊറ്റ വിശകലനം ദശലക്ഷക്കണക്കിന് എൻഡ്‌പോയിന്റുകളെ സംരക്ഷിക്കുന്നു. ആക്രമണത്തെക്കാൾ നന്നായി കണ്ടെത്തൽ വളർന്നു. കളി മുഴുവൻ അതായിരുന്നു.

പ്രവർത്തനസമയത്ത് ഉണ്ടാക്കപ്പെടുന്ന മാൽവെയർ ഈ പുനരുപയോഗം തകർക്കുന്നു. ഓരോ പ്രവർത്തനത്തിലും ഒരു സാമ്പിൾ സ്വന്തം ലോഡർ വീണ്ടും ഉണ്ടാക്കുമ്പോൾ, സിഗ്നേച്ചർ എടുക്കാൻ ഒരു കുടുംബമില്ല. ആദ്യ സാമ്പിളുകൾ അപക്വമാണ്; പ്രധാനം അതിന്റെ ഗതിയാണ്.

പ്രതിരോധത്തിനുള്ള ഫലം ഇന്നത്തെ മിക്ക സുരക്ഷാ ബജറ്റുകൾക്കും എതിരാണ്. സിഗ്നേച്ചറുകൾ ദുർബലമാകുന്നെങ്കിൽ, പണം പെരുമാറ്റത്തിലേക്ക് നീങ്ങും: ഒരു പ്രോസസ് ഫയൽ സിസ്റ്റത്തോട്, നെറ്റ്‌വർക്കിനോട്, ക്രെഡൻഷ്യൽ സ്റ്റോറിനോട് യഥാർത്ഥത്തിൽ എന്തു ചെയ്യുന്നു എന്നതിലേക്ക്. പെരുമാറ്റാധിഷ്ഠിത കണ്ടെത്തൽ എപ്പോഴും കൂടുതൽ ചെലവേറിയതും കൂടുതൽ തെറ്റായ മുന്നറിയിപ്പുകൾ തരുന്നതുമായ വഴിയായിരുന്നു, അതുകൊണ്ടാണ് അത് ഒരു അനുബന്ധമായി മാത്രം നിന്നത്. ഇപ്പോൾ അതാണ് മുൻനിര, പക്ഷേ മിക്ക സ്ഥാപനങ്ങളിലും ബജറ്റ് ഇതുവരെ നീങ്ങിയിട്ടില്ല.


നേരത്തേ എത്തുന്ന അളവിന്റെ പ്രശ്നം നിങ്ങളുടെ സ്വന്തം ഏജന്റുകളാണ്

ഉൽപ്പാദനച്ചെലവിലെ അതേ തകർച്ച നിങ്ങളുടെ സ്വന്തം സിസ്റ്റങ്ങൾ ഉണ്ടാക്കുന്ന സാമഗ്രിക്കും ബാധകമാണ്. ഉപഭോക്തൃ ഇമെയിലുകൾ തയ്യാറാക്കാനും സപ്പോർട്ട് ടിക്കറ്റുകൾ ഇടാനും കോഡ് കമ്മിറ്റ് ചെയ്യാനും ഏജന്റുകളെ പ്രവർത്തിപ്പിക്കുന്ന ഒരു സ്ഥാപനം, അയയ്ക്കുന്നതിനു മുൻപ് ആരും വായിക്കാത്ത ഉൽപ്പന്നങ്ങളുടെ നിർമ്മാണം വ്യവസായവൽക്കരിച്ചിരിക്കുന്നു. സാമൂഹ്യ പ്ലാറ്റ്‌ഫോമുകളിൽ എല്ലാം മനുഷ്യർ പരിശോധിക്കുന്നത് അസാധ്യമാക്കിയ ആ അളവിന്റെ വാദം, ഇപ്പോൾ 400 ജീവനക്കാരുള്ള സ്ഥാപനങ്ങൾക്കുള്ളിൽ എത്തുകയാണ്.

ഇത് ഏജന്റുകളെ പതുക്കെയാക്കാനുള്ള കാരണമല്ല. ഏതൊക്കെ പരിശോധനകൾ എല്ലാത്തിലും സ്വയമേവ നടക്കുന്നു, ഏതൊക്കെ തീരുമാനങ്ങൾക്ക് ഇപ്പോഴും പേരുള്ള ഒരു മനുഷ്യൻ വേണം എന്ന് കൃത്യമായി അറിയാനുള്ള കാരണമാണ്. ഈ വ്യത്യാസം തിരിച്ചറിയാൻ കഴിയാത്ത സ്ഥാപനങ്ങളിൽ ഒരേ സമിതി രണ്ടും പരിശോധിക്കുന്നതിൽ അവസാനിക്കും, അതായത് രണ്ടും നന്നായി പരിശോധിക്കപ്പെടില്ല.


സൗകര്യത്തിനുവേണ്ടി രണ്ടു ശേഷികൾ ഒന്നാക്കപ്പെട്ടു

“ഫിൽട്ടറിങ്” ഒരൊറ്റ ശേഷിയായി കാണുന്നതാണ് തന്ത്രപരമായ പിഴവ്. അത് രണ്ടാണ്, നേരെ വിപരീത അപകടസ്വഭാവങ്ങളോടെ.

സമഗ്രതാ നിയന്ത്രണം ഒരു ഉൽപ്പന്നം ആധികാരികമാണോ, പ്രവർത്തിപ്പിക്കാൻ സുരക്ഷിതമാണോ, അവകാശപ്പെടുന്ന ഇടത്തുനിന്നുതന്നെ വന്നതാണോ എന്ന് തീരുമാനിക്കുന്നു: സ്വയം മാറുന്ന ഒരു ബൈനറി തടയുക, വ്യാജ ഇൻവോയ്സ് നിരസിക്കുക, ഒരു ഏജന്റിന്റെ പുറത്തേക്കുള്ള API കോൾ തടഞ്ഞുവയ്ക്കുക. ഇത് എൻജിനീയറിങ്ങാണ്. രാഷ്ട്രീയമോ നിയമപരമോ ആയ അപകടസാധ്യത ഏതാണ്ട് ഇല്ല, ഇത് വിപുലീകരിക്കാനുള്ള കാരണം ഇപ്പോൾ ഗണ്യമായി ശക്തമായിരിക്കുന്നു.

ആവിഷ്കാര വിവേചനം അനുവദനീയവും ആധികാരികവുമായ ഒരു സന്ദേശം കൊണ്ടുപോകണോ എന്ന് തീരുമാനിക്കുന്നു: നിങ്ങളുടെ സ്ഥാപനം എന്തു പറയാൻ തയ്യാറാണ്, ആരോട്, ഏത് അധികാരപരിധിയിൽ. തർക്കമുള്ള അപകടസാധ്യത കിടക്കുന്നത് ഇവിടെയാണ്.

ഒരു റീട്ടെയിൽ ബാങ്ക് ഈ വിഭജനം വ്യക്തമായി കാണിക്കുന്നു. ഒരു റിലേഷൻഷിപ്പ് മാനേജർ ക്ലയന്റിനുള്ള ഇമെയിലിൽ ഏതൊക്കെ വാക്കുകൾ ഉപയോഗിക്കാം എന്ന നയം ആവിഷ്കാര വിവേചനമാണ് — തർക്കിക്കാവുന്നത്, അധികാരപരിധിക്കനുസരിച്ച് മാറുന്നത്, കുറയ്ക്കുന്നതാണ് നല്ലത്. ഒരു AI സഹായി സ്വയം തയ്യാറാക്കിയ പണമടയ്ക്കൽ നിർദ്ദേശം നടപ്പാക്കാമോ എന്ന നയം സമഗ്രതാ നിയന്ത്രണമാണ് — സാങ്കേതികം, കേവലം, വിപുലീകരിക്കുന്നതാണ് നല്ലത്. മിക്ക സ്ഥാപനങ്ങളും രണ്ടും ഒരേ ഭരണസമിതിയിലൂടെ കടത്തുന്നു, അതിനാൽ ആദ്യത്തേതിന്റെ സൂക്ഷ്മത രണ്ടാമത്തേതിനെ പതുക്കെയാക്കുന്നു.


സ്ഥാപനഘടനയിലും ഓഡിറ്റ് രേഖയിലും ബജറ്റിലും അവയെ വേർതിരിക്കുക

പ്രവർത്തന നിയമം: സമഗ്രതാ നിയന്ത്രണത്തിന് ഒരു പുതിയ നിയമം ഒരു ദിവസത്തിനുള്ളിൽ പുറത്തിറക്കാൻ കഴിയണം. ആവിഷ്കാര വിവേചനത്തിന്, ആരു തീരുമാനിച്ചു, ഏത് അടിസ്ഥാനത്തിൽ എന്ന എഴുതപ്പെട്ട രേഖയില്ലാതെ ഒന്നും പുറത്തിറക്കാൻ കഴിയരുത്.

ആ രണ്ടാമത്തെ ആവശ്യം, സൂക്ഷിച്ചുവയ്ക്കുന്ന ഓരോ AI വിധിയെയും ന്യായീകരിക്കാവുന്നതാക്കുന്ന അതേ ഉറവിട അച്ചടക്കമാണ്: ഒരു നയപതിപ്പ്, ഉത്തരവാദിത്തമുള്ള ഒരു റോൾ, അപ്പോൾത്തന്നെ എഴുതിയ കാരണം. സമഗ്രതാ നിയമങ്ങൾക്ക് ഈ ചടങ്ങുകളൊന്നും വേണ്ട, അതുകൊണ്ടുതന്നെ അവ ഈ വരിയുടെ പിന്നിൽ കാത്തുനിൽക്കേണ്ടതില്ല.


ഒരു UAE സ്ഥാപനത്തിന് ആദ്യത്തെ അപകടസാധ്യത യഥാർത്ഥത്തിൽ എവിടെയാണ്

മിക്ക സ്ഥാപനങ്ങളിലും ആദ്യം എത്തുന്ന ഭീഷണി പുതിയ റാൻസംവെയറല്ല. വിഷം കലർന്ന ഒരു നിർദ്ദേശപ്രകാരം പ്രവർത്തിക്കുന്ന അവരുടെ സ്വന്തം ഓട്ടോമേഷനാണ്: പണമടയ്ക്കൽ അധികാരമുള്ള ഒരു ഏജന്റ് ഒരു വ്യാജ ഇമെയിൽ വായിക്കുന്നു, പുറത്തേക്കുള്ള ഒരു ഇന്റഗ്രേഷൻ ആക്രമണകാരിയുടെ എൻഡ്‌പോയിന്റിലേക്ക് ചൂണ്ടുന്നു. നിർണായക പ്രക്രിയകളിൽ AI ഉപയോഗിക്കുന്ന DIFC സ്ഥാപനങ്ങളിൽ 21% ന് മേൽനോട്ടമില്ലെന്ന DFSA-യുടെ കണ്ടെത്തൽ കൃത്യമായി ഈ വിടവാണ് വിവരിക്കുന്നത്: ചുറ്റുമുള്ള സമഗ്രതാ പാളിക്കു മുൻപേ വിന്യസിക്കപ്പെട്ട ശേഷി.

നിങ്ങളുടെ സുരക്ഷാ ചെലവ് ഇപ്പോഴും സിഗ്നേച്ചർ കണ്ടെത്തലിലേക്ക് ചാഞ്ഞാണ് നിൽക്കുന്നതെങ്കിൽ, ഈ ബജറ്റ് കാലയളവിൽ വർധന പെരുമാറ്റ, ഐഡന്റിറ്റി നിയന്ത്രണങ്ങളിലേക്ക് മാറ്റുക, അത് പ്രത്യേകിച്ചും നിങ്ങളുടെ സ്വന്തം ഏജന്റുകളുടെ പുറത്തേക്കുള്ള പെരുമാറ്റത്തിലേക്ക് ചൂണ്ടുക. പരിമിതപ്പെടുത്തിയ അനുമതികൾ, ചെലവുപരിധികൾ, അനുവദനീയ ലക്ഷ്യസ്ഥാന പട്ടികകൾ, മാറ്റാനാവാത്ത ഒരു ലോഗ് — ഇവ ഭൂരിഭാഗം പ്രതലവും മൂടുന്നു, ഇവയൊന്നും ഏജന്റിനെ പതുക്കെയാക്കുന്നുമില്ല.


സമഗ്രതാ പാളി തുടക്കത്തിലേ രൂപകൽപ്പനയിൽ ചേർത്ത് നിർമ്മിച്ച ഒരു ഏജന്റ് പുറത്തിറങ്ങാൻ വൈകുന്നില്ല; അംഗീകാരം കിട്ടാൻ വേഗം കൂടുന്നു. ഒരു ക്ലിനിക് ദിനം നിങ്ങളുടെ ഒരു പ്രക്രിയയിൽ, പരിമിതപ്പെടുത്തിയ പുറംഗമനം, രേഖപ്പെടുത്തിയ പ്രവൃത്തികൾ, തിരിച്ചെടുക്കാനാവാത്ത ഘട്ടങ്ങളിൽ മനുഷ്യന്റെ അംഗീകാരം എന്നിവയോടെ, വൈകുന്നേരത്തിനകം പ്രവർത്തിക്കുന്ന ഒരു ഏജന്റ് നിർമ്മിക്കുന്നു. ഈ നിയന്ത്രണങ്ങൾക്കു പിന്നിലെ ഭരണചിന്ത എന്തുകൊണ്ട് AI ഏജന്റുകൾ കൃത്രിമം കാണിക്കുന്നു, ഒപ്പം ശരിക്കും നിലനിൽക്കുന്ന ഭരണരീതി എന്നതിലുണ്ട്.

Frequently asked questions

What is the difference between integrity control and expressive judgement?+

Integrity control decides whether an artefact is authentic, safe to execute, and originated where it claims: blocking a self-modifying binary, rejecting a spoofed invoice, quarantining an agent's outbound API call. Expressive judgement decides whether a permitted, authentic message should be carried. The first is engineering with little exposure; the second carries legal and reputational exposure in every jurisdiction. Fusing them slows the safe one to protect the contested one.

Why is signature-based malware detection losing ground to behavioural detection?+

Signature economics assumed writing novel malware was expensive, so attackers reused code and one analysis defended millions of endpoints. ESET's PromptLock proof-of-concept showed malware can now call a language model at runtime and regenerate its own scripts on each execution, leaving no stable family to signature. When variants cost an API call, the durable signal is behaviour: what a process does to files, networks, and credentials.

Do AI agent outputs need review before they are sent?+

Volume makes universal human review impossible, which is the point of splitting the filters. Integrity checks (authenticity, permissions, spend limits, destination allow-lists) run automatically on everything. Human judgement is reserved for the expressive layer and for actions that are expensive to reverse.

ഒരു സംഭാഷണം ആരംഭിക്കാൻ തയ്യാറോ?

അളക്കാവുന്ന AI ഫലങ്ങൾ ഡെലിവർ ചെയ്യാൻ ArkOne എങ്ങനെ ഭരണ സംവിധാനവും പ്രോഗ്രാം ആർക്കിടെക്ചറും നിർമ്മിക്കുന്നു എന്ന് കാണൂ.

ഡിസ്‌കവറി കോൾ ബുക്ക് ചെയ്യുക