ഏജന്റുകളോ ബോട്ടുകളോ? തുറന്ന വെബിൽ എഐ മനസ്സിലാക്കുന്നു
ആധുനിക എഐ അസിസ്റ്റന്റുകൾ പരമ്പരാഗത വെബ് ക്രാളിംഗിൽ നിന്ന് അടിസ്ഥാനപരമായി വ്യത്യസ്തമായാണ് പ്രവർത്തിക്കുന്നത്.

ഇന്റർനെറ്റ് വികസിക്കുന്നതിനനുസരിച്ച്, വിവരങ്ങൾ ആക്സസ് ചെയ്യാനും അവയുമായി സംവദിക്കാനുമുള്ള നമ്മുടെ രീതികളും മാറുന്നു. വെബിന്റെ ആദ്യകാലങ്ങളിൽ, ഓട്ടോമേറ്റഡ് ബോട്ടുകൾ ലളിതവും വ്യക്തമായി മനസ്സിലാക്കാവുന്നതുമായ ഒരു പങ്കാണ് വഹിച്ചിരുന്നത്: വെബ്സൈറ്റ് ഉടമകൾ നിശ്ചയിച്ച വ്യക്തമായ നിയമങ്ങൾക്കനുസരിച്ച് തിരയലിനായി സൈറ്റുകൾ സൂചികയിലാക്കുക, ലിങ്കുകൾ പരിശോധിക്കുക അല്ലെങ്കിൽ ഡാറ്റ സ്ക്രാപ്പ് ചെയ്യുക.
എന്നാൽ എഐ-അധിഷ്ഠിത അസിസ്റ്റന്റുകളുടെയും ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന ഏജന്റുകളുടെയും വരവോടെ, "വെറുമൊരു ബോട്ട്" എന്നതായി കണക്കാക്കപ്പെടുന്നതും യഥാർത്ഥ ആളുകളുടെ உடனടി ആവശ്യങ്ങൾ നിറവേറ്റുന്നതും തമ്മിലുള്ള അതിർത്തി കൂടുതൽ അവ്യക്തമായിരിക്കുന്നു.
ഡിജിറ്റൽ അസിസ്റ്റന്റുകളുടെ ഉയർച്ച
ആധുനിക എഐ അസിസ്റ്റന്റുകൾ പരമ്പരാഗത വെബ് ക്രാളിംഗിൽ നിന്ന് അടിസ്ഥാനപരമായി വ്യത്യസ്തമായാണ് പ്രവർത്തിക്കുന്നത്. നിലവിലെ വിവരങ്ങൾ ആവശ്യമുള്ള ഒരു ചോദ്യം നിങ്ങൾ Perplexity-യോട് ചോദിക്കുമ്പോൾ—ഉദാഹരണത്തിന്, "ആ പുതിയ റെസ്റ്റോറന്റിനെക്കുറിച്ചുള്ള ഏറ്റവും പുതിയ അവലോകനങ്ങൾ എന്തൊക്കെയാണ്?"—എഐ-ക്ക് ആ വിവരങ്ങൾ എവിടെയെങ്കിലും ഒരു ഡാറ്റാബേസിൽ ഇതിനകം ലഭ്യമായിരിക്കില്ല. പകരം, അത് പ്രസക്തമായ വെബ്സൈറ്റുകൾ സന്ദർശിക്കുകയും ഉള്ളടക്കം വായിക്കുകയും നിങ്ങളുടെ നിർദ്ദിഷ്ട ചോദ്യത്തിന് അനുയോജ്യമായ ഒരു സംഗ്രഹം നൽകുകയും ചെയ്യുന്നു.
ആരെങ്കിലും ആ നിർദ്ദിഷ്ട വിവരങ്ങൾ ആവശ്യപ്പെട്ടിട്ടുണ്ടോ ഇല്ലയോ എന്നതു പരിഗണിക്കാതെ, വലിയ ഡാറ്റാബേസുകൾ നിർമ്മിക്കുന്നതിനായി ദശലക്ഷക്കണക്കിന് പേജുകൾ വ്യവസ്ഥാപിതമായി സന്ദർശിക്കുന്ന പരമ്പരാഗത വെബ് ക്രാളിംഗിൽ നിന്ന് ഇത് അടിസ്ഥാനപരമായി വ്യത്യസ്തമാണ്. ഇതിനു വിപരീതമായി, ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന ഏജന്റുകൾ ഒരു യഥാർത്ഥ വ്യക്തി നിർദ്ദിഷ്ടമായ എന്തെങ്കിലും ആവശ്യപ്പെടുമ്പോൾ മാത്രമേ ഉള്ളടക്കം ലഭ്യമാക്കുകയുള്ളൂ, കൂടാതെ ഉപയോക്താവിന്റെ ചോദ്യത്തിന് ഉത്തരം നൽകാൻ അവർ ആ ഉള്ളടക്കം ഉടനടി ഉപയോഗിക്കുകയും ചെയ്യുന്നു. Perplexity-യുടെ ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന ഏജന്റുകൾ വിവരങ്ങൾ സംഭരിക്കുകയോ അതുപയോഗിച്ച് പരിശീലനം നേടുകയോ ചെയ്യുന്നില്ല.
എന്തുകൊണ്ടാണ് ഈ വ്യത്യാസം പ്രധാനമാകുന്നത്
ഓട്ടോമേറ്റഡ് ക്രാളിംഗും ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന ഫെച്ചിംഗും തമ്മിലുള്ള വ്യത്യാസം സാങ്കേതികമായത് മാത്രമല്ല—തുറന്ന വെബിലെ വിവരങ്ങൾ ആർക്ക് ആക്സസ് ചെയ്യാൻ കഴിയുമെന്നതിനെക്കുറിച്ചാണ് ഇത്. ഗൂഗിളിന്റെ സെർച്ച് എഞ്ചിൻ അതിന്റെ സൂചിക നിർമ്മിക്കാൻ ക്രാൾ ചെയ്യുമ്പോൾ, നിങ്ങൾ ഒരു പ്രിവ്യൂ ആവശ്യപ്പെട്ടതുകൊണ്ട് അത് ഒരു വെബ്പേജ് ഫെച്ച് ചെയ്യുമ്പോൾ ഉള്ളതിൽ നിന്ന് അത് വ്യത്യസ്തമാണ്. ഗൂഗിളിന്റെ "ഉപയോക്താവ് ട്രിഗർ ചെയ്ത ഫെച്ചറുകൾ" robots.txt നിയന്ത്രണങ്ങളേക്കാൾ നിങ്ങളുടെ അനുഭവത്തിന് മുൻഗണന നൽകുന്നു, കാരണം ഈ അഭ്യർത്ഥനകൾ നിങ്ങളുടെ പേരിൽ സംഭവിക്കുന്നവയാണ്.
ഇത് എഐ അസിസ്റ്റന്റുകൾക്കും ബാധകമാണ്. Perplexity ഒരു വെബ്പേജ് ഫെച്ച് ചെയ്യുമ്പോൾ, നിലവിലെ വിവരങ്ങൾ ആവശ്യപ്പെടുന്ന ഒരു നിർദ്ദിഷ്ട ചോദ്യം നിങ്ങൾ ചോദിച്ചതുകൊണ്ടാണ് അത് സംഭവിക്കുന്നത്. ഉള്ളടക്കം പരിശീലനത്തിനായി സംഭരിക്കപ്പെടുന്നില്ല—നിങ്ങളുടെ ചോദ്യത്തിന് ഉത്തരം നൽകാൻ അത് ഉടനടി ഉപയോഗിക്കുന്നു.
ക്ലൗഡ്ഫ്ലെയർ (Cloudflare) പോലുള്ള കമ്പനികൾ ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന എഐ അസിസ്റ്റന്റുകളെ ദോഷകരമായ ബോട്ടുകളായി തെറ്റായി ചിത്രീകരിക്കുമ്പോൾ, ഉപയോക്താക്കൾക്ക് സേവനം നൽകുന്ന ഏത് ഓട്ടോമേറ്റഡ് ടൂളും സംശയാസ്പദമായിരിക്കണം എന്നാണ് അവർ വാദിക്കുന്നത്—ഇമെയിൽ ക്ലയന്റുകളെയും വെബ് ബ്രൗസറുകളെയും അല്ലെങ്കിൽ തങ്ങൾക്കിഷ്ടമില്ലെന്ന് ഭാവിയിലെ ഒരു ഗേറ്റ്കീപ്പർ തീരുമാനിക്കുന്ന മറ്റേതെങ്കിലും സേവനങ്ങളെയും കുറ്റകൃത്യമായി കാണുന്ന ഒരു നിലപാടാണിത്.
നിയമപരമായ എഐ അസിസ്റ്റന്റുകളെയും യഥാർത്ഥ ഭീഷണികളെയും തമ്മിൽ വേർതിരിച്ചറിയാൻ ക്ലൗഡ്ഫ്ലെയറിന്റെ സിസ്റ്റങ്ങൾ അടിസ്ഥാനപരമായി അപര്യാപ്തമാണെന്ന് ഈ വിവാദം വെളിപ്പെടുത്തുന്നു. സഹായകരമായ ഒരു ഡിജിറ്റൽ അസിസ്റ്റന്റിനെ ദോഷകരമായ ഒരു സ്ക്രാപ്പറിൽ നിന്ന് തിരിച്ചറിയാൻ നിങ്ങൾക്ക് കഴിയുന്നില്ലെങ്കിൽ, ഏതൊക്കെയാണ് യഥാർത്ഥ വെബ് ട്രാഫിക് എന്ന് തീരുമാനിക്കാൻ നിങ്ങൾ 아마യും തുനിയരുത്.
ഈ അമിതമായ ബ്ലോക്കിംഗ് എല്ലാവരെയും ബാധിക്കുന്നു. ആരോഗ്യപരമായ അവസ്ഥകളെക്കുറിച്ച് ഗവേഷണം ചെയ്യാനോ, ഉൽപ്പന്ന അവലോകനങ്ങൾ താരതമ്യം ചെയ്യാനോ, ഒന്നിലധികം സ്രോതസ്സുകളിൽ നിന്നുള്ള വാർത്തകൾ ആക്സസ് ചെയ്യാനോ എഐ ഉപയോഗിക്കുന്ന ഒരാളെ പരിഗണിക്കുക. അവരുടെ അസിസ്റ്റന്റ് "ദോഷകരമായ ബോട്ട്" ആയി തടയപ്പെടുകയാണെങ്കിൽ, വിലയേപ്പടർന്ന വിവരങ്ങൾ അവർക്ക് നഷ്ടപ്പെടുന്നു.
നിങ്ങളുടെ ആവശ്യങ്ങളെ ആശ്രയിച്ചല്ല, മറിച്ച് നിങ്ങളുടെ മാർഗ്ഗങ്ങളെക്കുറിച്ച് കൂടുതൽ ശ്രദ്ധ ചെലുത്തുന്ന ഇൻഫ്രാസ്ട്രക്ചർ നിയന്ത്രണക്കാർ നിങ്ങൾ തിരഞ്ഞെടുത്ത ടൂളുകൾക്ക് അനുമതി നൽകിയിട്ടുണ്ടോ ഇല്ലയോ എന്നതിനെ ആശ്രയിച്ചാണ് നിങ്ങളുടെ ആക്സസ് എന്ന് വരുന്ന ഒരു രണ്ട് തട്ടിലുള്ള ഇന്റർനെറ്റിലാണ് ഇതിന്റെ ഫലം എത്തിക്കുന്നത്. ഇത് ഉപയോക്തൃ തിരഞ്ഞെടുപ്പിനെ ദുർബലപ്പെടുത്തുകയും സ്ഥാപിത ഭീമന്മാരുമായി മത്സരിക്കുന്ന നൂതന സേവനങ്ങൾക്കായി തുറന്ന വെബിന്റെ പ്രവേശനക്ഷമതയ്ക്ക് ഭീഷണി ഉയർത്തുകയും ചെയ്യുന്നു.
വ്യക്തതയ്ക്കായുള്ള ആഹ്വാനം: ഉപയോക്തൃ ഏജന്റുകൾ യഥാർത്ഥത്തിൽ എങ്ങനെ പ്രവർത്തിക്കുന്നു
ഒരു മനുഷ്യ അസിസ്റ്റന്റ് പോലെ തന്നെയാണ് എഐ അസിസ്റ്റന്റ് പ്രവർത്തിക്കുന്നത്. നിലവിലെ വിവരങ്ങൾ ആവശ്യമുള്ള ഒരു ചോദ്യം നിങ്ങൾ എഐ അസിസ്റ്റന്റിനോട് ചോദിക്കുമ്പോൾ, ഉത്തരം അവർക്ക് ഇതിനകം അറിയാമായിരിക്കില്ല. നിങ്ങൾ ആവശ്യപ്പെട്ട ഏത് ജോലിയും പൂർത്തിയാക്കാൻ അവർ നിങ്ങൾക്കായി അത് തിരഞ്ഞുനോക്കുന്നു.
Perplexity-യിലും മറ്റ് എല്ലാ ഏജന്റിക് എഐ പ്ലാറ്റ്ഫോമുകളിലും, ഇത് തത്സമയം, നിങ്ങളുടെ അഭ്യർത്ഥനയോട് പ്രതികരിച്ചുകൊണ്ട് സംഭവിക്കുന്നു, കൂടാതെ നിങ്ങളുടെ ചോദ്യത്തിന് ഉത്തരം നൽകാൻ വിവരങ്ങൾ ഉടനടി ഉപയോഗിക്കുകയും ചെയ്യുന്നു. ഭാവിയിലെ ഉപയോഗത്തിനായി ഇത് വലിയ ഡാറ്റാബേസുകളിൽ സംഭരിക്കപ്പെടുന്നില്ല, കൂടാതെ എഐ മോഡലുകളെ പരിശീലിപ്പിക്കാനും ഇത് ഉപയോഗിക്കുന്നില്ല.
ഉപയോക്താക്കൾ നിർദ്ദിഷ്ട അഭ്യർത്ഥനകൾ നടത്തുമ്പോൾ മാത്രമേ ഉപയോക്തൃ-നയിക്കപ്പെടുന്ന ഏജന്റുകൾ പ്രവർത്തിക്കുകയുള്ളൂ, കൂടാതെ ആ അഭ്യർത്ഥനകൾ നിറവേറ്റാൻ ആവശ്യമായ ഉള്ളടക്കം മാത്രമാണ് അവർ ഫെച്ച് ചെയ്യുന്നത്. ഒരു ഉപയോക്തൃ ഏജന്റും ഒരു ബോട്ടും തമ്മിലുള്ള അടിസ്ഥാനപരമായ വ്യത്യാസമാണിത്.
ക്ലൗഡ്ഫ്ലെയറിനെ നേരിട്ട് അഭിസംബോധന ചെയ്യുന്നു: കഴിവ് സംബന്ധിച്ച ഒരു ചോദ്യം
ആധുനിക എഐ അസിസ്റ്റന്റുകൾ യഥാർത്ഥത്തിൽ എങ്ങനെ പ്രവർത്തിക്കുന്നു എന്നതിനെക്കുറിച്ച് ക്ലൗഡ്ഫ്ലെയറിന്റെ സമീപകാല ബ്ലോഗ് പോസ്റ്റിന്ほぼ എല്ലാ കാര്യങ്ങളും തെറ്റായി വ്യാഖ്യാനിക്കാൻ കഴിഞ്ഞു.
20-25M ഉപയോക്തൃ ഏജന്റ് അഭ്യർത്ഥനകൾ സ്ക്രാപ്പറുകൾ അല്ലെന്ന് തെറ്റായി മനസ്സിലാക്കിയതിന് പുറമേ, വെബ്സൈറ്റ് നിയന്ത്രണങ്ങൾ മറികടക്കാൻ മറഞ്ഞിരിക്കുന്ന ബോട്ടുകളും ആൾമാറാട്ട തന്ത്രങ്ങളും ഉപയോഗിച്ച് Perplexity "സ്റ്റെൽത്ത് ക്രാളിംഗിൽ" ഏർപ്പെടുന്നുവെന്ന് ക്ലൗഡ്ഫ്ലെയർ അവകാശപ്പെട്ടു. എന്നാൽ സാങ്കേതിക വസ്തുതകൾ മറ്റൊരു കഥയാണ് പറയുന്നത്.
വളരെ പ്രത്യേകമായ ജോലികൾക്കായി (പ്രതിദിനം 45,000-ൽ താഴെ അഭ്യർത്ഥനകൾ) Perplexity ഇടയ്ക്കിടെ മാത്രം ഉപയോഗിക്കുന്ന മൂന്നാം കക്ഷി ക്ലൗഡ് ബ്രൗസർ സേവനമായ BrowserBase-ൽ നിന്നുള്ള ബന്ധമില്ലാത്ത ട്രാഫിക്കിന്റെ പ്രതിദിന 3-6M അഭ്യർത്ഥനകളുമായി ക്ലൗഡ്ഫ്ലെയർ Perplexity-യെ ആശയക്കുഴപ്പത്തിലാക്കിയതായി തോന്നുന്നു.
ക്ലൗഡ്ഫ്ലെയർ സൗകര്യപൂർവ്വം അവരുടെ രീതിശാസ്ത്രം അവ്യക്തമാക്കുകയും ഞങ്ങളുടെ ടീമുകളെ മനസ്സിലാക്കാൻ സഹായിക്കുന്ന ചോദ്യങ്ങൾക്ക് മറുപടി നൽകാൻ വിസമ്മതിക്കുകയും ചെയ്തതിനാൽ, സാധ്യമായ രണ്ട് വിശദീകരണങ്ങളിലേക്ക് മാത്രമായി ഞങ്ങൾക്ക് ഇത് ചുരുക്കാൻ കഴിയും.
ക്ലൗഡ്ഫ്ലെയറിന് ഒരു മികച്ച പബ്ലിസിറ്റി നിമിഷം ആവശ്യമായിരുന്നു, അതിനായി ഞങ്ങളുടെ സ്വന്തം ഉപഭോക്താവായ ഞങ്ങൾ അവർക്ക് ഉപയോഗപ്രദമായ ഒരു പേരായി മാറി.
BrowserBase-ന്റെ ഓട്ടോമേറ്റഡ് ബ്രൗസർ സേവനത്തിൽ നിന്നുള്ള പ്രതിദിന 3-6M അഭ്യർത്ഥനകൾ Perplexity-യുടേതാണെന്ന് ക്ലൗഡ്ഫ്ലെയർ അടിസ്ഥാനപരമായി തെറ്റായി ആരോപിച്ചു, വെബ് ട്രാഫിക്കിനെ മനസ്സിലാക്കുകയും തരംതിരിക്കുകയും ചെയ്യുകയെന്നതാണ് പ്രധാന ബിസിനസ്സ് ആയ ഒരു കമ്പനിയെ സംബന്ധിച്ചിടത്തോളം പ്രത്യേകിച്ചും ലജ്ജാകരമായ ഒരു അടിസ്ഥാന ട്രാഫിക് വിശകലന പരാജയമാണിത്.
ഏത് വിശദീകരണമാണ് സത്യം എന്നത് എന്തുമാകട്ടെ, ക്ലൗഡ്ഫ്ലെയറിന്റെ വിശകലനത്തിലെ സാങ്കേതിക പിഴവുകൾ ലജ്ജാകരമായവ മാത്രമല്ല—അവ അയോഗ്യമാക്കുന്നവയാണ്. ദശലക്ഷക്കണക്കിന് അഭ്യർത്ഥനകൾ തെറ്റായി ആരോപിക്കുകയും തികച്ചും തെറ്റായ സാങ്കേതിക ഡയഗ്രമുകൾ പ്രസിദ്ധീകരിക്കുകയും ആധുനിക എഐ അസിസ്റ്റന്റുകൾ എങ്ങനെ പ്രവർത്തിക്കുന്നു എന്നതിനെക്കുറിച്ച് അടിസ്ഥാനപരമായ തെറ്റായ ധാരണ പ്രകടിപ്പിക്കുകയും ചെയ്യുമ്പോൾ, ഈ സ്പേസിലെ വൈദഗ്ധ്യത്തിനുള്ള ഏത് അവകാശവാദവും നിങ്ങൾ നഷ്ടപ്പെടുത്തിയിരിക്കുന്നു.
നിയമപരമായ എഐ അസിസ്റ്റന്റുകളെയും യഥാർത്ഥ ഭീഷണികളെയും തമ്മിൽ വേർതിരിച്ചറിയാൻ ക്ലൗഡ്ഫ്ലെയറിന്റെ സിസ്റ്റങ്ങൾ അടിസ്ഥാനപരമായി അപര്യാപ്തമാണെന്ന് ഈ വിവാദം വെളിപ്പെടുത്തുന്നു. സഹായകരമായ ഒരു ഡിജിറ്റൽ അസിസ്റ്റന്റിനെ ദോഷകരമായ ഒരു സ്ക്രാപ്പറിൽ നിന്ന് തിരിച്ചറിയാൻ നിങ്ങൾക്ക് കഴിയുന്നില്ലെങ്കിൽ, ഏതൊക്കെയാണ് യഥാർത്ഥ വെബ് ട്രാഫിക് എന്ന് തീരുമാനിക്കാൻ നിങ്ങൾ 아마യും തുനിയരുത്.
ഈ പ്രശ്നത്തെക്കുറിച്ചുള്ള ബഹളം ക്ലൗഡ്ഫ്ലെയറിന്റെ നേതൃത്വം എഐ-യുടെ അടിസ്ഥാനകാര്യങ്ങളിൽ അപകടകരമാ വിധം തെറ്റായ വിവരങ്ങൾ ഉള്ളവരാണെന്നോ അല്ലെങ്കിൽ ക്ലൗഡിനേക്കാൾ ലളിതമായ പൊങ്ങച്ചങ്ങൾ ഉള്ളവരാണെന്നോ വെളിപ്പെടുത്തുന്നു. ക്ലൗഡ്ഫ്ലെയറിന്റെ ഉപഭോക്താക്കളിൽ എല്ലാത്തരം ബിസിനസ്സുകളും ഉൾപ്പെടുന്നു എന്നതുകൊണ്ട് ഇത് പ്രധാനമാണ്, ചarlatan പബ്ലിസിറ്റി സ്റ്റണ്ടുകളിൽ തങ്ങളുടെ ഇൻഫ്രാസ്ട്രക്ചർ വിശ്വസിക്കാൻ കഴിയാത്ത കമ്പനികൾ.
കൂടുതൽ ലജ്ജാകരമെന്നു പറയട്ടെ, Perplexity യഥാർത്ഥത്തിൽ എങ്ങനെ പ്രവർത്തിക്കുന്നു എന്നതുമായി യാതൊരു സാദൃശ്യമില്ലാത്ത "Perplexity-യുടെ ക്രാളിംഗ് വർക്ക്ഫ്ലോ" എന്ന് അവകാശപ്പെടുന്ന ഒരു സാങ്കേതിക ഡയഗ്രം ക്ലൗഡ്ഫ്ലെയർ പ്രസിദ്ധീകരിച്ചു. തങ്ങൾ കാണുന്ന ഡാറ്റ, ഞങ്ങളുടെ സിസ്റ്റങ്ങൾ എങ്ങനെ പ്രവർത്തിക്കുന്നു, അല്ലെങ്കിൽ മുകളിൽ വിവരിച്ച ഈ അടിസ്ഥാന ആശയങ്ങൾ എന്നിവ മനസ്സിലാക്കുന്നതിൽ ക്ലൗഡ്ഫ്ലെയറിന് യഥാർത്ഥത്തിൽ താൽപ്പര്യമുണ്ടായിരുന്നെങ്കിൽ, എല്ലാ Perplexity ഉപയോക്താക്കളോടും ഞങ്ങൾ ചെയ്യാൻ പ്രോത്സാഹിപ്പിക്കുന്ന കാര്യം അവർക്കും ചെയ്യാമായിരുന്നു. വെറുതെ ചോദിക്കുക.