Aģenti vai boti? Izpratne par AI atklātajā tīmeklī

Mūsdienu mākslīgā intelekta asistenti darbojas fundamentāli atšķirīgi no tradicionālās tīmekļa pārlūkošanas.

Līdz ar interneta attīstību mainās arī veidi, kādos mēs piekļūstam informācijai un mijiedarbojamies ar to. Tīmekļa pirmsākumos automātiskajiem botiem bija vienkārša un saprotama loma: tie indeksēja vietnes meklētājsistēmām, pārbaudīja saites vai vāca datus saskaņā ar skaidriem noteikumiem, ko bija noteikuši vietņu īpašnieki.

Taču līdz ar mākslīgā intelekta balstīto asistenti un lietotāju vadīto aģentu uzplaukumu robeža starp to, kas tiek uzskatīts par "parastu botu" un kas kalpo reālu cilvēku tiešajām vajadzībām, kļūst arvien neskaidrāka.

Digitālo asistentu uzplaukums

Mūsdienu mākslīgā intelekta asistenti darbojas fundamentāli atšķirīgi no tradicionālās tīmekļa pārlūkošanas. Kad jūs uzdodat Perplexity jautājumu, kam nepieciešama aktuāla informācija, piemēram, "Kādas ir jaunākās atsauksmes par šo jauno restorānu?", mākslīgajam intelektam šī informācija jau nav kaut kur saglabāta datubāzē. Tā vietā tas dodas uz attiecīgajām tīmekļa vietnēm, izlasa saturu un sagatavo kopsavilkumu, kas pielāgots tieši jūsu jautājumam.

Tas fundamentāli atšķiras no tradicionālās tīmekļa pārlūkošanas, kurā pārlūki sistemātiski apmeklē miljoniem lapu, lai izveidotu milzīgas datubāzes neatkarīgi no tā, vai kāds ir prasījis šo konkrēto informāciju. Turpretī lietotāju vadīti aģenti iegūst saturu tikai tad, kad reāls cilvēks pieprasa kaut ko konkrētu, un viņi izmanto šo saturu nekavējoties, lai atbildētu uz lietotāja jautājumu. Perplexity lietotāju vadītie aģenti neuzglabā informāciju un neapmāca ar to modeļus.

Kāpēc šī atšķirība ir svarīga

Atšķirība starp automātisko pārlūkošanu un lietotāja vadītu satura ieguvi nav tikai tehniska – tā attiecas uz to, kam ir ļauts piekļūt informācijai atklātajā tīmeklī. Kad Google meklētājs veic pārlūkošanu, lai izveidotu savu indeksu, tas atšķiras no gadījuma, kad tas iegūst tīmekļa lapu, jo jūs pieprasījāt priekšskatījumu. Google "lietotāja ierosinātie datu ieguvēji" izvirza jūsu pieredzi augstāk par robots.txt ierobežojumiem, jo šie pieprasījumi tiek veikti jūsu vārdā.

Tas pats attiecas uz mākslīgā intelekta asistentiem. Kad Perplexity iegūst tīmekļa lapu, tas notiek tāpēc, ka jūs uzdevāt konkrētu jautājumu, kuram nepieciešama aktuāla informācija. Saturs netiek uzglabāts apmācībai – tas tiek izmantots nekavējoties, lai atbildētu uz jūsu jautājumu.

Kad tādi uzņēmumi kā Cloudflare nepareizi raksturo lietotāju vadītos mākslīgā intelekta asistentus kā ļaunprātīgus botus, tie apgalvo, ka jebkuram automatizētam rīkam, kas apkalpo lietotājus, vajadzētu būt aizdomīgam – nostāja, kas kriminalizētu e-pasta klientus un tīmekļa pārlūkprogrammas vai jebkuru citu pakalpojumu, kuru potenciālais vārtu sargs izlemj neatzīt.

Šī pretruna atklāj, ka Cloudflare sistēmas ir fundamentāli nepietiekamas, lai atšķirtu leģitīmus mākslīgā intelekta asistentus no reāliem draudiem. Ja jūs nevarat atšķirt noderīgu digitālo asistentu no ļaunprātīga datu vācēja, tad jums droši vien nevajadzētu pieņemt lēmumus par to, kas ir leģitīma tīmekļa datplūsma.

Šāda pārmērīga bloķēšana kaitē visiem. Iedomājieties kādu, kurš izmanto mākslīgo intelektu, lai izpētītu medicīniskus stāvokļus, salīdzinātu produktu atsauksmes vai piekļūtu ziņām no vairākiem avotiem. Ja viņu asistents tiek bloķēts kā "ļaunprātīgs bots", viņi zaudē piekļuvi vērtīgai informācijai.

Rezultāts ir divlīmeņu internets, kurā jūsu piekļuve ir atkarīga nevis no jūsu vajadzībām, bet gan no tā, vai jūsu izvēlētos rīkus ir svētījuši infrastruktūras kontrolieri, kuri vairāk rūpējas par jūsu līdzekļiem. Tas grauj lietotāju izvēles brīvību un apdraud atklātā tīmekļa pieejamību inovatīviem pakalpojumiem, kas konkurē ar esošajiem gigantiem.

Aicinājums uz skaidrību: kā patiesībā darbojas lietotāju aģenti

Mākslīgā intelekta asistents darbojas tieši tāpat kā cilvēka asistents. Kad jūs uzdodat mākslīgā intelekta asistentam jautājumu, kam nepieciešama aktuāla informācija, tas atbildi vēl nezina. Tas to atrod jūsu vietā, lai izpildītu jebkuru uzdevumu, ko esat lūguši.

Perplexity un visās citās aģentu mākslīgā intelekta platformās tas notiek reāllaikā, reaģējot uz jūsu pieprasījumu, un informācija tiek izmantota nekavējoties, lai atbildētu uz jūsu jautājumu. Tā netiek uzglabāta milzīgās datubāzēs turpmākai izmantošanai un netiek izmantota mākslīgā intelekta modeļu apmācībai.

Lietotāju vadīti aģenti rīkojas tikai tad, kad lietotāji izsaka konkrētus pieprasījumus, un tie iegūst tikai to saturu, kas nepieciešams šo pieprasījumu izpildei. Tā ir fundamentāla atšķirība starp lietotāja aģentu un botu.

Tieša vēršanās pie Cloudflare: kompetences jautājums

Cloudflare nesenajā emuāra ierakstā izdevās saprast gandrīz visu nepareizi par to, kā mūsdienu mākslīgā intelekta asistenti faktiski darbojas.

Papildus tam, ka netika saprasts, ka 20-25 miljoni lietotāja aģenta pieprasījumu nav datu vācēji, Cloudflare apgalvoja, ka Perplexity nodarbojas ar "slēptu pārlūkošanu", izmantojot slēptus botus un uzdošanos par citiem, lai apietu vietnes ierobežojumus. Taču tehniskie fakti liecina par ko citu.

Šķiet, ka Cloudflare sajauca Perplexity ar 3-6 miljoniem ikdienas pieprasījumu no nesaistītas datplūsmas, ko nodrošina BrowserBase – trešās puses mākoņa pārlūkprogrammas pakalpojums, ko Perplexity izmanto tikai retumis ļoti specifiskiem uzdevumiem (mazāk nekā 45 000 ikdienas pieprasījumu).

Tā kā Cloudflare ir ērti aptumšojusi savu metodoloģiju un atteikusies atbildēt uz jautājumiem, kas palīdzētu mūsu komandām saprast, mēs varam to sašaurināt tikai līdz diviem iespējamiem skaidrojumiem.

Cloudflare bija nepieciešams gudrs publicitātes mirklis, un mēs – viņu pašu klientu – gadījāmies kā noderīgs vārds, lai to iegūtu.

Cloudflare fundamentāli nepareizi piedēvēja 3-6 miljonus ikdienas pieprasījumu no BrowserBase automatizētā pārlūkprogrammas pakalpojuma uzņēmumam Perplexity, kas ir pamata datplūsmas analīzes kļūda, kura ir īpaši apkaunojoša uzņēmumam, kura pamatdarbība ir tīmekļa datplūsmas izpratne un kategorizēšana.

Neatkarīgi no tā, kurš skaidrojums ir patiesība, tehniskās kļūdas Cloudflare analīzē nav tikai apkaunojošas – tās ir diskvalificējošas. Kad jūs nepareizi piedēvējat miljoniem pieprasījumu, publicējat pilnīgi neprecīzas tehniskās diagrammas un demonstrējat fundamentālu neizpratni par to, kā darbojas mūsdienu mākslīgā intelekta asistenti, jūs esat zaudējis jebkādas tiesības uz ekspertīzi šajā telpa.

Šī pretruna atklāj, ka Cloudflare sistēmas ir fundamentāli nepietiekamas, lai atšķirtu leģitīmus mākslīgā intelekta asistentus no reāliem draudiem. Ja jūs nevarat atšķirt noderīgu digitālo asistentu no ļaunprātīga datu vācēja, tad jums droši vien nevajadzētu pieņemt lēmumus par to, kas ir leģitīma tīmekļa datplūsma.

Šis troksnis ap šo jautājumu arī atklāj, ka Cloudflare vadība ir vai nu bīstami neinformēta par mākslīgā intelekta pamatiem, vai arī tai vienkārši ir vairāk skaļu vārdu nekā reāla satura. Tas ir svarīgi, jo Cloudflare klientu vidū ir visu veidu uzņēmumi – uzņēmumi, kuri nevar atļauties uzticēt savu infrastruktūru šarlatānu publicitātes trikiem.

Vēl apkaunojošāk ir tas, ka Cloudflare publicēja tehnisko diagrammu, kas it kā parāda "Perplexity darbplūsma", kurai nav nekādas līdzības ar to, kā Perplexity patiesībā darbojas. Ja Cloudflare patiesi interesētos par redzamajiem datiem, mūsu sistēmu darbību vai iepriekš minētajiem fundamentālajiem jēdzieniem, tie varēja rīkoties tā, kā mēs aicinām darīt visus Perplexity lietotājus. Vienkārši pajautājiet.