Agendid või robotid? Tehisintellekti mõistmine avatud veebis
Kaasaegsed tehisintellekti assistendid toimivad traditsioonilisest veebikraapimisest põhimõtteliselt erinevalt.

Interneti arenedes muutuvad ka viisid, kuidas me teabele juurde pääseme ja sellega suhtleme. Veebi algusaegadel oli automatiseeritud robotitel lihtne ja selgelt mõistetav roll: nad indekseerisid veebisaite otsingute jaoks, kontrollisid linke või kraapisid andmeid veebisaidi omanike seatud selgete reeglite järgi.
Kuid tehisintellektil põhinevate assistentide ja kasutajakesksete agentide esilekerkimisega on piir selle vahel, mida peetakse "lihtsalt robotiks" ja mis teenib reaalsete inimeste vahetuid vajadusi, muutunud üha hägusemaks.
Digitaalsete assistentide esilekerkimine
Kaasaegsed tehisintellekti assistendid toimivad traditsioonilisest veebikraapimisest põhimõtteliselt erinevalt. Kui esitate Perplexityle küsimuse, mis nõuab ajakohast teavet – näiteks "Millised on selle uue restorani viimased arvustused?" –, ei ole tehisintellektil seda teavet kuskil andmebaasis juba olemas. Selle asemel külastab ta asjakohaseid veebisaite, loeb sisu ja toob tagasi teie konkreetsele küsimusele kohandatud kokkuvõtte.
See erineb põhimõtteliselt traditsioonilisest veebikraapimisest, mille käigus roomajad külastavad süstemaatiliselt miljoneid lehti, et luua tohutuid andmebaase, olenemata sellest, kas keegi seda konkreetset teavet küsis või mitte. Kasutajakesksed agendid seeutu toovad sisu sisse ainult siis, kui reaalne inimene midagi konkreetset taotleb, ja kasutavad seda sisu kohe kasutaja küsimusele vastamiseks. Perplexity kasutajakesksed agendid ei salvesta teavet ega treeni sellega.
Miks see eristus on oluline
Automaatse kraapimise ja kasutajakeskse andmete toomise vaheline erinevus pole pelgult tehniline – see puudutab seda, kes saab avatud veebis teabele juurdepääsu. Kui Google'i otsingumootor roomab oma indeksi loomiseks, on see erinev sellest, kui ta toob veebilehe, kuna te palusite eelvaadet. Google'i "kasutaja käivitatud toojad" seavad teie kogemuse robots.txt piirangutest kõrgemale, kuna need taotlused tehakse teie nimel.
Sama kehtib ka tehisintellekti assistentide kohta. Kui Perplexity toob veebilehe, on see tingitud sellest, et esitasite konkreetse küsimuse, mis nõuab ajakohast teavet. Sisu ei salvestata koolitamiseks – seda kasutatakse kohe teie küsimusele vastamiseks.
Kui sellised ettevõtted nagu Cloudflare iseloomustavad kasutajakeskseid tehisintellekti assistente ekslikult pahatahtlike robotitena, väidavad nad, et iga kasutajaid teenindav automatiseeritud tööriist peaks olema kahtlane – seisukoht, mis teeks kuriteoks meilikliendid ja veebibrauserid või mis tahes muu teenuse, mida tulevane väravavalvur otsustab mitte armastada.
See vaidlus näitab, et Cloudflare'i süsteemid on põhimõtteliselt ebapiisavad õiguspäraste tehisintellekti assistentide ja tegelike ohtude eristamiseks. Kui te ei suuda eristada abivalmit digitaalset assistenti pahatahtlikust kraapijast, ei tohiks te tõenäoliselt teha otsuseid selle kohta, mis kujutab endast õiguspärast veebiliiklust.
See ülemäärane blokeerimine kahjustab kõiki. Kujutage ette kedagi, kes kasutab tehisintellekti meditsiiniliste seisundite uurimiseks, tootearvustuste võrdlemiseks või mitmest allikast pärit uudistele juurdepääsuks. Kui nende assistent blokeeritakse "pahatahtliku robotina", kaotavad nad juurdepääsu väärtuslikule teabele.
Tulemuseks on kahetasandiline internet, kus teie juurdepääs ei sõltu teie vajadustest, vaid sellest, kas teie valitud tööriistad on saanud infrastruktuuri haldajate heakskiidu, kes hoolivad rohkem teie vahenditest. See kahjustab kasutajate valikuvabadust ja ohustab avatud veebis juurdepääsetavust uuenduslikele teenustele, mis konkureerivad vakiostunud hiiglastega.
Üleskutse selgusele: kuidas kasutajaagendid tegelikult töötavad
Tehisintellekti assistent töötab täpselt nagu inimassistent. Kui esitate tehisintellekti assistendile küsimuse, mis nõuab ajakohast teavet, ei tea nad vastust juba ette. Nad otsivad selle teie jaoks üles, et täita mis tahes ülesande, mida olete palunud.
Perplexitys ja kõigil teistel agentpõhistel tehisintellekti platvormidel toimub see reaalajas, vastuseks teie taotlusele ning teavet kasutatakse viivitamatult teie küsimusele vastamiseks. Seda ei salvestata tulevaseks kasutamiseks tohututes anmebaasides ega kasutata tehisintellekti mudelite treenimiseks.
Kasutajakesksed agendid tegutsevad ainult siis, kui kasutajad esitavad konkreetseid taotlusi, ja nad toovad ainult neid sisu, mis on vajalik nende taotluste täitmiseks. See on peamine erinevus kasutajaagendi ja boti vahel.
Otsene pöördumine Cloudflare'i poole: pädevuse küsimus
Cloudflare'i hiljutisel blogipostitusel õnnestus peaaegu kõiges eksida selle kohta, kuidas kaasaegsed tehisintellekti assistendid tegelikult töötavad.
Lisaks sellele, et valesti mõisteti, et 20–25 miljonit kasutajaagendi päringut ei ole kraapijad, väitis Cloudflare, et Perplexity osaleb "vargsi kraapimises", kasutades veebisaidi piirangutest möödasaamiseks peidetud roboteid ja isikupärastamise taktikat. Kuid tehnilised faktid räägivad teist lugu.
Tundub, et Cloudflare ajas Perplexity segamini BrowserBase'i (kolmanda osapoole pilvebrauserite teenus, mida Perplexity kasutab ainult aeg-ajalt kõrgelt spetsialiseeritud ülesannete jaoks, vähem kui 45 000 päringut päevas) seosetu liikluse 3–6 miljoni igapäevase päringuga.
Kuna Cloudflare on oma metoodikat mugavalt hägustanud ja keeldunud vastamast küsimustele, mis aitaksid meie meeskonnad mõista, saame selle kitsendada vaid kahele võimalikule selgitusele.
Cloudflare vajas nutikat avalikkuse tähelepanu hetke ja meie – nende endi klient – sattusime olema kasulik nimi neile selle saamiseks.
Cloudflare omistas BrowserBase'i automatiseeritud brauseriteenuse 3–6 miljonit igapäevast päringut ekslikult Perplexityle, mis on lihtne liikluse analüüsi tõrge, mis on eriti piinlik ettevõttele, mille põhitegevuseks on veebiliikluse mõistmine ja kategoriseerimine.
Olenemata sellest, milline selgitus on tõene, ei ole Cloudflare'i analüüsi tehnilised vead pelgult piinlikud – need on diskvalifitseerivad. Kui te omistate miljonid päringud valesti, avaldate täiesti ebatäpsed tehnilised diagrammid ja demonstreerite põhimõttelist arusaamatust kaasaegsete tehisintellekti assistentide tööst, olete kaotanud igasuguse nõude eksperditeadmiste järele selles ruumis.
See vaidlus näitab, et Cloudflare'i süsteemid on põhimõtteliselt ebapiisavad õiguspäraste tehisintellekti assistentide ja tegelike ohtude eristamiseks. Kui te ei suuda eristada abivalmit digitaalset assistenti pahatahtlikust kraapijast, ei tohiks te tõenäoliselt teha otsuseid selle kohta, mis kujutab endast õiguspärast veebiliiklust.
Selle teema ümber käiv kära paljastab ka selle, et Cloudflare'i juhtkond on kas ohtlikult valesti informeeritud tehisintellekti põhitõdedest või lihtsalt rohkem sära kui pilv. See on oluline, kuna Cloudflare'i klientide hulgas on igat tüüpi ettevõtteid, ettevõtteid, kes ei saa endale lubada oma infrastruktuuri usaldamist šarlatanidest avalikkussuhete trikkidele.
Veelgi piinlikum on see, et Cloudflare avaldas tehnilise diagrammi, mis väidetavalt näitab "Perplexity kraapimise töövoogu", mis ei sarnane sellega, kuidas Perplexity tegelikult töötab. Kui Cloudflare oleks tõeliselt huvitatud nähtavate andmete mõistmisest, meie süsteemide tööst või nendest ülaltoodud põhikontseptsioonidest, oleksid nad saanud teha seda, mida julgustame kõiki Perplexity kasutajaid tegema. Lihtsalt küsige.