Sådan opbyggede vi sikkerhed ind i Comet fra dag ét

Ind i Comets sikkerhedsarbejde: eksterne audits, lagdelte prompt-injektionsforsvar og open-source-forskning.

Comet giver AI-assistenter kraftfulde funktioner til at gennemse websteder, interagere med indhold og udføre komplekse opgaver på vegne af brugere. Disse funktioner kræver lige så kraftfulde beskyttelsesforanstaltninger. Før vi lancerede Comet offentligt, hyrede vi Trail of Bits til at stressteste vores forsvar gennem formelle audits. Deres arbejde hjalp os med at identificere sårbarheder og styrke vores afbødninger, før brugerne begyndte at stole på Comet til følsomme opgaver.​

Opbygning af forsvar fra bunden

Angreb med prompt-injektion udvikler sig konstant, og forsvar mod dem kræver en flerlagstilgang. Vi vidste fra starten, at en enkelt forsvarsmekanisme ikke ville være nok. Vores kerneprincip er simpelt: Overlappende beskyttelser sikrer, at hvis det ene lag omgås, forbliver andre der for at holde brugerne sikre.​ Sådan omsætter vi det i praksis.

Vores sikkerhedsrejse: Vigtige milepæle

April 2025: Sikkerhedsaudit før lancering

Før vi lancerede Comet offentligt, hyrede vi Trail of Bits til at udføre systematisk trusselsmodellering af vores arkitektur. Deres hold testede virkelige angrebsscenarier i forsøg på at omgå vores forsvar ved hjælp af teknikker, som modstandere kunne finde på at bruge i praksis. Auditten identificerede specifikke huller i vores beskyttelsessystem og satte gang i en iterativ udbedringsproces. Vi finjusterede vores afbødninger og lukkede sårbarheder, før de kunne påvirke brugerne.​

Oktober 2025: Offentliggørelse af vores forsvarsarkitektur

Vi udgav et detaljeret teknisk indlæg , der forklarer vores fire-lags forsvarsarkitekturrammeværk og tankegangen bag hver enkelt komponent. Indlægget skitserede specifikke angrebstyper, vi forsvarer os imod, lige fra skjulte HTML- og CSS-injektioner til indholdsforvirring og målkapring. Vi annoncerede også vores hittebørnsprogram, som inviterer sikkerhedsforskere til at teste vores forsvar og rapportere sårbarheder. Gennemsigtighed har altid været centralt for vores sikkerhedstilgang: Vi tror på, at deling af vores metodologi gør hele AI-industrien stærkere.​

December 2025: Open-sourcing af BrowseSafe

Sikkerheden forbedres, når hele AI-fællesskabet kan lade sig inspirere af delt forskning. Vi frigav BrowseSafe, vores detektionsmodel og evalueringsbenchmark, som open-source-værktøjer. BrowseSafe-Bench indeholder 14.719 eksempler fordelt på 11 angrebstyper, 9 injektionsstrategier og 3 sproglige stilarter. Ved at udgive vores metodologi og datasæt hjælper vi andre AI-udviklere med at bygge mere sikre systemer og bidrager til branchens standarder for sikkerhed. Responsen fra udviklerfællesskabet har været opmuntrende, hvor hold allerede bruger BrowseSafe til at forbedre sikkerheden i deres egne AI-assistenter.​

Hvad vi har lært

At opbygge sikkerhed til AI-assistenter har lært os vigtige lektier om det landskab af trusler, der er i stadig udvikling. Ekstern modstandstest afslører blinde vinkler, som interne hold kan overse, uanset hvor dygtige de er. Trusselsmodellering er ikke en engangsøvelse, men en løbende disciplin, der skal udvikle sig i takt med, at angrebsteknikkerne skrider frem. Vigtigst af alt kræver sikkerhed samarbejde på tværs af branchen. Ved at dele vores forskning, inddrage eksterne eksperter og bidrage til åbne standarder hjælper vi med at opbygge et mere sikkert økosystem.

Vores fortsatte engagement

Vi opretholder regelmæssige sikkerhedsvurderinger, i takt med at Comet udvikler sig, og sikrer, at nye funktioner gennemgår grundig gennemgang før lancering. For at bidrage til at mindske misinformation inden for AI-sikkerhedsforskning investerer vi i robuste evalueringspraksisser og gennemsigtig rapportering, så fund om Comets forsvar er nøjagtige, reproducerbare og ikke forvrænget af sensationelle eller ufuldstændige sikkerhedspåstande. 

Vores hold kører også et blomstrende Vulnerability Disclosure Program og et privat bug bounty-program, der inviterer sikkerhedsforskere overalt til at teste vores forsvar. Efterhånden som AI-assistenter bliver mere dygtige og håndterer stadig mere følsomme opgaver, vil vores sikkerhedsinvesteringer fortsætte med at skalere i overensstemmelse hermed.​