Com vam integrar la seguretat a Comet des del primer dia

Treball de seguretat de Comet: auditories, defenses i recerca obert.

Comet dóna als assistents d'IA capacitats potents per navegar per llocs web, interactuar amb contingut i completar tasques complexes en nom dels usuaris. Aquestes capacitats requereixen mesures de protecció igualment potents. Abans de llançar Comet públicament, vam contractar Trail of Bits per posar a prova les nostres defenses mitjançant auditories formals. El seu treball ens va ajudar a identificar vulnerabilitats i a reforçar les nostres mitigacions abans que els usuaris comencessin a confiar en Comet per a tasques sensibles.

Construir la defensa des dels fonaments

Els atacs d'injecció de ordres (prompt injection) estan en constant evolució, i defensar-se'n requereix un enfocament de múltiples capes. Sabíem des del principi que un sol mecanisme de defensa no seria suficient. El nostre principi bàsic és ben senzill: les proteccions superposades garanteixen que, si s'eludeix una capa, n'hi hagi d'altres per mantenir els usuaris segurs. Així és com ho portem a la pràctica.

El nostre recorregut en seguretat: fites clau

Abril de 2025: Auditoria de seguretat prèvia al llançament

Abans de llançar Comet públicament, vam contractar Trail of Bits per dur a terme una modelització sistemàtica d'amenaces de la nostra arquitectura. El seu equip va provar escenaris d'atac del món real, intentant eludir les nostres defenses amb tècniques que els adversaris podrien utilitzar a la natura. L'auditoria va identificar buits específics en el nostre sistema de protecció i va iniciar un procés de remediació iteratiu. Vam refinar les nostres mitigacions i vam tancar les vulnerabilitats abans que poguessin afectar els usuaris.

Octubre de 2025: Publicació de la nostra arquitectura de defensa

Vam publicar una publicació tècnica detallada que explica el nostre marc d'arquitectura de defensa de quatre capes i el raonament darrere de cada component. La publicació va detallar tipus d'atacs específics contra els quals ens defensem, des d'injeccions ocultes d'HTML i CSS fins a la confusió de continguts i el segrest d'objectius. També vam anunciar el nostre programa de recompensa per errors (bug bounty), convidant investigadors de seguretat a provar les nostres defenses i informar de vulnerabilitats. La transparència sempre ha estat fonamental en el nostre enfocament de seguretat: creiem que compartir la nostra metodologia fa que tota la indústria de la IA sigui més forta.

Desembre de 2025: Obertura del codi font de BrowseSafe

La seguretat millora quan tota la comunitat d'IA pot aprendre de la investigació compartida. Vam publicar BrowseSafe, el nostre model de detecció i punt de referència d'avaluació, com a eines de codi obert. BrowseSafe-Bench inclou 14.719 exemples que cobreixen 11 tipus d'atacs, 9 estratègies d'injecció i 3 estils lingüístics. En publicar la nostra metodologia i conjunts de dades, ajudem a altres desenvolupadors d'IA a construir sistemes més segurs i contribuïm a estàndards de seguretat a tota la indústria. La resposta de la comunitat de desenvolupadors ha estat encoratjadora, amb equips que ja utilitzen BrowseSafe per millorar la seguretat del seu propi assistent d'IA.

El que hem après

Construir seguretat per a assistents d'IA ens ha ensenyat lliçons crítiques sobre el panorama d'amenaces en evolució. Les proves d'adversaris externs revelen punts cecs que els equips interns poden passar per alt, per molt capacitats que siguin. La modelització d'amenaces no és un exercici d'una sola vegada sinó una disciplina contínua que ha d'evolucionar a mesura que avancen les tècniques d'atac. El més important de tot és que la seguretat requereix col·laboració a tota la indústria. En compartir la nostra investigació, implicar experts externs i contribuir a estàndards oberts, estem ajudant a construir un ecosistema més segur.

El nostre compromís continu

Mantenim avaluacions de seguretat periòdiques a mesura que Comet evoluciona, garantint que les noves funcions se sotmetin a un examen rigorós abans del llançament. Per ajudar a reduir la desinformació en la investigació de seguretat d'IA, invertim en pràctiques d'avaluació sòlides i informes transparents perquè les troballes sobre les defenses de Comet siguin precises, reproduïbles i no estiguin distorsionades per declaracions de seguretat senzillistes o incompletes.

El nostre equip també gestiona un programa de divulgació de vulnerabilitats pròsper i un programa privat de recompensa per errors, convidant investigadors de seguretat de tot arreu a provar les nostres defenses. A mesura que els assistents d'IA esdevinguin més capaços i gestionin tasques cada cop més sensibles, les nostres inversions en seguretat continuaran augmentant en conseqüència.