Πώς ενσωματώσαμε την ασφάλεια στο Comet από την πρώτη μέρα

Το έργο ασφάλειας του Comet: εξωτερικοί έλεγχοι, πολυεπίπεδες άμυνες κατά των εγχύσεων προτροπών και έρευνα ανοιχτού κώδικα.

Το Comet προσφέρει σε βοηθούς τεχνητής νοημοσύνης ισχυρές δυνατότητες περιήγησης σε ιστότοπους, αλληλεπίδρασης με περιεχόμενο και ολοκλήρωσης σύνθετων εργασιών για λογαριασμό των χρηστών. Αυτές οι δυνατότητες απαιτούν εξίσου ισχυρές δικλείδες ασφαλείας. Πριν κυκλοφορήσουμε δημόσια το Comet, προσλάβαμε την Trail of Bits για να δοκιμάσει τις άμυνές μας υπό πίεση μέσω επίσημων ελέγχων. Το έργο τους μάς βοήθησε να εντοπίσουμε ευπάθειες και να ενισχύσουμε τα μέτρα προστασίας μας προτού οι χρήστες αρχίσουν να βασίζονται στο Comet για ευαίσθητες εργασίες.​

Χτίζοντας την άμυνα από τα θεμέλια

Οι επιθέσεις έγχυσης προτροπών (prompt injection) εξελίσσονται συνεχώς και η άμυνα απέναντί τους απαιτεί μια πολυεπίπεδη προσέγγιση. Γνωρίζαμε από την αρχή ότι ένας μεμονωμένος μηχανισμός άμυνας δεν θα ήταν αρκετός. Η βασική μας αρχή είναι απλή: οι αλληλεπικαλυπτόμενες προστασίες διασφαλίζουν ότι εάν παρακαμφθεί ένα επίπεδο, άλλα παραμένουν για να κρατήσουν τους χρήστες ασφαλείς.​ Δείτε πώς το εφαρμόσαμε στην πράξη.

Η πορεία μας στην ασφάλεια: Βασικά ορόσημα

Απρίλιος 2025: Έλεγχος ασφάλειας πριν από την κυκλοφορία

Πριν κυκλοφορήσουμε δημόσια το Comet, προσλάβαμε την Trail of Bits για να διεξάγει συστηματική μοντελοποίηση απειλών της αρχιτεκτονικής μας. Η ομάδα τους δοκίμασε σενάρια επιθέσεων από τον πραγματικό κόσμο, προσπαθώντας να παρακάμψει τις άμυνές μας χρησιμοποιώντας τεχνικές που θα μπορούσαν να χρησιμοποιήσουν οι αντίπαλοι στην πράξη. Ο έλεγχος εντόπισε συγκεκριμένα κενά στο σύστημα προστασίας μας και ξεκίνησε μια επαναληπτική διαδικασία αποκατάστασης. Βελτιώσαμε τα μέτρα προστασίας μας και κλείσαμε τα κενά ασφαλείας προτού μπορέσουν να επηρεάσουν τους χρήστες.​

Οκτώβριος 2025: Δημοσίευση της αρχιτεκτονικής άμυνάς μας

Δημοσιεύσαμε μια λεπτομερή τεχνική ανάρτηση που εξηγεί το πλαίσιο της τετραεπίπεδης αρχιτεκτονικής άμυνάς μας και το σκεπτικό πίσω από κάθε στοιχείο. Η ανάρτηση περιέγραψε συγκεκριμένους τύπους επιθέσεων κατά των οποίων αμυνόμαστε, από κρυφές εγχύσεις HTML και CSS έως τη σύγχυση περιεχομένου και την πειρατεία στόχων. Ανακοινώσαμε επίσης το πρόγραμμα αμοιβής για εντοπισμό σφαλμάτων (bug bounty), προσκαλώντας ερευνητές ασφάλειας να δοκιμάνουν τις άμυνές μας και να αναφέρουν ευπάθειες. Η διαφάνεια υπήρξε πάντα ο πυρήνας της προσέγγισής μας για την ασφάλεια: πιστεύουμε ότι η κοινοποίηση της μεθοδολογίας μας καθιστά ολόκληρη τη βιομηχανία τεχνητής νοημοσύνης ισχυρότερη.​

Δεκέμβριος 2025: Διάθεση του BrowseSafe ως ανοιχτού κώδικα

Η ασφάλεια βελτιώνεται όταν ολόκληρη η κοινότητα της τεχνητής νοημοσύνης μπορεί να μαθαίνει από την κοινή έρευνα. Διαθέσαμε το BrowseSafe, το μοντέλο ανίχνευσης και το σημείο αναφοράς αξιολόγησής μας, ως εργαλεία ανοιχτού κώδικα. Το BrowseSafe-Bench περιλαμβάνει 14.719 παραδείγματα που καλύπτουν 11 τύπους επιθέσεων, 9 στρατηγικές έγχυσης και 3 γλωσσικά στυλ. Δημοσιεύοντας τη μεθοδολογία και τα σύνολα δεδομένων μας, βοηθάμε άλλους προγραμματιστές τεχνητής νοημοσύνης να κατασκευάσουν ασφαλέστερα συστήματα και συμβάλλουμε στα πρότυπα ασφάλειας σε ολόκληρη τη βιομηχανία. Η ανταπόκριση από την κοινότητα των προγραμμαιστών ήταν ενθαρρυντική, με τις ομάδες να χρησιμοποιούν ήδη το BrowseSafe για να βελτιώσουν την ασφάλεια των δικών τους βοηθών τεχνητής νοημοσύνης.​

Αυτό που έχουμε μάθει

Η δημιουργία ασφάλειας για βοηθούς τεχνητής νοημοσύνης μάς έχει διδάξει κρίσιμα μαθήματα σχετικά με το μεταβαλλόμενο τοπίο απειλών. Η εξωτερική δοκιμή από αντιπάλους αποκαλύπτει τυφλά σημεία που οι εσωτερικές ομάδες μπορεί να χάσουν, ανεξάρτητα από το πόσο έμπειρες είναι. Η μοντελοποίηση απειλών δεν είναι μια εφάπαξ άσκηση αλλά μια συνεχιζόμενη πειθαρχία που πρέπει να εξελίσσεται καθώς οι τεχνικές επίθεσης προχωρούν. Το πιο σημαντικό είναι ότι η ασφάλεια απαιτεί συνεργασία σε ολόκληρη τη βιομηχανία. Μέσω της κοινοποίησης της έρευνάς μας, της εμπλοκής εξωτερικών ειδικών και της συμβολής σε ανοιχτά πρότυπα, βοηθάμε στη δημιουργία ενός ασφαλέστερου οικοσυστήματος.

Η συνεχιζόμενη δέσμευσή μας

Διατηρούμε τακτικές αξιολογήσεις ασφάλειας καθώς το Comet εξελίσσεται, διασφαλίζοντας ότι τα νέα χαρακτηριστικά υποβάλλονται σε αυστηρό έλεγχο πριν από την κυκλοφορία. Για να συμβάλουμε στον περιορισμό της παραπλανητικής πληροφόρησης στην έρευνα ασφάλειας τεχνητής νοημοσύνης, επενδύουμε σε ισχυρές πρακτικές αξιολόγησης και διαφανή αναφορά, ώστε τα πορίσματα σχετικά με τις άμυνες του Comet να είναι ακριβή, αναπαραγώγιμα και να μην αλλοιώνονται από εντυπωσιοθηρικούς ή ελλιπείς ισχυρισμούς ασφάλειας.

Η ομάδα μας διαχειρίζεται επίσης ένα ακμάζον Πρόγραμμα Γνωστοποίησης Ευπαθειών και ένα ιδιωτικό πρόγραμμα αμοιβής για εντοπισμό σφαλμάτων (bug bounty), προσκαλώντας ερευνητές ασφάλειας παντού να δοκιμάσουν τις άμυνές μας. Καθώς οι βοηθοί τεχνητής νοημοσύνης γίνονται πιο ικανοί και χειρίζονται όλο και πιο ευαίσθητες εργασίες, οι επενδύσεις μας στην ασφάλεια θα συνεχίσουν να κλιμακώνονται αναλόγως.​