Cách chúng tôi xây dựng bảo mật vào Comet ngay từ Ngày đầu tiên

Bên trong công tác bảo mật của Comet: kiểm toán bên ngoài, phòng thủ tiêm nhiễm lời nhắc đa tầng và nghiên cứu mã nguồn mở.

Comet cung cấp cho các trợ lý AI khả năng mạnh mẽ để duyệt trang web, tương tác với nội dung và hoàn thành các tác vụ phức tạp thay cho người dùng. Những khả năng này đòi hỏi các biện pháp bảo vệ cũng mạnh mẽ không kém. Trước khi ra mắt Comet công khai, chúng tôi đã thuê Trail of Bits để kiểm tra độ bền vững của hệ thống phòng thủ thông qua các đợt kiểm toán chính thức. Công việc của họ đã giúp chúng tôi xác định các lỗ hổng và củng cố các biện pháp giảm thiểu trước khi người dùng bắt đầu dựa vào Comet cho các tác vụ nhạy cảm.​

Xây dựng hệ thống phòng thủ từ gốc

Các cuộc tấn công tiêm nhiễm lời nhắc không ngừng tiến hóa, và việc phòng thủ chống lại chúng đòi hỏi một cách tiếp cận đa tầng. Ngay từ đầu, chúng tôi đã biết rằng một cơ chế phòng thủ đơn lẻ là chưa đủ. Nguyên tắc cốt lõi của chúng tôi rất đơn giản: các lớp bảo vệ chồng chéo đảm bảo rằng nếu một lớp bị vượt qua, các lớp khác vẫn duy trì để giữ an toàn cho người dùng.​ Dưới đây là cách chúng tôi áp dụng điều đó vào thực tế.

Hành trình bảo mật của chúng tôi: Các cột mốc quan trọng

Tháng 4 năm 2025: Kiểm toán bảo mật trước khi ra mắt

Trước khi ra mắt Comet công khai, chúng tôi đã thuê Trail of Bits để tiến hành mô hình hóa mối đe dọa có hệ thống đối với kiến trúc của mình. Nhóm của họ đã thử nghiệm các kịch bản tấn công thực tế, cố gắng vượt qua hệ thống phòng thủ của chúng tôi bằng các kỹ thuật mà kẻ xấu có thể sử dụng ngoài đời thực. Đợt kiểm toán đã xác định các khoảng trống cụ thể trong hệ thống bảo vệ của chúng tôi và khởi động quá trình khắc phục lặp đi lặp lại. Chúng tôi đã tinh chỉnh các biện pháp giảm thiểu và đóng lại các lỗ hổng trước khi chúng có thể ảnh hưởng đến người dùng.​

Tháng 10 năm 2025: Công bố kiến trúc phòng thủ của chúng tôi

Chúng tôi đã xuất bản một bài viết kỹ thuật chi tiết giải thích về khung kiến trúc phòng thủ bốn lớp của chúng tôi và lý do đằng sau từng thành phần. Bài viết phác thảo các loại tấn công cụ thể mà chúng tôi phòng thủ, từ cácinjection HTML và CSS ẩn cho đến sự nhầm lẫn nội dung và thao túng mục tiêu. Chúng tôi cũng công bố chương trình tiền thưởng lỗi của mình, mời các nhà nghiên cứu bảo mật kiểm tra hệ thống phòng thủ và báo cáo lỗ hổng. Tính minh bạch luôn là cốt lõi trong phương pháp bảo mật của chúng tôi: chúng tôi tin rằng việc chia sẻ phương pháp luận của mình sẽ giúp toàn bộ ngành công nghiệp AI trở nên vững mạnh hơn.​

Tháng 12 năm 2025: Mở mã nguồn BrowseSafe

Bảo mật sẽ được cải thiện khi toàn bộ cộng đồng AI có thể học hỏi từ các nghiên cứu được chia sẻ. Chúng tôi đã phát hành BrowseSafe, mô hình phát hiện và chuẩn đánh giá của chúng tôi, dưới dạng các công cụ mã nguồn mở. BrowseSafe-Bench bao gồm 14.719 ví dụ bao phủ 11 loại tấn công, 9 chiến lược tiêm nhiễm và 3 phong cách ngôn ngữ. Bằng cách công bố phương pháp luận và tập dữ liệu của mình, chúng tôi đang giúp các nhà phát triển AI khác xây dựng các hệ thống an toàn hơn và đóng góp vào các tiêu chuẩn bảo mật toàn ngành. Phản hồi từ cộng đồng nhà phát triển rất đáng khích lệ, với các nhóm đã sử dụng BrowseSafe để cải thiện tính bảo mật cho trợ lý AI của chính họ.​

Những gì chúng tôi đã học được

Việc xây dựng bảo mật cho các trợ lý AI đã mang lại cho chúng tôi những bài học quan trọng về bối cảnh mối đe dọa không ngừng tiến hóa. Kiểm thử đối kháng bên ngoài tiết lộ những điểm mù mà các nhóm nội bộ có thể bỏ sót, dù có giỏi đến đâu. Mô hình hóa mối đe dọa không phải là một hoạt động diễn ra một lần mà là một kỷ luật liên tục phải tiến hóa theo sự phát triển của các kỹ thuật tấn công. Quan trọng nhất, bảo mật đòi hỏi sự hợp tác trên toàn ngành. Bằng cách chia sẻ nghiên cứu, thu hút các chuyên gia bên ngoài và đóng góp vào các tiêu chuẩn mở, chúng tôi đang giúp xây dựng một hệ sinh thái an toàn hơn.

Cam kết liên tục của chúng tôi

Chúng tôi duy trì các đánh giá bảo mật thường xuyên khi Comet phát triển, đảm bảo các tính năng mới trải qua quá trình kiểm tra nghiêm ngặt trước khi ra mắt. Để giúp giảm thiểu thông tin sai lệch trong nghiên cứu bảo mật AI, chúng tôi đầu tư vào các phương pháp đánh giá mạnh mẽ và báo cáo minh bạch để các phát hiện về hệ thống phòng thủ của Comet được chính xác, có thể tái tạo và không bị bóp méo bởi các tuyên bố bảo mật giật gân hoặc chưa đầy đủ. 

Nhóm của chúng tôi cũng vận hành một Chương trình Tiết lộ Lỗ hổng thịnh vượng và chương trình tiền thưởng lỗi riêng tư, mời các nhà nghiên cứu bảo mật ở mọi nơi kiểm tra hệ thống phòng thủ của chúng tôi. Khi các trợ lý AI trở nên có năng lực hơn và xử lý các tác vụ ngày càng nhạy cảm, các khoản đầu tư bảo mật của chúng tôi sẽ tiếp tục mở rộng tương ứng.​