Agent API: Nơi duy nhất để xây dựng với LLM, Web và Tác nhân
Agent API của Perplexity là một điểm cuối có thể lập trình cho tìm kiếm web, lấy URL, thực thi mã, MCP, tìm kiếm tài chính và con người, với các cấu hình sẵn có thể điều chỉnh.

Perplexity đang xây dựng cơ sở hạ tầng cho các công việc phụ thuộc vào mô hình ngôn ngữ, web công cộng và các tác nhân hoạt động trên cả hai nền tảng đó. Agent API là phương thức để các nhà phát triển kết nối với cơ sở hạ tầng đó. Đây là một điểm cuối có thể lập trình duy nhất dành cho tìm kiếm web, lấy URL, thực thi mã, kết nối MCP, cũng như tìm kiếm tài chính và con người. Đối với mỗi yêu cầu, các tính năng này được kết hợp theo yêu cầu vào một quy trình truy xuất.
Hôm nay, chúng tôi đang nâng cấp tất cả khách hàng Sonar lên cấu hình sẵn Agent API, đạt điểm cao hơn trên các bài kiểm tra chuẩn với chi phí thấp hơn. Sonar sẽ tiếp tục khả dụng trong 45 ngày trước khi Agent API trở thành giao diện duy nhất cho công việc này. Những khách hàng có cam kết hợp đồng hiện tại với Sonar sẽ được hỗ trợ cho đến hết thời hạn hiện tại của họ.
Các nhóm sử dụng giải pháp này để xây dựng các tác nhân nghiên cứu, trải nghiệm trả lời trong sản phẩm và các quy trình làm việc tự động cần thông tin cập nhật, có trích dẫn, mà không cần phải kết nối thủ công một nhà cung cấp tìm kiếm, máy chủ mô hình, môi trường chạy công cụ và lớp điều phối riêng biệt.
Một giao diện có thể lập trình duy nhất
Trước Agent API, Sonar cung cấp các tính năng thông qua một tập hợp các mô hình cố định: Sonar, Sonar Pro, Sonar Reasoning Pro và Sonar Deep Research. Việc chọn một mô hình đồng nghĩa với việc chọn một gói tĩnh gồm độ sâu suy luận, hành vi tìm kiếm và chi phí, đồng thời cố định gói đó vào mã nguồn sản xuất. Mỗi bậc là một quyết định sản phẩm riêng biệt thay vì là cấu hình của một hệ thống dùng chung.
Agent API thu gọn các bậc đó thành một giao diện duy nhất có thể lập trình. Sáu cấu hình sẵn (preset) gồm fast, low, medium, high, xhigh và wide-research nằm trên cùng một cơ sở hạ tầng và cung cấp các mức độ khác nhau trên đường cong chất lượng và chi phí. Mỗi cấu hình sẵn là một thiết lập minh bạch, được định cấu hình sẵn: một mô hình đi kèm với lời nhắc hệ thống, cấu hình công cụ, nỗ lực suy luận và ngân sách mã thông báo được tinh chỉnh dựa trên khối lượng công việc thực tế.
Các cấu hình sẵn được tinh chỉnh lại theo mỗi lần phát hành mô hình tiên tiến, do đó một lệnh gọi low hôm nay và cùng một lệnh gọi đó sáu tháng sau đều phản ánh trạng thái công nghệ tiên tiến nhất tại thời điểm đó với mức chi phí có thể dự đoán được. Mọi tham số đều có thể được ghi đè.
Các bậc của Sonar tương ứng trực tiếp với các cấu hình sẵn: sonar với fast, sonar-pro với low, sonar-reasoning-pro với medium và sonar-deep-research với high. Cấu hình sẵn xhigh mở rộng vượt ra ngoài Nghiên cứu chuyên sâu (Deep Research) đối với công việc tác nhân mở.
Search as Code, lớp bên dưới
Agent API bao gồm tìm kiếm web, lấy URL, hộp cát (sandbox) mã, kết nối máy chủ MCP, tìm kiếm tài chính và tìm kiếm con người. Các cấu hình sẵn định cấu hình các công cụ này theo mặc định và mọi công cụ đều khả dụng cho bất kỳ cấu hình tác nhân tùy chỉnh nào.
Các công cụ này nằm trên Search as Code, kiến trúc đằng sau ngăn xếp tìm kiếm của Perplexity. Thay vì định tuyến việc truy xuất thông qua một giao diện cố định duy nhất, Search as Code hiển thị các thành phần cơ bản của tìm kiếm mà mô hình kết hợp theo yêu cầu thành một quy trình truy xuất cho mỗi yêu cầu. Đó là điều cho phép các cấu hình sẵn cấp cao chạy hàng nghìn bước truy xuất trong một lệnh gọi duy nhất.
Đó cũng là điều cho phép các cấu hình sẵn trên toàn dải mang lại câu trả lời tốt hơn cho mỗi đô la so với quy trình tìm kiếm kết hợp mô hình truyền thống. Các nhà phát triển nhận được các thành phần cơ bản tương tự mà các sản phẩm của chính Perplexity được xây dựng dựa trên đó, trong cùng một API.
Chất lượng trên mỗi đô la cao hơn trên các bài kiểm tra chuẩn
Chúng tôi đã đánh giá các cấu hình sẵn của Agent API và các mô hình Sonar trên các khối lượng công việc giống hệt nhau qua ba bài kiểm tra chuẩn: BrowseComp, đo lường việc duyệt web của tác nhân trên các câu hỏi yêu cầu chuỗi nhiều tìm kiếm; DeepSearchQA, đo lường chất lượng câu trả lời đối với các câu hỏi nghiên cứu sâu; và WideSearch, đo lường mức độ hoàn thiện của một lần chạy khi thu thập và điền vào các kết quả có cấu trúc.

Cấu hình sẵn low mang lại cải thiện khoảng 7 lần trên BrowseComp so với Sonar Pro ở mức khoảng 0,05 USD cho mỗi truy vấn. Các cấu hình sẵn của Agent API có thể sánh ngang với Sonar Deep Research với một phần nhỏ chi phí.
Các bước tiếp theo cho người dùng Sonar
Nếu người dùng gọi Sonar hôm nay, họ sẽ cần hướng tích hợp của mình đến Agent API trước ngày ngừng hoạt động. Đây là một thay đổi nhỏ: lựa chọn mô hình hiện tại tương ứng với một cấu hình sẵn phù hợp, và định dạng yêu cầu cũng như phản hồi có sự khác biệt nhỏ.
Hầu hết các nhóm đều hoàn tất việc này trong vài phút. Kỹ năng (skill) tác nhân lập trình của chúng tôi có thể áp dụng thay đổi tại chỗ và hướng dẫn di chuyển tại docs.perplexity.ai sẽ hướng dẫn từng trường cho các kỹ sư thực hiện thủ công.
Nếu không có thay đổi nào được thực hiện trước ngày ngừng hoạt động, các lệnh gọi Sonar sẽ ngừng hoạt động, vì vậy chúng tôi khuyên bạn nên di chuyển sớm trong thời gian ân hạn.
Khả năng tiếp tục sử dụng
Các điểm cuối Sonar vẫn hoàn toàn khả dụng ngay hôm nay. Vào ngày 27 tháng 9 năm 2026, Agent API trở thành giao diện chính cho công việc này và các bậc của Sonar sẽ ngừng hoạt động vào cùng ngày đó. Mọi bậc hiện tại đều tương ứng với một cấu hình sẵn đạt điểm chuẩn cao hơn với chi phí thấp hơn, vì vậy việc chuyển đổi này giúp củng cố khối lượng công việc vào một hệ thống có thể lập trình duy nhất mà không phải đánh đổi bất kỳ điều gì. Tài liệu di chuyển, chi tiết cấu hình sẵn và hướng dẫn ánh xạ từng trường có tại docs.perplexity.ai.