Nghiên cứu

Cách xây dựng với các tác nhân AI — và tin tưởng vào kết quả.

Chúng tôi nghiên cứu điều gì làm cho kỹ thuật có hỗ trợ tác nhân trở nên đáng tin cậy và an toàn, rồi biến câu trả lời thành các công cụ và tiêu chuẩn mở mà bất kỳ ai cũng có thể sử dụng.

Lĩnh vực nghiên cứu

Kỹ thuật tác nhân đáng tin cậy

Điều phối, phân rã và các rào chắn giúp các tác nhân AI bám sát nhiệm vụ qua công việc dài, nhiều bước — mà không dừng lại quá sớm hoặc đi chệch khỏi đặc tả.

Bảo mật của việc phân phối có hỗ trợ AI

Cách mã do tác nhân viết bị lỗi, cách phát hiện nó, và cách biến an toàn từ thiết kế thành mặc định: IAM, AppSec và red-teaming được ủy quyền đối với những gì tác nhân tạo ra.

Tiêu chuẩn & đánh giá

'Tốt' nghĩa là gì đối với đầu ra của tác nhân, và cách đo lường nó: các sổ tay quy chuẩn, cổng chất lượng và kiểm thử chứng minh hành vi thay vì cảm tính.

Trải nghiệm nhà phát triển

Biến cách đúng thành cách dễ — bộ công cụ cài đặt các tiêu chuẩn, giữ chúng luôn cập nhật, và không cản đường nhà phát triển.

Cách tiếp cận của chúng tôi

Công khai

Các phát hiện và công cụ được công bố, không giữ riêng. Khả năng tái lập chính là điều cốt lõi.

Bám sát thực tiễn

Chúng tôi nghiên cứu bằng cách xây dựng và đưa vào sử dụng — phòng thí nghiệm và các sản phẩm nuôi dưỡng lẫn nhau.

Ưu tiên bảo mật

Nếu chạy nó không an toàn thì chưa hoàn thành. Mô hình hóa mối đe dọa và kiểm thử là một phần của phương pháp.

Theo dõi nghiên cứu.

Chúng tôi viết lại những gì học được trên blog, và các công cụ xuất hiện trên GitHub.