अनुसंधान
AI एजेंट्स के साथ कैसे बनाएँ — और परिणाम पर भरोसा करें।
हम अध्ययन करते हैं कि एजेंट-सहायित इंजीनियरिंग को क्या विश्वसनीय और सुरक्षित बनाता है, और उत्तरों को ऐसे खुले टूल्स और मानकों में बदलते हैं जिन्हें कोई भी उपयोग कर सके।
अनुसंधान क्षेत्र
विश्वसनीय एजेंट इंजीनियरिंग
ऑर्केस्ट्रेशन, विघटन और गार्डरेल जो AI एजेंट्स को लंबे, बहु-चरणीय काम के दौरान लक्ष्य पर बनाए रखते हैं — बिना जल्दी रुके या स्पेसिफ़िकेशन से भटके।
AI-सहायित डिलीवरी की सुरक्षा
एजेंट-लिखित कोड कैसे विफल होता है, उसे कैसे पकड़ें, और सुरक्षित-बाय-डिज़ाइन को डिफ़ॉल्ट कैसे बनाएँ: IAM, AppSec और एजेंट्स जो उत्पन्न करते हैं उसकी अधिकृत रेड-टीमिंग।
मानक और मूल्यांकन
एजेंट के आउटपुट के लिए 'अच्छा' का क्या अर्थ है, और इसे कैसे मापें: नॉर्मेटिव प्लेबुक, क्वालिटी गेट्स और ऐसे परीक्षण जो अनुमानों के बजाय व्यवहार को सिद्ध करते हैं।
डेवलपर अनुभव
सही तरीके को आसान तरीका बनाना — ऐसी टूलिंग जो मानकों को इंस्टॉल करती है, उन्हें अद्यतन रखती है, और डेवलपर के रास्ते से हट जाती है।
हमारा दृष्टिकोण
खुले में
निष्कर्ष और टूल्स प्रकाशित किए जाते हैं, जमा नहीं किए जाते। पुनरुत्पादनीयता ही मुख्य बात है।
अभ्यास में आधारित
हम निर्माण और शिपिंग करके अनुसंधान करते हैं — लैब और उत्पाद एक-दूसरे को पोषित करते हैं।
सुरक्षा-फ़र्स्ट
अगर इसे चलाना सुरक्षित नहीं है, तो यह पूरा नहीं हुआ। थ्रेट मॉडलिंग और परीक्षण इस पद्धति का हिस्सा हैं।
अनुसंधान का अनुसरण करें।
जो हम सीखते हैं उसे हम ब्लॉग पर लिखते हैं, और टूल्स GitHub पर पहुँचते हैं।