剣 KENSAI
अनुसंधान 2026-06-06 · 4 मिनट पढ़ें

KENSAI शोध: एजेंटिक बग बाउंटी ट्रायेज के लिए प्रमाण-आधारित पुनरुत्पादन आवश्यक है

6 जून का शोध नोट: AGI-सहायित बाउंटी कार्यप्रवाह तभी उपयोगी बनते हैं, जब हर संभावित निष्कर्ष दायरे से बँधा हो, साफ़ साक्ष्य के साथ दोहराया गया हो और रखरखावकर्ताओं के भरोसे योग्य पर्याप्त प्रमाण के साथ भेजा जाए।

पहले दायराएजेंट को शोषण की संभावना पर विचार करने से पहले कार्यक्रम विवरण से बाहर के आकर्षक रास्तों को अस्वीकार करना चाहिए।
फिर प्रमाणकिसी निष्कर्ष को तब तक आगे नहीं बढ़ाया जाता, जब तक पुनरुत्पादन के कदम, प्रभावित एसेट और अपेक्षित प्रभाव एक-दूसरे से मेल न खाएँ।
मानवीय हस्तांतरणरिपोर्ट को रखरखावकर्ता का काम तेज़ करना चाहिए, उसे स्वायत्त अटकलों के ढेर में नहीं दबाना चाहिए।

दायरे के अनुशासन के बिना स्वायत्तता केवल तेज़ शोर है

बग बाउंटी का काम जिज्ञासा को पुरस्कृत करता है, लेकिन कार्यक्रम अनुबंध होते हैं। AGI-सहायित ट्रायेज चक्र की शुरुआत नीति को संचालनात्मक रक्षापंक्तियों में बदलने से होनी चाहिए: अनुमत होस्ट, निषिद्ध परीक्षण श्रेणियाँ, दर सीमाएँ, डेटा-संचालन की सीमाएँ और प्रकटीकरण की भाषा। KENSAI इस नीति को ऐसा जीवंत बंधन मानता है जो एजेंट के अन्वेषण से पहले केवल एक बार पढ़ा गया अनुच्छेद नहीं है।

उपयोगी इकाई दोहराया गया दावा है

आशाजनक स्टैक ट्रेस, असामान्य प्रतिक्रिया हेडर या प्राधिकरण का अंतर केवल एक संकेत है। बाउंटी टीम के लिए उपयोगी इकाई दोहराया गया दावा है: कौन-सा अनुरोध भेजा गया, कौन-सी पूर्वशर्त मौजूद थी, क्या बदला, कौन-सा साक्ष्य प्रभाव सिद्ध करता है और सुधार के बाद पुनःपरीक्षण में क्या दिखना चाहिए। यह संरचना AGI सहायता को उन रखरखावकर्ताओं के अनुरूप रखती है जिन्हें संक्षिप्त, सत्यापन योग्य तथ्य चाहिए।

ट्रायेज को रखरखावकर्ता की अनिश्चितता घटानी चाहिए

सबसे मजबूत रिपोर्ट सबसे लंबी रिपोर्ट नहीं होती। वह अवलोकन को निष्कर्ष से अलग करती है, गलत सकारात्मक परिणामों को खारिज करने वाली नकारात्मक जाँच शामिल करती है और कार्यक्रम की भाषा में बताती है कि समस्या क्यों महत्वपूर्ण है। KENSAI के लिए एजेंटिक काम यहीं भरोसा कमाता है: स्वतंत्र सुरक्षा इंजीनियर के लिए परिणाम दोहराने लायक पर्याप्त विवरण बचाते हुए समीक्षा का प्रयास घटाकर।

AGI युग की सुरक्षा टीमों के लिए यह क्यों महत्वपूर्ण है

जैसे-जैसे मॉडल बहु-चरणीय परीक्षणों की योजना बनाने में बेहतर होते हैं, बाधा विचार उत्पन्न करने से हटकर साक्ष्य की गुणवत्ता पर आ जाती है। जो टीमें अभी दायरा जाँच, प्रमाण संग्रह और रिपोर्ट की स्वच्छता व्यवस्थित करती हैं, वे बाद में अधिक सक्षम एजेंटों के लिए तैयार होंगी, क्योंकि सुरक्षा सीमा और गुणवत्ता मानक पहले से स्पष्ट होंगे।

संभावित स्वायत्तता से बेहतर है प्रमाण

KENSAI एजेंटिक सुरक्षा कार्यप्रवाहों को सीमित दायरे वाले परीक्षण, पुनरुत्पादन योग्य निष्कर्ष और साफ़ रखरखावकर्ता हस्तांतरण के इर्द-गिर्द बना रहा है—वे साधारण नियंत्रण जो AGI सहायता को उपयोगी होने लायक सुरक्षित बनाते हैं।

KENSAI, AI-संचालित सुरक्षा इंटेलिजेंस