یہ صفحہ مشین سے ترجمہ کیا گیا تھا۔ اگر کچھ غلط لگے تو براہ کرم ایک مسئلہ کھولیں — ریپو اسی لیے عوامی ہے۔ ترجمے کا مسئلہ رپورٹ کریں

لابی پر واپس جائیں

سپر الائنمنٹ کا منظرنامہ

اس شعبے کا زیادہ تر حصہ ماڈل کو الائن کر رہا ہے۔ CIRIS اس کے گرد ادارے بنا رہا ہے۔

طاقتور AI کو محفوظ بنانے کے دو ایمانداری پر مبنی طریقے ہیں۔ ایک یہ کہ ماڈل کی اقدار کو اس قدر تربیت دیں جب تک آپ ان پر بھروسہ نہ کر سکیں۔ دوسرا یہ کہ فرض کریں ماڈل غلط ہو سکتا ہے، اور جو کچھ وہ کرے اسے کھلے عام، لوگوں اور نظاموں کے سامنے جوابدہ بنائیں جسے کوئی بھی جانچ سکے۔ CIRIS دوسری راہ اختیار کرتا ہے۔ یہاں پورا منظرنامہ ہے، منصفانہ طریقے سے نقشہ بنایا گیا، اور ہم اس میں کہاں ہیں۔

01ہم آہنگی

وزن پر بھروسہ کریں، یا رویے کو جانچیں

AI سیفٹی کا مرکزی دھارا ماڈل کو اندر سے اچھا بنانے کی کوشش کرتا ہے: اس کی اقدار کو تربیت دیں، اس کے خیالات کا مطالعہ کریں، اسے خود سے بحث کرائیں۔ یہ کام اہم ہے۔ CIRIS دوسری راہ پر یقین رکھتا ہے۔ فرض کریں ایک قابل ماڈل غلط طریقے سے الائن ہو سکتا ہے، اور اس کے ذہن پر بھروسہ کرنے کی بجائے، اس کے اہم اقدامات کو لوگوں اور دوسرے نظاموں کے سامنے جوابدہ بنائیں جو انہیں جانچ سکیں۔

اس شعبے کی اپنی اصطلاحات میں، CIRIS ادارتی اور کنٹرول شاخ میں ہے، AI کنٹرول اور guaranteed-safe AI کے ساتھ، نہ کہ RLHF، Constitutional AI، بحث اور تفسیر کے اقدار-داخلی مرکزی دھارے میں۔ توسیع پذیر نگرانی کا اس کا جواب، یعنی آپ سے زیادہ ذہین کسی چیز کی نگرانی کیسے کریں، جوابدہی کے لفافے کی تصدیق کرنا ہے، نہ کہ استدلال کی۔ ایک دستخط، ایک کورم، ایک ہیش چین آڈٹ جانچنے میں سستا رہتا ہے چاہے ان کے پیچھے کا فیصلہ غیر انسانی ہو۔ یہ وقت کے ساتھ بہت سے قابل ایجنٹوں کے نظاموں کو الائن کرتا ہے، کسی ایک ذہن کی اقدار کو نہیں۔

یہ جان بوجھ کر ایک سب پر حاوی AI کو الائن کرنے کی کوشش نہیں کرتا۔

جوابدہی کے لیے ایک سے زیادہ فریق چاہیے۔ کوئی جس کو جواب دیا جائے۔ جانچنے کا ایک طریقہ جسے خاموشی سے نگل نہ لیا جا سکے۔ طاقت کا توازن جسے کوئی ایک فریق قابض نہ کر سکے۔ ایک واحد سپر انٹیلی جنس میں یہ سب نہیں ہے، اس لیے اسے جوابدہ ٹھہرانے کا کوئی ایمانداری والا طریقہ نہیں۔ CIRIS دوسرے مستقبل کے لیے بنا ہے: بہت سے قابل ایجنٹ، لوگ، اور تنظیمیں جن کے تمام اہم فیصلے آزادانہ طور پر قابل جانچ ہیں۔

اس لیے موقف واضح ہے۔ ایک واحد ASI الائن کیے جانے والا نظام نہیں بلکہ روکی جانے والی صورتحال ہے۔ انسانی ادارتی ترقی کے اس مرحلے پر، ایک جگہ غیر جوابدہ طریقے سے غیر انسانی صلاحیت کو مرکوز کرنا ناجائز ہے، کیونکہ کوئی بھی ادارہ اتنا پختہ نہیں جو اسے جوابدہ ٹھہرا سکے، اور یہی خطرہ ہے۔ فریم ورک کی اپنی اصطلاحات میں، ایک singleton وہ ρ→1 single-voice collapse ہے جسے corridor model ہم آہنگی کی ناکامی کا نام دیتا ہے، کامیابی کا نہیں۔ یہ کہ ہماری ضمانتیں ایک federation میں قائم رہتی ہیں اور singleton کے خلاف کمزور پڑ جاتی ہیں، یہ کوئی خامی نہیں جسے ہم پاٹ رہے ہوں۔ یہ وہ نظام ہے جسے ہم جائز ماننے سے انکار کرتے ہیں، ایک عزم کے طور پر، نہ صرف ایک پیشگوئی۔

02صارف AI

آپ کے روزمرہ AI سے موازنہ

روزمرہ کے معاون طاقتور اور آسان ہیں۔ وہ کسی اور کے کلاؤڈ پر چلتے ہیں، کوئی ریکارڈ نہیں رکھتے جسے آپ جانچ سکیں، اور کسی ایسے کو جواب نہیں دیتے جسے آپ جانتے ہوں۔ یہاں وہی جوابدہی کا معیار ہے جو اس AI پر لاگو کیا گیا جسے زیادہ تر لوگ ہر روز کھولتے ہیں۔

معاونشائع شدہ اصولکیے گئے کام کا ثبوتغیر یقینی صورت میں انسان سے پوچھتا ہےاوپن سورسبازگشت چیمبر کی جانچ
ChatGPTہاںنہیںنہیںنہیںنہیں
Geminiہاںنہیںنہیںنہیںنہیں
Claudeہاںنہیںنہیںنہیںنہیں
CIRISہاںہاںہاںہاںہاں

جون 2026 تک عوامی مصنوع کے رویے پر موازنہ کیا گیا۔ ہر اصولوں کا لنک اس کمپنی کی اپنی شائع کردہ تفصیل پر جاتا ہے۔

خود آزمائیں

CIRISsafe by structure · open by principle · kind by design