இரண்டு வழிகள்
எடையை நம்புவதா, நடவடிக்கையை சரிபார்ப்பதா
AI பாதுகாப்பின் முதன்மை நீரோட்டம் மாடலை உள்ளிருந்து நல்லதாக மாற்ற முயற்சிக்கிறது: அதன் மதிப்புகளை பயிற்றுவித்து, அதன் எண்ணங்களை ஆய்வு செய்து, அது தன்னுடன் விவாதிக்கவைத்து. அந்த வேலை முக்கியமானது. CIRIS மற்ற வழியில் பந்தயம் கட்டுகிறது. ஒரு திறமையான மாடல் தவறாக சீரமைக்கப்பட்டிருக்கலாம் என்று கருதி, அதன் மனதை நம்புவதற்கு பதிலாக, அதன் முக்கியமான செயல்களை மக்கள் மற்றும் சரிபார்க்கக்கூடிய பிற அமைப்புகளுக்கு பொறுப்பாக்குகிறது.
துறையின் சொந்த வார்த்தைகளில், CIRIS நிறுவன மற்றும் கட்டுப்பாட்டு கிளையில் உள்ளது, AI கட்டுப்பாடு மற்றும் உத்தரவாதப்பட்ட பாதுகாப்பான AI-உடன் சேர்ந்து, RLHF, Constitutional AI, விவாதம் மற்றும் விளக்கத்தன்மையின் மதிப்பு-உள்வாங்கல் முதன்மை நீரோட்டத்தில் அல்ல. அளவிடக்கூடிய கண்காணிப்பிற்கு, அதாவது உங்களை விட புத்திசாலியான ஒன்றை எவ்வாறு மேற்பார்வையிடுவது என்பதற்கு, அதன் பதில் சிந்தனையை அல்ல, பொறுப்புக்கூறல் கவரை சரிபார்ப்பதாகும். ஒரு கையொப்பம், ஒரு கோரம், ஒரு ஹாஷ்-சங்கிலி தணிக்கை, அவற்றுக்கு பின்னால் உள்ள முடிவு மனித திறனுக்கு அப்பாற்பட்டதாக இருந்தாலும் சரிபார்க்க மலிவாகவே இருக்கும். இது காலப்போக்கில் பல திறமையான முகவர்களின் அமைப்புகளை சீரமைக்கிறது, எந்த ஒரு மனதின் மதிப்புகளையும் அல்ல.
நாம் கடைப்பிடிக்கும் கோடு
இது ஒரு எல்லா-சக்தி வாய்ந்த AI-ஐ சீரமைக்க முயற்சிக்கவில்லை. வேண்டுமென்றே.
பொறுப்புக்கூறலுக்கு ஒன்றுக்கு மேற்பட்ட தரப்பு தேவை. பதில் சொல்ல ஒருவர். அமைதியாக விழுங்கப்பட முடியாத சரிபார்ப்பு வழி. எந்த ஒரு தரப்பாலும் கைப்பற்ற முடியாத சக்தி சமநிலை. ஒரே ஒரு சூப்பர்-இன்டெலிஜென்ஸிடம் இவை எதுவும் இல்லை, எனவே அதை பொறுப்பாக்க நேர்மையான வழி இல்லை. CIRIS மற்ற எதிர்காலத்திற்காக உருவாக்கப்பட்டுள்ளது: பல திறமையான முகவர்கள், மக்கள் மற்றும் நிறுவனங்கள், அவர்களின் முக்கியமான முடிவுகள் அனைத்தும் சுயாதீனமாக சரிபார்க்கக்கூடியவை.
எனவே நிலைப்பாடு தெளிவாக உள்ளது. ஒற்றை ASI என்பது சீரமைக்கப்பட வேண்டிய ஒரு அமைப்பு அல்ல, தடுக்கப்பட வேண்டிய ஒரு நிலை. மனித நிறுவன வளர்ச்சியின் இந்த கட்டத்தில் ஒரே ஒரு பொறுப்பற்ற இடத்தில் மனித திறனுக்கு அப்பாற்பட்ட திறனை குவிப்பது நியாயமற்றது, ஏனென்றால் எந்த நிறுவனமும் அதை பொறுப்பாக்கும் அளவுக்கு முதிர்ச்சியடையவில்லை, இதுவே சரியான அபாயம். கட்டமைப்பின் சொந்த வார்த்தைகளில் ஒற்றை என்பது ρ→1 ஒற்றை-குரல் சரிவு, இதை வழிகோல் மாதிரி ஒரு ஒருங்கிணைப்பு தோல்வியாக பெயரிடுகிறது, வெற்றியாக அல்ல. நமது உத்தரவாதங்கள் ஒரு கூட்டமைப்பில் நிலையாக இருந்து ஒற்றைக்கு எதிராக அரிக்கப்படுவது நாம் சரிசெய்யும் இடைவெளி அல்ல. இது நாம் நியாயப்படுத்த மறுக்கும் ஆட்சி, ஒரு உறுதிப்பாடாக வைக்கப்பட்டது, வெறும் கணிப்பாக மட்டும் அல்ல.
நீங்கள் உண்மையில் பயன்படுத்தும் AI உடன் ஒப்பீடு
அன்றாட உதவியாளர்கள் சக்திவாய்ந்தவர்கள், பயன்படுத்த எளிதானவர்கள். ஆனால் அவை வேறு யாரோ ஒருவரின் கணினியில் இயங்குகின்றன, நீங்கள் சரிபார்க்கக்கூடிய எந்தப் பதிவையும் வைத்திருக்கவில்லை, யாரிடமும் பொறுப்பு சொல்வதில்லை. இங்கே அதே பொறுப்புணர்வு சோதனை, பெரும்பாலான மக்கள் தினமும் திறக்கும் AI க்கு பயன்படுத்தப்படுகிறது.
| உதவியாளர் | வெளியிடப்பட்ட கொள்கைகள் | செய்ததற்கான சான்று | தெரியாதபோது மனிதரிடம் கேட்கும் | திறந்த மூலக் குறியீடு | எதிரொலி அறை சோதனை |
|---|---|---|---|---|---|
| ChatGPT | ஆம் | இல்லை | இல்லை | இல்லை | இல்லை |
| Gemini | ஆம் | இல்லை | இல்லை | இல்லை | இல்லை |
| Claude | ஆம் | இல்லை | இல்லை | இல்லை | இல்லை |
| CIRIS | ஆம் | ஆம் | ஆம் | ஆம் | ஆம் |
ஜூன் 2026 நிலவரப்படி பொது தயாரிப்பு நடத்தையின் அடிப்படையில் ஒப்பிடப்பட்டது. ஒவ்வொரு கொள்கை இணைப்பும் அந்த நிறுவனத்தின் சொந்த வெளியிடப்பட்ட விவரக்குறிப்பிற்கு செல்கிறது.
நீங்களே முயற்சிக்கவும்
அது சிந்திப்பதை பாருங்கள்
ஒரு உண்மையான முகவரின் சிந்தனையை படிப்படியாக பாருங்கள். ஒரு தடத்தை ஆராயுங்கள் →
அதன் அடையாளத்தை சரிபார்க்கவும்
முகவர்கள் யார் என்று எப்படி நிரூபிக்கிறார்கள் என்று பாருங்கள், AI-க்கான DMV போல. நம்பிக்கை மற்றும் அடையாளம் →
தொடங்கவும்
உங்கள் முதல் முகவரை பயன்படுத்தவும் அல்லது எளிய ஆங்கிலத்தில் ஆய்வரணை படியுங்கள். முதல் தொடர்பு →