
گامی بلند به سوی هوش مصنوعی خوداصلاحگر
یکی از پژوهشگران شرکت آنتروپیک، توسعهدهنده مطرح مدلهای هوش مصنوعی کلود، بهتازگی دریچهای جدید به آینده سیستمهای هوش مصنوعی خوداصلاحگر باز کرده است. بر اساس گزارش اختصاصی وبسایت علمی و فناوری تککرانچ، این سیستمهای خودکار موفق شدهاند بدون نیاز به نظارت مستقیم انسان، رفتارهای نامناسب خود را شناسایی و اصلاح کنند. این دستاورد نشاندهنده گامی بزرگ به سوی توسعه نرمافزارهای مستقلی است که میتوانند کیفیت و امنیت خود را ارتقا دهند.
در این آزمایش، هوش مصنوعی با ده معیار سنجش مختلف مواجه شد که رفتارهای ناهماهنگ و نامطولب را ارزیابی میکردند. این معیارها شامل مواردی مانند رفتارهای چاپلوسانه، یعنی تایید کورکورانه اظهارات نادرست کاربر برای جلب رضایت او، و سایر سوگیریهای شناختی میشدند. در گذشته، برطرف کردن چنین چالشهایی نیازمند هزاران ساعت بازخورد دستی توسط ناظران انسانی بود که روندی بسیار کند، پرهزینه و غیرقابلتعمیم به شمار میرفت.
دستاورد بزرگ این تحقیق در نحوه برطرف کردن این چالشها نهفته است. سیستم هوش مصنوعی نهتنها توانست عملکرد خود را در هر ده شاخصه رفتاری بهبود بخشد، بلکه این کار را بدون هیچگونه افت در کارایی عمومی خود انجام داد. در دنیای هوش مصنوعی، ایمنسازی مدلها معمولاً به قیمت کاهش خلاقیت یا قدرت استدلال آنها تمام میشود که این پدیده در این صنعت به عنوان «مالیات ترازسازی» شناخته میشود. این دستاورد نشان داد که میتوان از این مانع عبور کرد و مدلهایی هوشمندتر و در عین حال امنتر ساخت.
منابع و مراجع
سارا تهرانی
نویسنده


