گزارش ایمنی هوش مصنوعی هشدار می دهد که صنعت از نظر ساختاری برای خطرات رو به رشد آماده نیست
یک ارزیابی مستقل جدید از شیوههای ایمنی هوش مصنوعی در میان بزرگترین بازیگران صنعت، نگرانیهایی را در مورد اینکه شرکتها با پیشرفت سریع مدلهایشان چقدر عقب هستند، افزایش میدهد.
شاخص ایمنی هوش مصنوعی زمستان ۲۰۲۵ که چهارشنبه توسط مؤسسه Future of Life منتشر شد، پروتکلهای ایمنی هشت توسعهدهنده اصلی هوش مصنوعی، از جمله خالقان ChatGPT، Gemini و Claude را ارزیابی کرد و به این نتیجه رسید که بسیاری از شرکتها “فقدان پادمانهای ملموس، نظارت مستقل و سیستمهای مدیریت ریسک قوی بلندمدت نیاز دارند.”
این تحلیل دهها شاخص را در شش حوزه مورد بررسی قرار میدهد که همه چیز از ارزیابی ریسک شرکت و شفافیت مدل گرفته تا حفاظت از افشاگران و برنامهریزی ریسک وجودی را پوشش میدهد. او برنامه ریزی ریسک وجودی را به طور خاص به عنوان یک شکاف رو به رشد برجسته می کند زیرا “برنامه ریزی فعال … به یک ضرورت مبرم تبدیل شده است.”
هیئت کارشناسی بر اساس عملکرد ایمنی به هر شرکت نمره نامه داد. فقط دو شرکت نمره C مثبت دریافت کردند و هر کدام به سختی. آنتروپیک، بالاترین رتبه در لیست، نمره C+ و پایینترین شرکت Alibaba Cloud، D- را دریافت کرد.
سابینا نونگ، محقق ایمنی هوش مصنوعی برای موسسه آینده زندگی، در مصاحبه با اسکریپس نیوز گفت: «ما شروع به دیدن این شکاف بزرگ بین شرکتهایی کردیم که در صدر هستند، جایی که آنها کارهای بیشتری را به صورت شفاف عمومی انجام میدهند، در مقابل شرکتهایی که فکر میکنیم جای پیشرفت دارند. ما شاهد استفاده از بهترین شیوه های بیشتر توسط شرکت های دیگر بوده ایم.
محققان میگویند این شکاف نشاندهنده تفاوتهای عمیقتر در نحوه اولویتبندی ایمنی سازمانها است. برخی از شرکت ها شروع به اتخاذ اقدامات اساسی مانند واترمارک کردن تصاویر تولید شده توسط هوش مصنوعی یا انتشار نقشه های مدل کرده اند. اما برخی دیگر هنوز فاقد ساختارهای حاکمیتی روشن، ارزیابی مستقل یا سیاستهای حفاظت از کارکنان هستند که نگرانیهای ایمنی را افزایش میدهد.
مطلب مرتبط | هوش مصنوعی اکنون ارتباطات زندان را برای پیش بینی جنایات اسکن می کند
این گزارش هشدار میدهد که چارچوبهای ایمنی داوطلبانه با سرعتی که مدلهای جدید و توانمندتر عرضه میشوند، همگام نیستند. نونگ میگوید که این موضوع حتی نگرانکنندهتر است، زیرا پیشرفت ابرهوشی در آینده نزدیک است.
نونگ به اسکریپس نیوز گفت: «همه ما میدانیم که شرکتها هدف خود را برای رفتن به سوپرهوش، رفتن به AGI، جایی که برخی از مدیران عامل فناوری آن را گونهای جدید مینامند، تعیین کردهاند. “ما به طور بالقوه در حال ایجاد چیزی هستیم که قدرتمندتر از آن چیزی است که نیروی انسانی می تواند نظارت و کنترل کند. و من فکر می کنم با رویاهای این شرکت ها قطعاً مسئولیت های بیشتری به همراه خواهد داشت، جایی که ما دوست داریم شرکت ها برنامه های ملموس تری برای کنترل داشته باشند.”
بسیاری از شرکتها میگویند که در حال کار بر روی محافظهای قویتر در نسخههای جدیدتر مدلهای خود هستند و این گزارش تأیید میکند که بهبودهایی در حال ظهور است. اما نویسندگان هشدار می دهند که این تغییرات تدریجی هستند، در حالی که قابلیت های مدل به شدت افزایش می یابد.
این گزارش هشدار می دهد: «این شکاف بین ظرفیت و ایمنی، بخش را از نظر ساختاری برای خطراتی که فعالانه ایجاد می کند، آماده نمی کند.
ادامه مطلب | قانونگذاران به کارشناسان فناوری و بهداشت در مورد ایمنی هوش مصنوعی و حفظ حریم خصوصی داده ها فشار می آورند و امیدوارند مقررات آینده را شکل دهند.
برای پر کردن این شکاف، این شاخص توصیه میکند که شرکتهای هوش مصنوعی شفافیت را در مورد آزمایشهای داخلی و ارزیابیهای ریسک افزایش دهند، از ارزیابهای ایمنی شخص ثالث مستقل استفاده کنند، حفاظتها را برای محققان و افشاگران تقویت کنند، به خطرات نوظهور مانند “روانپریشی” هوش مصنوعی و توهمهای مضر رسیدگی کنند، تلاشهای لابیگری را که مانع مقررات ایمنی میشوند، کاهش دهند، و برنامههای مدیریت بحران بلندمدتتری را صادر کنند.
علاوه بر تمایل به شفافیت بیشتر، محققان «نیاز شدید» به مقررات را برجسته میکنند، زیرا مکانیسمهای اجرایی کند و ناسازگار باقی میمانند.
در حال حاضر، نویسندگان میگویند، کاربران باید به ابزارهایی تکیه کنند که بیش از هر زمان دیگری توانمندتر هستند، اما با پشتیبانی سیستمهای ایمنی که «ناقص، ناسازگار و توسعه نیافته» باقی میمانند.
