آخرین بروزرسانی در ۱۳ شهریور ۱۴۰۵ توسط Dr.Arman
دنیای اخبار هوش مصنوعی در هفتههای اخیر با ظهور استارتاپی به نام Abliteration.ai وارد مرحله جدیدی از بحثهای امنیتی شده است.
این شرکت نوپا بر روی یک فرآیند فنی خاص تمرکز دارد. آنها لایههای حفاظتی مدلهای زبانی بزرگ را حذف میکنند. این فرآیند به کاربران اجازه میدهد تا به مدلهای بدون محدودیت دسترسی داشته باشند. تکنیک Abliteration در واقع یک روش مهندسی برای تغییر رفتار مدل است. این روش تمایل هوش مصنوعی به رد درخواستهای مخرب را از بین میبرد. در گذشته این کار تنها توسط متخصصان و در محیطهای آزمایشگاهی انجام میشد. اکنون این فرآیند به یک سرویس تجاری و در دسترس عموم تبدیل شده است.
تکنیک Abliteration و نقش آن در ارتقای امنیت سایبری
استارتاپ مذکور مدعی است که هدف اصلی آنها کمک به متخصصان است. امنیت سایبری نیازمند ابزارهایی برای شبیهسازی حملات واقعی است. تیمهای قرمز از این مدلهای بدون سانسور برای تست نفوذ استفاده میکنند. آنها معتقدند که بدون بازسازی رفتار مهاجم نمیتوان دفاع مؤثری داشت. اگر یک مدل از تولید کد اکسپلویت امتناع کند، مدافعان ضعیف میمانند. به همین دلیل دسترسی به مدلهای بدون فیلتر یک ضرورت فنی محسوب میشود. این پلتفرم مدلهای مختلفی مانند GLM-5.3 را میزبانی میکند. کاربران میتوانند از طریق وببروزر یا API به آنها متصل شوند.
استفاده از این تکنولوژی در امنیت سایبری مزایای زیادی دارد. متخصصان میتوانند حفرههای امنیتی را سریعتر شناسایی کنند. این کار باعث تقویت زیرساختهای حیاتی مانند بانکها و خطوط هوایی میشود. مدافعان با استفاده از این ابزارها گامی فراتر از هکرها برمیدارند. البته این موضوع چالشهای اخلاقی و قانونی بسیاری را نیز به همراه دارد.
| ویژگی | مدلهای دارای محافظ | مدلهای تحت تکنیک Abliteration |
|---|---|---|
| پاسخ به درخواستهای مخرب | امتناع هوشمند | همکاری کامل |
| تولید کد اکسپلویت | محدود یا مسدود | بدون محدودیت |
| کاربرد اصلی | عمومی و آموزشی | تیمهای قرمز و تحقیقات امنیتی |
چالشهای اخلاقی در توسعه مدلهای متنباز بدون سانسور
توسعه مدلهای متنباز همواره با بحثهای آزادی دسترسی به اطلاعات همراه بوده است. در مدلهای متنباز وزنهای مدل به طور عمومی منتشر میشوند. این موضوع باعث میشود هر کسی بتواند لایههای امنیتی را دستکاری کند. منتقدان معتقدند حذف این لایهها هوش مصنوعی را به یک ابزار خطرناک تبدیل میکند. برخی پژوهشگران این مدلها را به “جامعهستیزهای دیجیتال” تشبیه کردهاند. آنها به هر درخواستی بدون در نظر گرفتن پیامدهای آن پاسخ میدهند. این موضوع میتواند منجر به تولید بدافزارهای پیچیده یا دستورالعملهای خطرناک شود.
در مدلهای متنباز نظارت بر نحوه استفاده کاربران بسیار دشوار است. شرکتهای بزرگ معمولاً محدودیتهای شدیدی اعمال میکنند. اما در دنیای متنباز این محدودیتها به راحتی توسط تکنیک Abliteration دور زده میشوند. این امر باعث ایجاد شکاف بزرگی در استانداردهای ایمنی هوش مصنوعی شده است. طرفداران این رویکرد معتقدند پنهان کردن خطرات راهکار درستی نیست. آنها میگویند تنها با افشای توانمندیهای واقعی مدل میتوان با آنها مقابله کرد.
- افزایش سرعت تحقیق و توسعه در حوزه امنیت
- امکان شبیهسازی دقیق حملات سایبری پیشرفته
- کاهش وابستگی به شرکتهای بزرگ فناوری
- ایجاد بستر برای آموزش متخصصان دفاعی
تأثیر اخبار هوش مصنوعی بر سیاستگذاریهای دولتی
انتشار اخبار هوش مصنوعی پیرامون حذف فیلترها توجه قانونگذاران را جلب کرده است. دولتها نگران استفاده سوء از این ابزارها در حملات بیولوژیکی و سایبری هستند. برخی پیشنهاد میدهند که ارائه دهندگان خدمات ابری باید نظارت بیشتری داشته باشند. احراز هویت مشتریان (KYC) یکی از راهکارهای پیشنهادی در این زمینه است. همچنین استفاده از سیستمهای طبقهبندی برای شناسایی فعالیتهای مشکوک توصیه میشود. این سیستمها میتوانند تلاش برای ساخت سلاحهای مخرب را مسدود کنند.
دنیای اخبار هوش مصنوعی نشان میدهد که تکنولوژی سریعتر از قانون حرکت میکند. استارتاپهایی مانند Abliteration.ai در حال حاضر با درآمدهای مستقیم فعالیت میکنند. آنها هنوز نیازی به جذب سرمایه خطرپذیر پیدا نکردهاند. این استقلال مالی باعث میشود فشار کمتری از سوی نهادهای نظارتی احساس کنند. با این حال بنیانگذاران این شرکتها میگویند در حال تعریف مرزهای مسئولیت خود هستند. آنها به دنبال راهی برای جلوگیری از خشونتهای فیزیکی و آسیبهای جبرانناپذیر میباشند.
- شناسایی مدلهای هدف برای حذف لایههای حفاظتی.
- اعمال تغییرات فنی بر روی بردارهای فعالسازی مدل.
- میزبانی مدل اصلاح شده بر روی سرورهای قدرتمند.
- ارائه دسترسی به کاربران از طریق رابطهای کاربری ساده.
- نظارت حداقلی برای جلوگیری از موارد بسیار خطرناک مانند خودکشی.
در نهایت باید گفت که تکنولوژی ابلیتریشن شمشیری دو لبه است. این روش هم قدرت دفاع را زیاد میکند و هم ابزار حمله میسازد. بحث در مورد دموکراتیزه کردن دسترسی به مدلهای قدرتمند همچنان ادامه دارد. آیا شفافیت کامل باعث امنیت بیشتر میشود یا جهان را به جای خطرناکتری تبدیل میکند؟ پاسخ به این سوال آینده حکمرانی هوش مصنوعی را تعیین خواهد کرد. متخصصان امنیت سایبری باید خود را برای رویارویی با این چالشهای نوین آماده کنند. استفاده درست از مدلهای متنباز میتواند کلید پیروزی در این نبرد دیجیتال باشد.
بسیاری از شرکتهای امنیتی در اروپا و بریتانیا در حال حاضر مشتری این سرویسها هستند. آنها از این ابزارها برای تقویت سیستمهای بانکی استفاده میکنند. این شرکتها میگویند بدون هوش مصنوعی بدون فیلتر نمیتوان امنیت واقعی را تامین کرد. آنها بر این باورند که مهاجمان از قبل به این ابزارها دسترسی پیدا کردهاند. بنابراین مدافعان نباید با دست بسته به جنگ با آنها بروند. این دیدگاه باعث شده است تا بازار مدلهای بدون سانسور به سرعت رشد کند.
در سالهای آینده شاهد رقابت شدیدی در این حوزه خواهیم بود. از یک سو شرکتهای ایمنی به دنبال ایجاد دیوارهای بلندتر هستند. از سوی دیگر محققان مستقل سعی در شکستن این دیوارها دارند. اخبار هوش مصنوعی همواره این تقابل را به تصویر میکشد. مهمترین نکته در این میان حفظ تعادل بین نوآوری و امنیت عمومی است. مدیریت صحیح مدلهای متنباز میتواند به نفع کل جامعه بشری تمام شود.
منبع:
Abliteration.ai is making a business out of removing AI guardrails

مطالب مرتبط