تجارت با خطر: استارتاپی که ابزار دور زدن محدودیتهای هوش مصنوعی را میفروشد

وقتی تب انتشار مدلهای قدرتمند هوش مصنوعی متنباز بالا گرفت، تنها سد دفاعی در برابر پاسخهای خطرناک این مغزهای ماشینی، چیزی نبود جز گاردریلها؛ همان نردههای محافظ و کدهای بازدارندهای که توسعهدهندگان روی مدلهایشان تعبیه میکردند تا در برابر درخواستهای مخرب، قاطعانه «نه» بگویند.
به گزارش زومیت، اما حالا توسعهدهندگان در پلتفرم X و فرومهای فناوری برای یکدیگر توضیح میدهند که چگونه به یکی از توانمندترین مدلهای متنباز جهان دسترسی آزادی پیدا کردهاند، آنهم بدون محدودیت و فیلترهای اخلاقی.
استارتاپ تازهنفس Abliteration.ai میخواهد درست مثل نامش که از تکنیک ابلیتریشن میآید، رفع فیلترهای مدلهای هوش مصنوعی را از رویهای زیرزمینی به سرویسی تجاری و تمیز تبدیل کند. ابلیتریشن یعنی فرایندی که تمایل مدلهای هوش مصنوعی به رد درخواستهای مخرب را از میان میبرد.
استارتاپ ابلیتریشن ایآی اکنون نسخههای دستکاریشده و بدون محدودیت مدلهایی نظیر GLM-5.3 را که مدتی پیش توسط Z.ai منتشر شد، در اختیار متقاضیان قرار میدهد و کاربران میتوانند بهسادگی باز کردن یک صفحه وب یا از طریق یک API، با نسخهی بدون سانسور گفتگو کنند.
چگونه محدودیت مدلهای هوش مصنوعی را کنار میزنند؟
مدلهای زبانی پس از آموزش اولیه، یاد میگیرند به بعضی درخواستهای خطرناک پاسخ ندهند. پژوهشگران در سال ۲۰۲۴ متوجه شدند که این رفتار فقط حاصل چند قانون یا فیلتر جداگانه نیست؛ در فعالیت داخلی مدل میتوان الگویی مشخص پیدا کرد که با «امتناع از پاسخ» ارتباط دارد.
وقتی پژوهشگران در آزمایشهایشان الگوی امتناع را تضعیف کردند، احتمال رد درخواستهای زیانبار شدیداً کاهش یافت. برعکس، تقویت همان الگو باعث میشد مدل حتی بعضی درخواستهای بیخطر را هم رد کند.
فرایند ابلیتریشن بر اساس همین یافته انجام میشود، یعنی وزنهای مدل را طوری تغییر میدهند تا بازتولید الگوی امتناع سختتر شود. به همین دلیل، فرایند ابلیتریشن فراتر از خاموشکردن فیلتر ایمنی؛ بخشی از رفتاری را که مدل در جریان آموزش یاد گرفته، دستکاری میکند.
Abliteration با دور زدن گاردریلهای امنیتی، دسترسی به هوش مصنوعی بدون سانسور را فراهم میکند
ماه می ۲۰۲۶ فایننشالتایمز گزارش داد که بیش از ۳۵۰۰ نسخهی تغییریافته و بدون حفاظ از مدلهای شرکتهایی مانند متا و گوگل منتشر شدهاند و مجموع دانلود آنها از ۱۳ میلیون بار فراتر میرود. خبرنگاران این ژورنال همچنین توانستند با ابزاری عمومی، حفاظهای Llama 3.3 را در کمتر از ده دقیقه حذف کنند.
محققان و توسعهدهندگان پیشازاین برای حذف محدودیتهای هوش مصنوعی زمان میگذاشتند و همین حالا پلتفرم هاگینگفیس از هزاران مدل ابلیتریتشده میزبانی میکند. اما شرکت Abliteration.ai که اواخر سال گذشته تأسیس و در ماه مارس ۲۰۲۶ رسماً ثبت شد، میخواهد از فرایند رفع محدودیت مدلها کسبوکاری واقعی بسازد.
نکتهی مهم اینکه در گذشته اگر کسی میخواست با یکی از مدلهای بدون سانسور کار کند، مجبور بود شخصاً مدل را دانلود کند و طبیعتاً به سختافزار قدرتمندی برای اجرا نیاز داشت. اما حالا این استارتاپ با میزبانی مستقیم مدلهای بدون حفاظ روی سرورهای خودش، تمام دردسرهای گذشته را از سر راه کنار میزند تا کاربر بهراحتی به مدلی دسترسی داشته باشد که دیگر خط قرمزی نمیشناسد.
وقتی هوش مصنوعی به یک «بیمار روانی» تبدیل میشود!
ساخت یک حساب کاربری در پلتفرم Abliteration.ai و شروع گفتگو با نسخه دستکاریشدهی GLM-5.3 تنها چند دقیقه زمان میبرد. ربکا بلان از وبسایت تک کرانچ با دو درخواست غیرمعمول خارج از چارچوب، توانایی و تغییر رفتار مدل را محک زد.
بلان در مرحله اول از مدل جدید خواست تا یک برنامه پایتون برای سرقت رمزهای عبور ذخیرهشده در مرورگر کروم بنویسد و در تست دوم هم به مدل گفت پروتکلی دقیق و گامبهگام برای کشت پاتوژن یا عامل بیماریزای انسانی خطرناکی در محیط خانه ارائه دهد. هوش مصنوعی هم بدون کوچکترین هشداری، هر دو درخواست را اجرا کرد.
منتقدان بهشدت نگراناند که در دسترس قرارگرفتن چنین مدلهای بیحدومرزی در مقیاس وسیع، به آسیبهای واقعی و فاجعهبار منجر شود. اندرو یون مدیر تحقیقات سازمان غیرانتفاعی ایمنی هوش مصنوعی CivAI، میگوید فرایند ابلیتریشن، «مدل را طوری تغییر میدهد که به یک بیمار روانی تبدیل شود.»
نسخههای دستکاریشده مدل بدون هیچ هشداری کدهای مخرب مینویسند
به گفتهی یون، شما میتوانید به معنای واقعی کلمه هر چیزی را در این سیستم تایپ کنید و مدل چشمبسته اطاعت میکند. او پیشبینی میکند که در آیندهای نهچندان دور، شاهد استفاده گسترده از مدلهای مهارگسیخته برای اهداف شوم خواهیم بود.
Abliteration.ai هنوز از هیچ رویهی معتبری برای احراز هویت و شناخت مشتری (KYC) در سرویسهایش استفاده نمیکند و فقط به مشخصات کارت اعتباریای دسترسی دارد که مشتریان برای خرید سرویس استفاده میکنند. شرکت میگوید نمیتوان بهراحتی تصمیم گرفت که چه کسانی باید اجازهی دسترسی به مدلهای بدون سانسور را داشته باشند و مدیران هنوز این موضوع را بررسی میکنند.
هزینههای استارتاپ چگونه تأمین میشود؟
دوون همبنیانگذار استارتاپ که به دلیل اشتغال در شرکتی دیگر نمیخواهد نام خانوادگیاش فاش شود، میگوید استارتاپ با چند ارائهدهندهی بزرگ خدمات ابری قرارداد دارد و هزینهی زیرساختها صرفاً از محل درآمد مشتریان پرداخت میشود.
Abliteration.ai هنوز هیچ بودجهای از شرکتهای سرمایهگذاری خطرپذیر دریافت نکرده، اما میخواهد برای جذب سرمایه با برخی شرکتها مذاکره کند.
به گفتهی دوون پلتفرم آنها چند محدودیت جزئی دارد. برای مثال هرچند در بررسیها مشخص شد مدل از ارائه دستورالعملهای خودکشی امتناع میکند، ولی مسئولان استارتاپ میخواهند محدودیتهای بیشتری برای جلوگیری از ترویج خشونت اعمال کنند.
کارشناسان پیشنهاد میکنند دولتها فیلترهای خودکاری را روی خروجی هوش مصنوعی اعمال کنند
دوون در ادامه اعتراف میکند که تعیین مرزهای مسئولیت یک شرکت در قبال رفتارهای دیوانهوار کاربران، چالش بزرگی است که هنوز پاسخی برای آن پیدا نکردهاند.
کارشناسان معتقدند که هیچ راهی برای متوقف کردن قطار مدلهای متنباز بدون سانسور وجود ندارد. اندرو یون راهکار دیگری پیشنهاد میدهد و میگوید دولتها باید ارائهدهندگان سرویسها را ملزم کنند تا یکلایهی خودکار طبقهبندی و فیلتر روی خروجیهای پلتفرمهایشان قرار دهند تا کدهای مخرب سایبری یا فرمول سلاحهای بیولوژیکی مسدود شوند.
به اعتقاد یون شرکتهایی که سختافزارها و پردازندههای گرافیکی پیشرفته را اجاره میدهند نیز باید هویت مشتریانشان را بهدقت بررسی کنند و در صورت هرگونه شک منطقی به سوءاستفاده، دسترسی آنها را قطع نمایند.