المدونة
ملاحظات حول الاستدلال غير الخاضع للرقابة — الفريق الأحمر، ومعايير قياس الرفض، وتشغيل الـ API في بيئة الإنتاج.
-
ما هو النموذج الـ abliterated؟
تحدد عملية الـ abliteration اتجاه الرفض في التيار المتبقي للنموذج وتُسقطه خارج الأوزان — دون إعادة تدريب ودون حيل في الموجّهات.
-
واجهة API لنموذج لغوي غير خاضع للرقابة للفريق الأحمر والبحث الأمني
حين يرفض نموذجك المهاجم، فأنت تقيس حذره لا متانة هدفك. لماذا تحتاج خطوط المعالجة الأمنية إلى نقطة نهاية غير مفلترة.
-
واجهة API متوافقة مع OpenAI كبديل مباشر — الترحيل في سطرين
وجّه OpenAI SDK الحالي لديك إلى unbleep بتغيير base_url والمفتاح. البث، وفئات النماذج، وحقل reasoning_content، والمزالق التي تُوقع بك فعلًا.