وبلاگ
یادداشتهایی دربارهٔ استنتاج بدون سانسور — ردتیمینگ، بنچمارکهای امتناع و اجرای API در محیط پروداکشن.
-
مدل abliterated چیست؟
Abliteration جهت امتناع را در جریان باقیماندهٔ مدل پیدا میکند و آن را از وزنها بیرون میکشد — بدون بازآموزی، بدون ترفند پرامپت.
-
یک API مدل زبانی بدون سانسور برای ردتیمینگ و پژوهش امنیتی
وقتی مدل مهاجمتان امتناع میکند، دارید احتیاط آن را میسنجید نه استحکام هدف را. چرا پایپلاینهای امنیتی به یک اندپوینت بدون فیلتر نیاز دارند.
-
یک API سازگار با OpenAI برای جایگزینی مستقیم — مهاجرت در دو خط
با تغییر base_url و کلید، SDK فعلی OpenAI را به unbleep وصل کنید. استریمینگ، سطحهای مدل، reasoning_content و نکتههایی که واقعاً دردسر میسازند.