TGViewer
Linuxor ? Linuxor ? @linuxor · 31.7K subscribers
Post #5464 6.44K
یه نفر تونسته سانسور Qwen رو تقریبا برداره، توی AI یه تکنیکی داریم به اسم Abliteration که یعنی با دستکاری وزن‌های مدل، جهت‌هایی که باعث میشن مدل بعضی درخواست‌ها رو رد کنه یا اصطلاحاً refusal داشته باشه، تا حد زیادی حذف بشن. یعنی به‌جای اینکه فقط با System Prompt به مدل بگی «رد نکن»، خود مدل رو تغییر میدن.

حالا مدل Qwen3.5-9B-abliterated دقیقاً با همین روش ساخته شده؛ یه نسخه دستکاری‌شده از Qwen3.5-9B که هدفش اینه رفتارهای refusal رو تا حد زیادی کم کنه. سازنده با تحلیل activationهای مدل، جهت مرتبط با refusal رو پیدا کرده و بعد با Abliteration اون جهت رو از وزن‌های مدل حذف کرده.

بعد از این مرحله هم روی مدل QLoRA fine-tuning انجام شده تا مواردی که هنوز باعث refusal میشدن کمتر بشن. نتیجه یه مدل 9B هستش که برای استفاده‌های local جالبه، مخصوصاً اگه دنبال مدلی هستید که محدودیت‌های رفتاری کمتری نسبت به نسخه اصلی داشته باشه:

huggingface.co/lukey03/Qwen3.5-9B-abliterated


@Linuxor
More from @linuxor
  1. Sep 28, 2026دکمه‌ی Turbo روی کیس‌های قدیمی یکی از چیزهای جالب کامپیوترهای دهه‌های 1980 و 1990 بود. توی…
  2. Sep 28, 2026آموزش گام به گام اجرای مدل‌های Laya Decision رو به‌صورت لوکال و فقط با 4GB رم روی CPU، مک،…
  3. Sep 28, 2026تقریبا همه بازی های ساخته شده هوش مصنوعی که روی وب کار میکنن از Three.js استفاده میکنن اما…
  4. Sep 28, 2026این ویدیو هم جالب بود روی گوشی S26 مدل تصمیم گیر شبیه Jev به اسم Laya-LiteRT رو ران میکنه…
  5. Sep 28, 2026فروش Gemini Pro و Super Duolingo فقط 480 هزار تومن به مدت ۴۸ ساعت. 🛒 جهت ثبت سفارش: @AccA…
  6. Sep 28, 2026اگر سایت یا اپی دارید که داخلش دارید از چارت های مختلفی استفاده میکنید این دو تا سایت به د…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →