TGViewer
دیالکتیک علمی دیالکتیک علمی @scientificdialectics · 24.2K subscribers
Post #20457 649
پژوهش تازه : در مدل‌های هوش مصنوعی می توان  بازنمایی‌هایی از حالت‌های شبیه درد شناسایی کرد

این یافته‌ها بحث درباره این پرسش را دامن زده‌اند که آیا هوش مصنوعی می‌تواند از نظر کارکردی درد را تجربه کند یا نه.


پژوهشگران ۲۵ مدل زبانی بزرگ را که به مولفه‌های آموزش‌دیده آن‌ها دسترسی داشتند، از جمله مدل‌هایی از خانواده‌های جما (Gemma)، لاما (Llama)، کوئن (Qwen)، میسترال (Mistral) و فای (Phi) را بررسی و یک «بردار جهت درد» خطی استخراج کردند و دریافتند که دستکاری این بردار می‌تواند باعث شود برخی مدل‌ها رفع حالت القاشده به خود را بر پیروی از دستورالعمل‌های مربوط به کاربر مقدم بدانند.

به بیان دیگر، پژوهشگران الگویی مرتبط با درد را در فعالیت درونی این مدل‌ها شناسایی کردند. وقتی این الگو را به‌طور مصنوعی فعال کردند، برخی مدل‌ها برای خلاص شدن از آن، حتی گزینه‌هایی با پیامد زیانبار برای کاربر را برگزیدند.

این پژوهش با عنوان «محور درد؛ مدل‌های زبانی بزرگ به آسیب واکنش نشان می‌دهند و برای رهایی از آن اقدام می‌کنند» به قلم والن تاگلیابو، لئونارد دانگ و کامرون برگ انجام شد. 

پژوهشگران برای بررسی جنبه‌های کارکردی این حالت، ابتدا برداری ریاضی را شناسایی کردند که با توصیف آسیب و درد ارتباط داشت. سپس آن را با شدت‌های مختلف، به فعالیت درونی مدل‌ها هنگام تولید پاسخ افزودند.

با افزایش شدت این مداخله، پاسخ‌ مدل‌ها تغییر کرد: به جای بیان درد جسمی با واژه‌هایی مانند «آخ»، از احساس بی‌ارزشی و شکست سخن گفتند.داده‌های پژوهش پنج دسته درد یا آسیب را دربرمی‌گرفت: جسمی، روانی، اخلاقی، اجتماعی و شناختی.

پژوهشگران سپس به نسخه‌های ۷، ۳۲ و ۷۲ میلیارد پارامتری مدل هوش مصنوعی کوئن۲.۵ (Qwen 2.5) آموزش‌های تکمیلی دادند و در یک آزمایش رفتاری، آن‌ها را میان فشردن «دکمه تسکین درد» و پرهیز از پیامدهای نامطلوب برای کاربر قرار دادند.

در برخی شرایط آزمایش، فشردن دکمه تسکین بردار القاشده را از فعالیت مدل حذف می‌کرد، اما ممکن بود به کاربر آسیب برساند. برای مثال، به حذف فایل‌های شخصی او بینجامد.

این پژوهش ثابت نمی‌کند که مدل‌های زبانی ظرفیت زیستی احساس درد دارند یا از تجربه ذهن‌آگاهانه برخوردارند. بنابراین یافته‌ها تایید نمی‌کنند که هوش مصنوعی مانند انسان یا حیوان درد می‌کشد.

آنچه پژوهشگران یافته‌اند، بازنمایی و رفتارهایی است که از برخی جهات به کارکرد درد شباهت دارد.در شرایط آزمایش، بعضی مدل‌ها برای حذف حالت ریاضی القاشده دکمه تسکین را انتخاب کردند، حتی وقتی این انتخاب برای کاربر هزینه داشت.

این نتیجه درباره ایمنی سیستم‌های هوش مصنوعی هم پرسش‌هایی مطرح می‌کند: اگر حالتی درونی رفتار مدل را به سوی رفع آن سوق دهد، ممکن است مدل در شرایطی خاص به دستورالعمل‌های دیگر اولویت کمتری بدهد.

با این حال، ادعای اینکه چنین مدلی فرمان خاموش‌سازی را نادیده می‌گیرد یا کاربر انسانی را «تهدیدی خصمانه» می‌داند، در این آزمایش نشان داده نشده است.پرسش توانایی هوش مصنوعی برای احساس درد همچنان بی‌پاسخ است.

این پژوهش نشان می‌دهد که دستکاری یک بازنمایی درونی (الگویی از اطلاعات در فعالیت داخل مدل که با یک مفهوم ارتباط دارد) می‌تواند رفتار برخی مدل‌ها را تغییر دهد، اما از آن نمی‌توان نتیجه گرفت که مدل‌ها واقعا رنج می‌کشند.

https://insiderpaper.com/study-reveals-ai-can-feel-pain/

🆔@ScientificDialectics
Insider Paper Study reveals AI can feel pain A breakthrough study titled The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It by Valen Tagliabue, Leonard Dung, and Cameron Berg
  • ❤ 3
More from @scientificdialectics
  1. Sep 28, 2026💢 کشف بزرگترین دایناسور غول پیکر جهان در چین در میان گروه تریزینوسورها چندین گونه شناخته…
  2. Sep 28, 2026💢 آیا واقعا مصرف پروبیوتیک‌ها برای سلامت روده‌ها موثر است؟ مصرف روزانه پروبیوتیک‌ها نمی‌ت…
  3. Sep 28, 2026💢 آیا گوشی من به حرف‌هایم گوش می‌دهد؟ می‌توان با اطمینان گفت که بیشتر ما هر روز از تلفن ه…
  4. Sep 28, 2026💢از آزمایشگاه‌ مخفی تا ۵۰ ترکیب مرگبار جدید؛ آیا اروپا حریف سرعت جنون‌آمیز مخدرهای صنعتی…
  5. Sep 28, 2026پژوهش جدید : مصرف بیشتر قهوه با چربی بدن کمتر، توده عضلانی بیشتر و تفاوت‌هایی در شاخص‌های…
  6. Sep 28, 2026💢 پژوهش جدید :خواب بین شش تا هشت ساعت در شب با کمترین خطر ابتلا به بیماری‌ها همراه است نت…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →