به نظرتون میشه مدلهای زبانی یا همون LLM روی Commodore 64 اجرا کرد؟! جواب این سوال مثبته و واقعاً یکی این کارو کرده!
تو دنیایی که هر روز یه مدل هوش مصنوعی جدید با کلی ادعا معرفی میشه و برای اجراشون به چند ده گیگ رم و پردازندههای گرافیکی عجیبغریب نیازه، اینکه یکی بیاد یه مدل زبانی رو روی Commodore 64 اجرا کنه، واقعاً با عقل جور در نمیاد. ولی خب، یه نفر دقیقاً همین کارو کرده، و نتیجهش شده یه ترکیب جذاب از نوستالژی و مهندسی خلاقانه.
اگه با دنیای کامپیوترهای قدیمی آشنا باشید، حتماً اسم C64 به گوشتون خورده. یه کامپیوتر خونگی محبوب از دهه ۸۰ میلادی، که فقط ۶۴ کیلوبایت رم داره(شاید بهتره بگیم داشت؟) با یه پردازندهی ۸ بیتی ساده. تو زمان خودش یه غول خونگی بود، ولی با استانداردای امروز بیشتر شبیه اسباببازیه تا کامپیوتر واقعی!
اگه بخوام یه مقایسه امروزی بکنم، شاید بشه گفت میکروکنترلر ATMega64 از C64 قویتره، هم از نظر سرعت، هم از نظر توان پردازشی. حالا تصور کن روی چنین سیستمی یه نسخه سادهشده از یه مدل زبانی رو اجرا کنی. مدلی که قراره متن تولید کنه، سوال جواب بده یا حتی دیالوگ برقرار کنه!
اما چطوری همچین چیزی ممکن شده؟ قضیه اینه که مدل زبانیای که استفاده شده، یه نسخه فوقالعاده بهینهشدهست. کلی از قابلیتهاش حذف شدن، وزنها و پارامترها فشرده شدن، و حتی بخشهایی از کد به زبان اسمبلی بازنویسی شده تا بتونه تو منابع محدود C64 جا بگیره. سرعت پردازشش خیلی بالا نیست (حتی ممکنه تولید یه کلمه چند دقیقه طول بکشه!) ولی بالاخره کار میکنه😁 اونم روی سیستمی که برای بازیهای ساده شبیه آتاری طراحی شده بود.
برای اینکه مدل جا بشه، از حافظهی جانبی مخصوصی به اسم REU استفاده شده، یه افزونه سختافزاری که به C64 وصل میشه و حافظهی بیشتر در اختیارش میذاره. بخشی از دادهها و وزنهای مدل تو این حافظه ذخیره میشن و سیستم ازشون موقع اجرا استفاده میکنه. از بیرون ممکنه بهنظر بیاد که خود C64 داره همه محاسبات رو انجام میده، ولی در واقع بخش بزرگی از کار توسط این ترفندها انجام میشه.
واقعیتش اینه که این پروژه اصلاً کاربردی نیست. مدل نهایی نه سریع کار میکنه و نه دقت خارقالعادهای داره. اما چیزی که باعث میشه این پروژه اینقدر جالب باشه، خلاقیت پشتشه. این کار بیشتر شبیه یه اثر هنریه تا یه پروژه مهندسی! یه جور بازی با مرزهای ممکن و یه ادای احترام به دوران طلایی کامپیوترهای خونگی هم هست.
و البته یه طعنه ظریف هم به وضعیت فعلی هوشهای مصنوعیه جایی که مدلها روزبهروز سنگینتر میشن و منابع بیشتری طلب میکنن، ولی در نهایت قراره همون کار ساده رو انجام بدن: حرف زدن.
اگه کنجکاوید بدونید دقیقاً چطوری این پروژه پیادهسازی شده، یا میخوایید خودتون امتحانش کنید، میتونید از لینک زیر به کدش دسترسی داشته باشید:
https://github.com/drmortalwombat/oscar64
Post #240
2.02K

- 👍 14
- ❤ 6
- 🔥 4