دوستان با توجه به وضعیت موجود شاید وقت خوبی باشه که lmstudio یا Ollama رو راه بندازید روی سیستم.
ماجرا اینه که یه نرم افزار نصب میکنید مثل lmstudio و توی اون مدل های هوش مصنوعی رو میتونید دانلود کنید بسته به مشخصات سیستمتون و بدون اینترنت بهشون دسترسی داشته باشید و چت کنید. lmstudio حالت گرافیکی داره و با خودش میشه چت کرد ولی api مطابق openai هم میده و ollama حالت cli داره.
من روی یه لپتاپ با کارت گرافیک ضعیف موفق شدم qwen 3 VL و Ministral 3 رو اجرا کنم (هردو ۴ میلیارد پارامتری که حداقل اندازه بود) و با سرعت خیلی خوبی پاسخ دادن (۲۰ توکن بر ثانیه). البته اگه کلا کارت گرافیک ندارید سرعت پایین تره شاید در حد ۱-۲ توکن بر ثانیه.
تواناییشون توی کارهای مختلف متفاوته برای همین من ۲-۳ تا مدل ۳-۴ گیگی دانلود کردم و برای پرامتهای متفاوت همه رو امتحان میکنم مثلا متن فارسی روی qwen خیلی جالب جواب نداد ولی Ministral خوب بود. اگه دنبال مدلهای خوب بودین deepseek و glm و gemma هم مدلهای خوب opensourceی هستن. خود lmstudio هم یه قسمت editor pick داره که بر اساس رم سیستم مدلهای خوب رو پیشنهاد میده. داخل صفحه مدل که برید میگه که این مدل میتونه کامل بره روی gpu یا partial بره یا اصلا خیلی بزرگه و احتمالا اجرا نمیشه.
مطالب قبلی در این باره:
https://t.me/terminal_stuff/2902
https://t.me/terminal_stuff/2903
شما هم تجربهتون رو به اشتراک بگذارید.
Post #3264
2.85K