شرکت Inception از مدل جدیدی رونمایی کرده که برخلاف LLM های رایج از متود Diffusion، همون متودی که تا امروز برای تولید عکس و ویدیو در مدلهایی مثل Sora و Midjourney استفاده میشد، برای تولید و ویرایش متنها استفاده میکنه.
این موضوع باعث میشه که این مدل بتونه کارهایی که مدلهای کنونی انجام میدن رو با سرعت بسیار بیشتری انجام بده.
مدل های LLM کنونی به صورت Sequential کار میکنن، یعنی مثلا برای تولید یک عبارت سه حرفی در ابتدا باید کلمه اول، سپس دوم و در آخر سومین کلمه تولید بشه، تولید کلمه دوم مادامی که تولید کلمه اول به اتمام نرسیده باشه ممکن نیست.
اما مدل های Diffusion در همون ابتدا یک برآورد کلی از خروجیای که قراره درنهایت تولید بشه (مثل یک عکس) دارن و سپس دیتا رو حول محور اون جمع آوری و تولید میکنند، وقتی که این مکانیزم رو با مدلهای زبانی کنونی ترکیب کنیم، نتیجه میشه یک مدل زبانی بسیار سریع که میتونه به صورت موازی تولید متون مختلف رو انجام بده.
آقای Ermon، بنیانگذار این شرکت که استاد دانشگاه استنفورد هم هست، به همراه یکی از دانشجوهاش پیپر مربوط به این تکنیک رو سال گذشته منتشر کردن.
این شرکت همچنین از خانواده مدلهایی که بر این اساس ساخته شدن به اسم Mercury هم رونمایی کرده که به گفته این شرکت ۱۰ برابر سریعتر از مدل های کنونی هستن. این مدلها که Mercury Coder Mini و Mercury Coder Small نام دارند، میتونن روی کارت های Nvidia H100 تا ۱۰۰۰ توکن بر ثانیه خروجی داشته باشن، که این سرعت تا قبل از این فقط با چیپهای شخصی سازی شده قابل دستیابی بود.
مدل Mercury Coder که تمرکز اون روی کد نویسی هست از اینجا در دسترس و قابل استفاده هست.
@aipulse24
Post #332
3.14K



- 👍 18
- 🔥 10
- ❤ 4
- 👌 1