TGViewer
DeepMind AI Expert DeepMind AI Expert @ai_deepmind · 15.7K subscribers
Post #5159 2.2K
مقاله بررسی می‌کند آیا مدل می‌تواند از ابتدا، با داده‌هایی که خودش تولید می‌کند، الگوهای قابل‌انتقال به داده‌های واقعی یاد بگیرد.

روش:
دو مدل با وزن‌های تصادفی هم‌زمان آموزش می‌بینند:
مولد:
برنامه‌هایی می‌نویسد که اجرا می‌شوند و دنباله‌های بایت تولید می‌کنند.
یادگیرنده:
پیش‌بینی بایت بعدی این دنباله‌ها را یاد می‌گیرد.
مولد با آموزش تقویتی، بابت تولید ساختارهای قابل‌یادگیری در مرز توانایی یادگیرنده پاداش می‌گیرد؛ صرفاً سخت‌کردن داده با نویز کافی نیست.

با افزایش محاسبات، خطای پیش‌بینی روی متن، تصویر، گفتار، موسیقی و کدِ دیده‌نشده کاهش یافت. مدل قابلیت یادگیری از مثال‌های داخل زمینه را نشان داد و مولد، ساختارهایی مانند دنباله فیبوناچی کشف کرد. خودبازی از نمونه‌گیری تصادفی برنامه‌ها بهتر بود؛ اما روش مبتنی بر دستور زبان مصنوعی در متن و کد قوی‌تر عمل کرد.

🔊 Self-Play Pretraining with Zero Data

#مقاله

➡️ @AI_DeepMind
✔️ @AI_Person
  • 🔥 6
  • ❤ 2
  • 👌 1
More from @ai_deepmind
  1. Oct 6, 2026https://x.com/rez_ebrahimi/status/2107199720355725465 ❤️🖤
  2. Oct 5, 2026ایرانسل یه اپلیکیشن داره که با اینترنت خودش باز نمیشه، حتما باید همراه اول داشته باشی.
  3. Oct 5, 2026روز جهانی معلم را به آموزگارانم جمینای، چت‌ جی‌پی تی و کلاد تبریک عرض می‌کنم. ‌‌‌‌‌‌‌‌‌‌‌‌…
  4. Oct 5, 2026مهدی نوشت: البته خیلی از صفت‌ها هستن که الکی اسم خوشگل کمال‌گرایی رو می‌ذارن روش که خیالشو…
  5. Oct 5, 2026خیلی دوست داشتم توی ژانرِ «عمل‌گرا vs کمال‌گرا» شرکت کنم، اما به همین یه جمله بسنده می‌کنم…
  6. Oct 5, 2026آفرهای فیلترشکن تونل ویژه کانال برای شرایط عادی یک ماهه مناسب برای تمام وب سایتها از جمله…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →