@ai_python
مبحث Alignment یا همان Post Training در خصوص مدل های زبانی بزرگ، در بسیاری از موارد، تکمیل کننده Pre Training خواهد بود و بسیار ضروری است.
@ai_python
پای تورچ در این پست وبلاگش سعی کرده مباحثی مانند SFT ، RLHF و DPO و ... را در خصوص Post Training مدل های زبانی بزرگ، باز کنه:
https://pytorch.org/blog/a-primer-on-llm-post-training/
Post #17752
2.58K
