مدل Qwen3.8-27B رو روی سرورهای شرکت بالا آوردیم و دارم تستش میکنم.
نکته عجیبی که دیدم این بود که chat template مدل توی hugging face باگ داره!
با اینکه توی template سه تا سطح xhigh، medium و low برای reasoning effort تعریف شده، به طرز خندهداری سطح medium اصلا هیچ instruction ی نداره. یعنی اگه شما effort رو روی medium بذارید، مدل واقعا نمیدونه چقدر باید فکر کنه. درستش هم نکردن:
https://huggingface.co/Qwen/Qwen3.8-27B/blob/main/chat_template.jinja
نکته بعدی هم در مورد 9router هست که اگه ببینه توی اسم مدل qwen هست، اگه reasoning effort رو توی درخواست بفرستید، اون رو همونجوری به مدل ارسال نمیکنه و ترجمه میکنه به thinking_budget که فقط توی تمپلیت Qwen3.7 پشتیبانی میشه و هیچ کدوم از مدلهای Qwen3.6 و Qwen3.8 پشتیبانیش نمیکنن.
اینم از مدل چینی!
@DevTwitter | <aleskxyz/>
Post #13111
7.21K

- 👍 44
- 🍌 23
- 👎 2