Qwen3.6: /nothink fikrlashni o‘chiradigan tugma emas
Qwen3.6: /nothink fikrlashni o‘chiradigan tugma emas
Siz Qwen3.6-35B-A3B’dan murojaatlarni tezda toifalarga ajratishni so‘raysiz, /nothink qo‘shasiz, ammo baribir mulohazalar tugashini kutasiz. Darhol kuchliroq GPU izlashdan oldin so‘rov sozlamalarini tekshiring.
Qwen’ning rasmiy model kartasiga ko‘ra, model odatda thinking mode’da ishlaydi. Eski /think va /nothink buyruqlari rasman qo‘llab-quvvatlanmaydi. Mulohazalar blokisiz bevosita javob olish uchun xabardagi iborani emas, API parametrini o‘zgartirish kerak.
O‘zingizning vLLM yoki SGLang serveringizda extra_body ichidagi chat_template_kwargs maydoniga {"enable_thinking": false} qiymatini bering. Alibaba Cloud Model Studio’da esa enable_thinking bevosita extra_body ichiga yoziladi, chat_template_kwargs kerak emas. Bir xil murojaatlar to‘plamini ikkala rejimda sinang: tayyor javobgacha ketgan vaqtni va toifalash xatolarini solishtiring.
Bu sinov serverni almashtirishdan oldin vazifangizga fikrlash rejimi kerakligini aniqlashga yordam beradi. Parametrni bir provayderdan boshqasiga tekshirmay ko‘chirmang: tuzilishi farq qiladi, sifatni esa o‘z ma’lumotlaringizda tekshirish zarur. Qwen3.6 rejimini matndagi /nothink bilan emas, API parametri orqali almashtiring.

