BottleCap AI випустила ThinkingCap-Qwen3.8-27B: на 37,2% менше токенів міркування ціною зниження точності на 0,86 в.п.
BottleCap AI випустила ThinkingCap-Qwen3.8-27B — донавчену версію Qwen3.8-27B, яка використовує на 37,2% менше токенів міркування у 12 бенчмарках. Макроточність змінилася з 86,65% до 85,79%, а AA-LCR у довгому контексті покращився на 2,25 в.п. Модель є прямою заміною у vLLM і…