BottleCap AI выпустила ThinkingCap-Qwen3.8-27B: на 37,2% меньше токенов рассуждений при снижении точности на 0,86 п.п.
BottleCap AI выпустила ThinkingCap-Qwen3.8-27B — дообученную версию Qwen3.8-27B, которая использует на 37,2% меньше токенов рассуждений в 12 бенчмарках. Макроточность изменилась с 86,65% до 85,79%, а AA-LCR в условиях длинного контекста улучшился на 2,25 п.п. Модель является прямой заменой во vLLM и…