Qwen3.6-27B

Почему мы собрали LLM-сервер, который жжёт миллиард токенов в сутки

Часть 1 серии «Наш опыт»: мотивация self-hosted LLM-инференса и путь железа от ноутбука с RTX 2060 до 3×(2×RTX 3090) — с цифрами на каждой фазе.

Как мы выбрали Qwen3.8-27B из 12 моделей: бенчмарки, MTP и почему 27B — sweet spot

Часть 2 серии «Наш опыт»: сравнение 12 моделей на 2×RTX 3090 — Terminal-Bench, DeepSWE, MTP, VRAM. Почему 27B — оптимум для агентного кодинга.