Qwen 3.6 27B is the sweet spot for local development
Qwen 3.6 27B стал «точкой слияния» для локального развития: это первый локальный модель, который ощутимо приближается к всеобщей интеллектуальности, при этом обходит более крупные варианты в практических задачах. Автор отмечает, что 27‑битовая версия «ударяет сзади» — её называют «перепрыгивает выше веса», а в Hacker News её часто называют лучшим компромиссом между мощью и ресурсоёмкостью.
Тестовые сценарии подтверждают возможности: от «пингвинов на велосипеде» до восьмистрочного стихотворения о Зоуке и квантовой физике, от мгновенного создания hexagonal‑minesweeper в OpenCode до генерации полноценной landing‑page для онлайн‑магазина свечей. Запуск локальный прост: через llama.cpp берут 8‑битную квантованную модель (Q8_0), контекст расширяют до 64 k токенов, а flash‑attention и draft‑mtp ускоряют вывод. При работе модель нагревается до такой степени, что её можно отследить тепловизором. Ключевые цифры — 27 B против 35 B, 8‑битное сжатие экономит ~50 % памяти, а контекст до 64 k токенов открывает широкие возможности для локального кодинга и генерации контента.