Qwen3 32B
Сильная плотная модель для кода и рассуждений. В Q4 она находится у границы 24 ГБ с учётом KV-кэша и служебной памяти.
Для чего подходит
- сложный код
- локальный аналитический ассистент
- длинные инструкции
- сервер с 24-48 ГБ видеопамяти
Ограничения
- на 16 ГБ почти неизбежен перенос части данных в RAM или разделение между картами
- длинный контекст требует отдельного запаса памяти