DeepSeek-R1-Distill-Qwen-7B
Компактная reasoning-модель, перенёсшая часть поведения DeepSeek-R1 в базу Qwen.
Для чего подходит
- математика и логика
- обучающие объяснения
- небольшой coding assistant
- эксперименты с reasoning
Ограничения
- может рассуждать избыточно
- дистилляция не делает 7B эквивалентом полной R1