DeepSeek-R1-Distill-Qwen-7B
Компактная модель для рассуждений, перенёсшая часть поведения DeepSeek-R1 в основу Qwen.
Для чего подходит
- математика и логика
- обучающие объяснения
- небольшой помощник по коду
- эксперименты с пошаговыми рассуждениями
Ограничения
- может рассуждать избыточно
- дистилляция не делает модель 7B эквивалентом полной DeepSeek-R1