DeepSeek-R1-FineTuning. Fine-Tuning of DeepSeek-Style Reasoning Models | RL + Quantization Implementation

github.com/0xZee/DeepSeek-R1-FineTuning

Vaya's read on this project

Problem, audience, market, and the verdict — sign in to see it.

Updates

No recent activity.