This model is a fine-tuned version of Qwen/Qwen3-4B-Instruct-2507. It has been trained using TRL. This model was trained with SFT.
Independent publisher
Habeeb
Habiquell
Models in Library1
Datasets in Library0
Models on Hugging Face1
Followers—