SAVRN
Search Contact SAVRN

Independent publisher

Tatasauce

tatasauce4life

Models in Library1
Datasets in Library0
Models on Hugging Face2
Followers

Models

Model · Translation

qwen3-4b-en2zh-orpo

Tatasauce

模型類型: LoRA Adapter (SFT + ORPO 累積更新) - 基礎模型: unsloth/Qwen3-4B-Base-unsloth-bnb-4bit - SFT 模型來源: tatasauce4life/qwen3-4b-en2zh-lora - 訓練方法: ORPO (Odds Ratio Preference Optimization) 1. SFT 階段: 使用英中平行小說語料做 LoRA SFT 2. ORPO 階段: 使用人工譯文 (chosen) vs. 機器翻譯 (rejected) 做偏好優化 此模型是 LoRA adapter,包含 SFT + ORPO 的累積更新。

Open weights apache-2.0