SAVRN
Search Contact SAVRN

Independent publisher

TR AKR

AKRTR

Models in Library1
Datasets in Library0
Models on Hugging Face2
Followers—

Models

Model · Image and text to text

qwen3.5-35b-a3b-instruct-merged8083-sft

TR AKR

This model is a fine-tuned version of /mnt/shared-storage-user/mineru2-shared/niujunbo/ldy/models/Qwen3.5-35B-A3B-Instruct on the merged8083ulogocohqwen35 dataset. The following hyperparameters were used during training: - learningrate: 5e-05 - trainbatchsize: 1 - evalbatchsize: 8 - distributedtype: multi-GPU - numdevices: 8 - gradientaccumulationsteps: 8 - totaltrainbatchsize: 64 - totalevalbatchsize: 64 - lrschedulertype: cosine - lrschedulerwarmupsteps: 0.1 - numepochs: 1.0 - Transformers 5.6.0 - Pytorch 2.10.0+cu128 - Datasets 4.0.0 - Tokenizers 0.22.2

Open weights other 664,944 parameters 262,144 tokens transformers