This model is a fine-tuned version of jhu-clsp/mmBERT-base on an unknown dataset. It achieves the following results on the evaluation set: The following hyperparameters were used during training: - learningrate: 3e-05 - trainbatchsize: 8 - evalbatchsize: 4 - distributedtype: multi-GPU - numdevices: 2 - gradientaccumulationsteps: 2 - totaltrainbatchsize: 32 - totalevalbatchsize: 8 - lrschedulertype: cosine - lrschedulerwarmupsteps: 0.1 - numepochs: 4 - mixedprecisiontraining: Native AMP - Transformers 5.0.0 - Pytorch 2.10.0+cu128 - Datasets 5.0.0 - Tokenizers 0.22.2
Independent publisher
Dao Minh
daominhwysi
Models in Library1
Datasets in Library0
Models on Hugging Face4
Followers3