Fine-tuned MiniLM classifier for the historical English HC3 benchmark. Dataset: Hello-SimpleAI/HC3, revision 4d0ff18143b5a7e1b1e79beb540c04549d1e59d3. One nonempty human/generated answer pair per eligible, deduplicated question. Question-level 80/10/10 train/validation/test split with seed 42. AdamW, learning rate 2e-05, 5 epochs, batch size 32, maximum 256 tokens, dynamic padding. The baseline is logistic regression on frozen sentence embeddings. Performance measures this historical corpus, not current generators or unseen domains. Text is truncated at the maximum sequence length. Dataset style artifacts can influence predictions. Do not use this model as evidence of student misconduct.
Independent publisher
Xun
space-xun
generative models
Models in Library1
Datasets in Library0
Models on Hugging Face2
Followers2