CNN/DailyMail ModernBERT Pointwise Run
- model_size:
large - model_name:
answerdotai/ModernBERT-large - resolved_model_name:
/lustre/fsmisc/dataset/HuggingFace_Models/answerdotai/ModernBERT-large - target_mode:
model_balanced - target_field:
salience_score_model_balanced - input_field:
model_input_text - train_file:
data/CNN_DM/representative_subset/salience_generation/recovery_f2_all6/sentence_scorer_data/modernbert_pointwise/train.jsonl - dev_file:
data/CNN_DM/representative_subset/salience_generation/recovery_f2_all6/sentence_scorer_data/modernbert_pointwise/dev.jsonl - train_rows:
59643 - dev_rows:
6793 - train_articles:
1000 - dev_articles:
200 - max_length:
4096 - learning_rate:
2e-05 - weight_decay:
0.01 - num_train_epochs:
3.0 - warmup_ratio:
0.06 - per_device_train_batch_size:
2 - per_device_eval_batch_size:
2 - gradient_accumulation_steps:
8 - effective_train_batch_size:
16 - eval_strategy:
epoch - save_strategy:
epoch - early_stopping_patience:
2 - bf16:
True - fp16:
False - gradient_checkpointing:
True
Eval Metrics
- epoch:
3.0 - eval_article_ndcg_at_3:
0.9210334527568008 - eval_article_ndcg_at_5:
0.91633834365026 - eval_article_spearman:
0.7742035575368817 - eval_loss:
0.022096654400229454 - eval_mae:
0.10976211726665497 - eval_pearson:
0.8568720334438967 - eval_rmse:
0.1486494345775639 - eval_runtime:
132.4829 - eval_samples_per_second:
51.275 - eval_spearman:
0.856351157285778 - eval_steps_per_second:
25.641