Instructions to use dell-research-harvard/historical_newspaper_ner with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use dell-research-harvard/historical_newspaper_ner with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("token-classification", model="dell-research-harvard/historical_newspaper_ner")# Load model directly from transformers import AutoTokenizer, AutoModelForTokenClassification tokenizer = AutoTokenizer.from_pretrained("dell-research-harvard/historical_newspaper_ner") model = AutoModelForTokenClassification.from_pretrained("dell-research-harvard/historical_newspaper_ner", device_map="auto") - Notebooks
- Google Colab
- Kaggle
| { | |
| "best_metric": 0.8647798742138365, | |
| "best_model_checkpoint": "/mnt/data01/entity/ner_trained_models//roberta-large_lr_4.71695374919064e-05_ml_128_bs_128_e_184/checkpoint-500", | |
| "epoch": 171.42857142857142, | |
| "global_step": 1200, | |
| "is_hyper_param_search": false, | |
| "is_local_process_zero": true, | |
| "is_world_process_zero": true, | |
| "log_history": [ | |
| { | |
| "epoch": 14.29, | |
| "eval_dev1_accuracy_score": 0.9730900798175599, | |
| "eval_dev1_f1": 0.8222730739893211, | |
| "eval_dev1_loss": 0.13282082974910736, | |
| "eval_dev1_precision": 0.7973372781065089, | |
| "eval_dev1_recall": 0.8488188976377953, | |
| "eval_dev1_runtime": 0.896, | |
| "eval_dev1_samples_per_second": 147.323, | |
| "eval_dev1_steps_per_second": 2.232, | |
| "step": 100 | |
| }, | |
| { | |
| "epoch": 28.57, | |
| "eval_dev1_accuracy_score": 0.9779931584948689, | |
| "eval_dev1_f1": 0.8483896307934015, | |
| "eval_dev1_loss": 0.15858674049377441, | |
| "eval_dev1_precision": 0.8463949843260188, | |
| "eval_dev1_recall": 0.8503937007874016, | |
| "eval_dev1_runtime": 0.8958, | |
| "eval_dev1_samples_per_second": 147.352, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 200 | |
| }, | |
| { | |
| "epoch": 42.86, | |
| "eval_dev1_accuracy_score": 0.9770809578107184, | |
| "eval_dev1_f1": 0.8430913348946136, | |
| "eval_dev1_loss": 0.1632351577281952, | |
| "eval_dev1_precision": 0.8359133126934984, | |
| "eval_dev1_recall": 0.8503937007874016, | |
| "eval_dev1_runtime": 0.8958, | |
| "eval_dev1_samples_per_second": 147.362, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 300 | |
| }, | |
| { | |
| "epoch": 57.14, | |
| "eval_dev1_accuracy_score": 0.9775370581527936, | |
| "eval_dev1_f1": 0.8463949843260189, | |
| "eval_dev1_loss": 0.16842932999134064, | |
| "eval_dev1_precision": 0.8424336973478939, | |
| "eval_dev1_recall": 0.8503937007874016, | |
| "eval_dev1_runtime": 0.8946, | |
| "eval_dev1_samples_per_second": 147.555, | |
| "eval_dev1_steps_per_second": 2.236, | |
| "step": 400 | |
| }, | |
| { | |
| "epoch": 71.43, | |
| "learning_rate": 2.8858381633247082e-05, | |
| "loss": 0.0251, | |
| "step": 500 | |
| }, | |
| { | |
| "epoch": 71.43, | |
| "eval_dev1_accuracy_score": 0.9784492588369441, | |
| "eval_dev1_f1": 0.8647798742138365, | |
| "eval_dev1_loss": 0.16985777020454407, | |
| "eval_dev1_precision": 0.8634222919937206, | |
| "eval_dev1_recall": 0.8661417322834646, | |
| "eval_dev1_runtime": 0.8956, | |
| "eval_dev1_samples_per_second": 147.384, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 500 | |
| }, | |
| { | |
| "epoch": 85.71, | |
| "eval_dev1_accuracy_score": 0.9787913340935006, | |
| "eval_dev1_f1": 0.8539857932123125, | |
| "eval_dev1_loss": 0.17249244451522827, | |
| "eval_dev1_precision": 0.8560126582278481, | |
| "eval_dev1_recall": 0.8519685039370078, | |
| "eval_dev1_runtime": 0.8962, | |
| "eval_dev1_samples_per_second": 147.288, | |
| "eval_dev1_steps_per_second": 2.232, | |
| "step": 600 | |
| }, | |
| { | |
| "epoch": 100.0, | |
| "eval_dev1_accuracy_score": 0.9778791334093501, | |
| "eval_dev1_f1": 0.8491008600469115, | |
| "eval_dev1_loss": 0.18127191066741943, | |
| "eval_dev1_precision": 0.843167701863354, | |
| "eval_dev1_recall": 0.8551181102362204, | |
| "eval_dev1_runtime": 0.8957, | |
| "eval_dev1_samples_per_second": 147.363, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 700 | |
| }, | |
| { | |
| "epoch": 114.29, | |
| "eval_dev1_accuracy_score": 0.976054732041049, | |
| "eval_dev1_f1": 0.834755624515128, | |
| "eval_dev1_loss": 0.18781279027462006, | |
| "eval_dev1_precision": 0.8226299694189603, | |
| "eval_dev1_recall": 0.8472440944881889, | |
| "eval_dev1_runtime": 0.8971, | |
| "eval_dev1_samples_per_second": 147.138, | |
| "eval_dev1_steps_per_second": 2.229, | |
| "step": 800 | |
| }, | |
| { | |
| "epoch": 128.57, | |
| "eval_dev1_accuracy_score": 0.9789053591790193, | |
| "eval_dev1_f1": 0.8557993730407524, | |
| "eval_dev1_loss": 0.17089255154132843, | |
| "eval_dev1_precision": 0.8517940717628705, | |
| "eval_dev1_recall": 0.8598425196850393, | |
| "eval_dev1_runtime": 0.8955, | |
| "eval_dev1_samples_per_second": 147.396, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 900 | |
| }, | |
| { | |
| "epoch": 142.86, | |
| "learning_rate": 1.0547225774587767e-05, | |
| "loss": 0.0004, | |
| "step": 1000 | |
| }, | |
| { | |
| "epoch": 142.86, | |
| "eval_dev1_accuracy_score": 0.9790193842645382, | |
| "eval_dev1_f1": 0.8542159180457054, | |
| "eval_dev1_loss": 0.1791904866695404, | |
| "eval_dev1_precision": 0.8548895899053628, | |
| "eval_dev1_recall": 0.8535433070866142, | |
| "eval_dev1_runtime": 0.8957, | |
| "eval_dev1_samples_per_second": 147.369, | |
| "eval_dev1_steps_per_second": 2.233, | |
| "step": 1000 | |
| }, | |
| { | |
| "epoch": 157.14, | |
| "eval_dev1_accuracy_score": 0.9784492588369441, | |
| "eval_dev1_f1": 0.8513302034428794, | |
| "eval_dev1_loss": 0.17708931863307953, | |
| "eval_dev1_precision": 0.8460342146189735, | |
| "eval_dev1_recall": 0.8566929133858268, | |
| "eval_dev1_runtime": 0.8944, | |
| "eval_dev1_samples_per_second": 147.578, | |
| "eval_dev1_steps_per_second": 2.236, | |
| "step": 1100 | |
| }, | |
| { | |
| "epoch": 171.43, | |
| "eval_dev1_accuracy_score": 0.9786773090079818, | |
| "eval_dev1_f1": 0.8571428571428571, | |
| "eval_dev1_loss": 0.17732492089271545, | |
| "eval_dev1_precision": 0.8544600938967136, | |
| "eval_dev1_recall": 0.8598425196850393, | |
| "eval_dev1_runtime": 0.8936, | |
| "eval_dev1_samples_per_second": 147.71, | |
| "eval_dev1_steps_per_second": 2.238, | |
| "step": 1200 | |
| } | |
| ], | |
| "max_steps": 1288, | |
| "num_train_epochs": 184, | |
| "total_flos": 3.308248909268352e+16, | |
| "trial_name": null, | |
| "trial_params": null | |
| } | |