CamemBERT - noms de personnes

Modèle fait pour le TD2 de NLP (ESGI). Pour chaque mot, il dit si c'est un nom de personne (1) ou pas (0).

Entraînement

  • Base : almanach/camembert-base
  • Étape 1 : MultiNERD FR (20 000 phrases, 2 epochs)
  • Étape 2 : données France Inter du TD (3 epochs)

Résultats (jeu de test)

  • MultiNERD FR : 99.9 % accuracy
  • France Inter : 99.45 % accuracy par mot

Utilisation

from transformers import AutoModelForTokenClassification, AutoTokenizer

model = AutoModelForTokenClassification.from_pretrained("MohamedDataX/camembert-person-ner")
tokenizer = AutoTokenizer.from_pretrained("MohamedDataX/camembert-person-ner")

Le label d'un mot = le label de son 1er token.

Downloads last month
75
Safetensors
Model size
0.1B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for MohamedDataX/camembert-person-ner

Finetuned
(179)
this model