CamemBERTavr. 27, 2016Aller sur le site du projet Image credit: Alix ChaguéLanguage ModelingPedro Ortiz SuarezChercheur SeniorJe suis chercheur senior au sein de la fondation Common Crawl.PublicationsCamemBERT: a Tasty French Language ModelWe explore the impact of the training data size on a French version of RoBERTa.Louis Martin, Benjamin Muller, Pedro Ortiz Suarez, Yoann Dupont, Laurent Romary, Éric de la Clergerie, Djamé Seddah, Benoît SagotPDF Citation Jeu de données Projet Vidéo DOI ACL Anthology arXiv Website ACL 2020 HALLes modèles de langue contextuels Camembert pour le Français : impact de la taille et de l'hétérogénéité des données d'entrainementNous explorons l’impact de la taille et de l’hétérogénéité des données d’entraînement sur la modélisation de la langue française.Louis Martin, Benjamin Muller, Pedro Ortiz Suarez, Yoann Dupont, Laurent Romary, Éric de la Clergerie, Benoît Sagot, Djamé SeddahPDF Citation Jeu de données Projet TALN 2020 HAL Website