arXiv cs.AI / cs.LG / cs.CL·11d agoRight Tool, Right Job: Native-Language Evaluation, Tokenizer Sensitivity, and Methodological Findings from a French-Only BabyLM#babylm#cross-lingual#evaluationAI research