Perplexity AI publie un tokenizer unigram open-source avec une latence p50 cinq fois inférieure à Hugging Face
8/10Perplexity AI a récemment publié en open-source un tokenizer unigram capable de réduire la latence p50 de tokenisation par un facteur de cinq comparé aux tokenizers du crate Hugging Face. Cette avancée notable améliore significativement l'efficacité des traitements NLP, notamment dans la réduction du temps de prétraitement des données textuelles pour les modèles de langage.
MarkTechPost · 28/05/2026 07:00:00
