Optimisation Memoire
2 article(s)
→

vLLM - 01. Introduction : C'est quoi ? (modèles, inférences, cache)
📖 Lire sur Vigie24Cette introduction présente vLLM, une bibliothèque optimisée pour l'inférence de modèles de langage. Elle explique les concepts fondamentaux liés à la gestion du cache et à l'optimisation des ressources pour améliorer les performances de génération.
Notez :👁 2

Comment compter des millions de vues ? HyperLogLog
📖 Lire sur Vigie24L'article explique le fonctionnement de l'algorithme HyperLogLog, utilisé pour estimer le nombre d'éléments uniques dans des ensembles de données massifs. Il détaille comment réduire drastiquement l'utilisation de la mémoire tout en acceptant une légère marge d'erreur.
Notez :👁 2