Optimisation Memoire

2 article(s)
1–2 sur 2
vLLM - 01. Introduction : C'est quoi ? (modèles, inférences, cache)
vLLM - 01. Introduction : C'est quoi ? (modèles, inférences, cache)
📖 Lire sur Vigie24

Cette introduction présente vLLM, une bibliothèque optimisée pour l'inférence de modèles de langage. Elle explique les concepts fondamentaux liés à la gestion du cache et à l'optimisation des ressources pour améliorer les performances de génération.

✍️ xavki · via  Xavki

France  · 05/07/2026 18:58 ·  ⚙️ 622 tok Score : 59.8 ⓘ

Notez :👁 2
Comment compter des millions de vues ? HyperLogLog
Comment compter des millions de vues ? HyperLogLog
📖 Lire sur Vigie24

L'article explique le fonctionnement de l'algorithme HyperLogLog, utilisé pour estimer le nombre d'éléments uniques dans des ensembles de données massifs. Il détaille comment réduire drastiquement l'utilisation de la mémoire tout en acceptant une légère marge d'erreur.

✍️ Grafikart.fr · via  Grafikart

France  · 22/06/2026 13:00 ·  ⚙️ 616 tok Score : 59.8 ⓘ

Notez :👁 2
Une erreur s'est produite. Cette page ne sera pas actualisée jusqu'à ce que vous ayez redémarré l'application. Actualiser 🗙