StartHub accompagne les dirigeants à chaque étape du développement de leur entreprise en réunissant stratégie, expertise et les meilleurs partenaires autour de leurs projets.

Contact
Téléphone +352 27 04 82 37
Adresse 16 Zone d'Activités Economiques L-8287 Kehlen
Suivez-nous
Contact
Téléphone +352 27 04 82 37
Adresse 16 Zone d'Activités Economiques L-8287 Kehlen
Suivez-nous

Cache

Inférence & performance

Cache

Un cache conserve temporairement un résultat ou une donnée afin d’éviter de refaire un traitement ou un accès coûteux.

Comprendre la notion

La clé, la durée de validité et les règles d’invalidation déterminent sa fiabilité. Pour une application d’IA, les versions de modèle, les permissions et le contexte peuvent faire partie de la clé. Un cache partagé doit empêcher qu’un utilisateur reçoive une donnée réservée à un autre.

Exemple d’utilisation

Une application conserve brièvement une information publique souvent consultée et la rafraîchit après expiration.

Point de vigilance

Le gain de vitesse doit être mis en balance avec le risque de servir un résultat périmé ou mal isolé.

Références pour approfondir

Articles associés

85.

Inférence & performance

KV cache

Mémoire qui conserve certaines représentations calculées par les couches d’attention pour éviter de les recalculer à chaque étape.

87.

Inférence & performance

Latence

La latence est le temps écoulé entre une action ou une requête et le résultat mesuré à un point défini.

Bâtissons l'avenir ensemble.

Vous pouvez modifier votre choix à tout moment depuis « Gérer les cookies » en bas de page.

Votre choix est conservé pendant six mois dans ce navigateur. Aucun outil publicitaire n’est installé. La mesure d’audience est facultative.

Détails sur les cookies

Rechercher sur le site

Saisissez au moins deux caractères.