StartHub accompagne les dirigeants à chaque étape du développement de leur entreprise en réunissant stratégie, expertise et les meilleurs partenaires autour de leurs projets.

Contact
Téléphone +352 27 04 82 37
Adresse 16 Zone d'Activités Economiques L-8287 Kehlen
Suivez-nous
Contact
Téléphone +352 27 04 82 37
Adresse 16 Zone d'Activités Economiques L-8287 Kehlen
Suivez-nous

Decode

Inférence & performance

Decode

Phase durant laquelle un modèle génératif produit les éléments successifs de sa sortie.

Comprendre la notion

La génération utilise l’état préparé et mis à jour au fil des tokens. Sa performance dépend notamment de la mémoire, de la concurrence et de l’organisation des lots.

Exemple d’utilisation

Une réponse s’affiche progressivement après le premier token.

Point de vigilance

Le débit total du serveur et la fluidité d’une réponse sont deux mesures différentes.

Références pour approfondir

24.

Inférence & performance

Cache

Un cache conserve temporairement un résultat ou une donnée afin d’éviter de refaire un traitement ou un accès coûteux.

Bâtissons l'avenir ensemble.

Vous pouvez modifier votre choix à tout moment depuis « Gérer les cookies » en bas de page.

Votre choix est conservé pendant six mois dans ce navigateur. Aucun outil publicitaire n’est installé. La mesure d’audience est facultative.

Détails sur les cookies

Rechercher sur le site

Saisissez au moins deux caractères.