Inférence & performance
Time to first token (TTFT)
Délai entre un point de départ défini d’une requête et la réception du premier token de réponse.
StartHub accompagne les dirigeants à chaque étape du développement de leur entreprise en réunissant stratégie, expertise et les meilleurs partenaires autour de leurs projets.
Comprendre les notions utiles pour structurer un projet, piloter une entreprise et éclairer ses décisions.
157–167 sur 167 définitions
Inférence & performance
Délai entre un point de départ défini d’une requête et la réception du premier token de réponse.
IA : modèles
Unité de représentation utilisée par un modèle pour découper une entrée ou construire une sortie.
IA : modèles
Le top-p limite l’échantillonnage à un ensemble de tokens dont les probabilités cumulées atteignent un seuil défini.
Données & architecture
Capacité à retrouver l’origine, les transformations et les décisions associées à une information ou une opération.
IA : modèles
Famille d’architectures de réseaux de neurones utilisant notamment des mécanismes d’attention pour traiter des relations entre éléments d’une séquence.
Économie & financement
L’économie unitaire examine les revenus et les coûts attribuables à une unité d’activité : client, commande, dossier ou requête.
Agents & automatisation
Intervention d’une personne à une étape définie d’un système automatisé.
Inférence & performance
Mémoire dédiée d’un accélérateur graphique, utilisée notamment pour les paramètres et états de calcul.
Cloud & sécurité
Un webhook est une notification HTTP envoyée par un service à un autre lorsqu’un événement survient.
Agents & automatisation
Enchaînement d’étapes et de conditions décrivant la progression d’un travail.
IA : modèles
Le zero-shot demande au modèle de réaliser une tâche sans lui fournir d’exemple de cette tâche dans la requête.