Probans
← Lexique
ia

Coût d'inférence

Coût de calcul associé à l'utilisation d'un modèle déjà entraîné pour produire une réponse.

ExempleGénérer une réponse de 500 tokens avec GPT-4o coûte ~0,01 $ : un chatbot traitant 100 000 requêtes/jour représente 1 000 $/jour ; poste à optimiser via la quantification ou des modèles plus légers.

1 article utilisant ce terme

Newsletter

Recevoir les prochaines analyses

Choisissez les catégories qui vous intéressent.

Catégories