← Lexique
ia
Coût d'inférence
Coût de calcul associé à l'utilisation d'un modèle déjà entraîné pour produire une réponse.
ExempleGénérer une réponse de 500 tokens avec GPT-4o coûte ~0,01 $ : un chatbot traitant 100 000 requêtes/jour représente 1 000 $/jour ; poste à optimiser via la quantification ou des modèles plus légers.