ces résultats correspondent à la réponse complète ...
# french-speaking
u
ces résultats correspondent à la réponse complète des 50 tokens (max), et non pas à la latence du premier token chunk reçu (qui est bien plus faible évidemment)
2 Views