Coté LLM t'aura pas plus rapide que Groq qui propo...
# french-speaking
x
Coté LLM t'aura pas plus rapide que Groq qui propose pas mal de modele dont deepseek. Ce sont les seul a avoir une infra sur LPU (puce dedié LLM, plus rapide que GPU) ...tu y gagnera quele centaine de ms, mais bon apres ce qui influe le + sur la latence reste la synthese vocale. Si ton projet n'a pas besoin de trop de realisme tu peux opter pour les voix Azure plutot que 11lab. Groq + Azure t'es quasiment sur du real-time, avec des voix un peu moins realiste mais raisonable.