1 article tagué « backend »
Les développeurs peuvent désormais utiliser vLLM directement avec les modèles Hugging Face pour des inférences plus rapides.