AI Infrastructure Engineer — vLLM / Kubernetes (Bry-sur-Marne)
À propos de la mission
Mission freelance pour consolider et optimiser une plateforme mutualisée d'inférence IA sur Kubernetes on‑premise avec parc GPU NVIDIA. Le consultant auditera le socle existant, optimisera le serving (vLLM, Triton), configurera une gateway LLM multi‑tenant et définira routage, quotas, traçabilité et plan de capacité. D
Compétences recherchées
IA · Kubernetes · vLLM · GPU
Créer mon profil gratuitement