DRW Montreal

DRW Montreal

Spécialiste CHP

Montreal

Sponsorship not specifiedDetected 23 days ago
PythonBashKubernetesTerraformAnsibleLinuxPrometheusGrafanaDevOpsSite Reliability EngineeringMachine LearningDeep LearningLLMsEmbedded SystemsTCP/IPCommunication

About the role

  • Nous valorisons l'autonomie et la capacité à pivoter rapidement pour saisir les opportunités, c'est pourquoi nous opérons en utilisant notre propre capital et en négociant à nos propres risques.
  • Nous avons également tiré parti de notre expertise et de notre technologie pour nous développer dans trois stratégies non traditionnelles: l'immobilier, le capital-risque et les crypto-actifs.
  • Nous opérons avec respect, curiosité et ouverture d'esprit.

Nice to have

  • Déployer, maintenir et optimiser l'infrastructure GPU pour des charges de travail d'inférence LLM à grande échelle, incluant le provisionnement, la configuration et le déploiement de flottes de serveurs GPU.
  • Concevoir et mettre en œuvre des solutions de serving distribuées pour des déploiements de modèles multi-nœuds et multi-GPU.
  • Configurer l'infrastructure réseau, incluant les load balancers, pare-feu et la communication inter-nœuds pour les clusters GPU.
  • Mettre en œuvre et optimiser des solutions de stockage pour les poids des modèles et les caches d'inférence.
  • Diagnostiquer les goulets d'étranglement en matière de performance à tous les niveaux: matériel, pilotes, réseau et couche applicative.
  • Rechercher et évaluer les nouvelles technologies GPU, les frameworks de serving de modèles et les optimisations d'infrastructure.
  • Collaborer avec les ingénieurs ML pour profiler les performances des modèles et mettre en œuvre des techniques d'accélération de l'inférence.
  • Améliorer la fiabilité via la supervision, les alertes, la planification de capacité et la gestion des incidents.

This listing is sourced directly from DRW Montreal's careers page and normalized into a canonical job model.