L'ingenieur des operations cloud est responsable de garantir l'integrite operationnelle, la stabilite et la fiabilite des systemes et applications bases sur le cloud heberges sur AWS. Ce role implique la gestion, la surveillance et l'automatisation de l'infrastructure et des services AWS, la mise en oeuvre de pratiques de gestion de configuration, ainsi que l'utilisation de l'infrastructure sous forme de code (IaC) pour rationaliser les operations. Ce role implique egalement une collaboration avec les parties prenantes et le respect des normes de securite et de conformite.
Devoirs et responsabilites
Gestion de l'infrastructure AWS
- Concevoir, installer, configurer et maintenir l'infrastructure cloud AWS, y compris les architectures de serveur et sans serveur.
- Concevoir et planifier des ameliorations en utilisant de nouvelles solutions natives dans AWS et/ou un environnement cloud alternatif.
- Bonne connaissance des services cloud de base tels que les machines virtuelles, les conteneurs, les services d'application, les reseaux virtuels, les groupes de mise a l'echelle automatique (ASG), les passerelles d'application, les equilibrateurs de charge et les comptes S3.
- Evaluer regulierement les applications cloud, les conceptions et les meilleures pratiques.
- Mettre en oeuvre des solutions de reseautage securisees telles que VPC, sous-reseaux, routage et groupes de securite.
- Gerer les groupes de securite, les roles IAM et les politiques pour un controle d'acces securise.
Automatisation et optimisation
- Creer et maintenir des solutions automatisees pour les taches repetitives, y compris le provisionnement de l'infrastructure, la surveillance et l'application de correctifs.
- Optimiser les ressources cloud pour la gestion des couts et les performances.
- Mettre en oeuvre des solutions de mise a l'echelle automatique et d'elasticite pour garantir la fiabilite et l'efficacite de l'infrastructure.
Gestion de la configuration et infrastructure sous forme de code (IaC)
- Utiliser des outils d'infrastructure sous forme de code pour approvisionner, gerer et versionner les ressources AWS.
- Mettre en oeuvre et maintenir des outils de gestion de configuration pour standardiser et automatiser les configurations.
Surveillance et alertes
- Configurer et maintenir des systemes de surveillance et d'alerte pour garantir la sante et les performances de l'infrastructure.
Deploiement et support d'applications
- Deployer, configurer et prendre en charge les applications et services sur l'infrastructure AWS.
- Collaborer avec les equipes DevOps pour optimiser et automatiser les pipelines CI/CD.
Gestion des changements et des incidents
- Preparer et documenter les demandes de changement et les methodes de procedures pour les modifications de l'infrastructure.
- Depanner et resoudre les incidents affectant les services cloud conformement aux accords de niveau de service (SLA) predefinis.
- Transmettre les problemes aux equipes internes ou aux fournisseurs tiers selon les besoins.
Reponse aux incidents et rapports post-incident
- Participer aux processus de reponse aux incidents et aux rapports post-incident.
- Identifier et deployer des correctifs pour eviter la recurrence des problemes.
Securite et conformite
- Travailler avec la securite informatique pour s'assurer que l'infrastructure cloud s'aligne sur les meilleures pratiques de securite et les exigences de conformite.
- Travailler avec l'architecture interne, la livraison de solutions (PMO), la gouvernance et les equipes de securite pour garantir que toutes les exigences et meilleures pratiques de securite, de gouvernance et de responsabilite are integres et mis en oeuvre.
- Gouvernance cloud - Optimisation des couts, gestion des donnees, gestion des actifs, gestion des performances et acceleration du deploiement.
- Mettre en oeuvre des solutions de chiffrement, de sauvegarde et de reprise apres sinistre.
Securite et conformite
- S'engager activement dans le systeme de gestion de la securite de l'entreprise en signalant les dangers et les incidents rencontres lors des operations quotidiennes.
Collaboration et documentation
- Coordonner avec les parties prenantes internes, DevOps et les fournisseurs tiers pour les deploiements et les corrections.
- Travailler au sein d'une equipe pluridisciplinaire composee d'ingenieurs des operations systemes, d'administrateurs d'applications, d'ingenieurs de donnees, de DevOps et d'administrateurs de bases de donnees pour specifier, concevoir, developper, tester et mettre en oeuvre des services et solutions cloud AWS.
- Fournir des conseils et des connaissances aux autres membres de l'equipe et promouvoir l'efficacite, la productivite, l'innovation et le partage des connaissances au sein d'equipes multifonctionnelles.
- Travailler en etroite collaboration avec les partenaires commerciaux internes pour recueillir les exigences, concevoir et mettre en oeuvre des solutions, gerer les operations techniques, trier et resoudre les problemes operationnels.
- Maintenir une documentation systeme, d'application et d'infrastructure detaillee et precise.
Support d'astreinte
- Participer a une rotation d'astreinte en dehors des heures de bureau pour la resolution d'incidents critiques.
Autres responsabilites
- Effectuer des taches connexes supplementaires attribuees par la direction.
Competences comportementales
Souci de la securite : Identifier les situations dangereuses ou potentiellement dangereuses et prendre les mesures appropriees pour maintenir un environnement sur pour soi et pour les autres.
Travail d'equipe : Travailler en collaboration avec d'autres pour atteindre les objectifs organisationnels.
Service aux passagers / clients : Fournir une excellence de service aux clients internes et/ou externes (passagers).
Initiative : Traiter les situations et les problemes de maniere proactive et persistante, en saisissant les opportunites qui se presentent.
Orientation vers les resultats : Concentrer ses efforts sur l'obtention de resultats de haute qualite conformes aux normes de l'organisation.
Favoriser la communication : Ecouter et communiquer ouvertement, honnetement et respectueusement avec differentes audiences, en favorisant le dialogue et la recherche de consensus.
Qualifications
- Solide experience avec les services AWS tels que EC2, S3, RDS, Lambda, CloudFormation et VPC.
- 5 ans et plus d'experience dans les operations d'infrastructure informatique avec un minimum de 3 ans d'experience dans AWS.
- Maîtrise des outils d'automatisation (ex. : AWS CLI, Terraform ou CloudFormation).
- Familiarite avec les outils de surveillance tels que CloudWatch, Dynatrace.
- Experience avec les langages de script tels que Python, PowerShell ou Bash.
- Experience dans la mise en oeuvre, la prise en charge et la surveillance de serveurs et d'applications dans les environnements Windows et Linux.
- Experience dans l'integration d'applications et de systemes.
- Comprehension des pratiques ITIL et des processus de gestion des changements.
- Solides competences en resolution de problemes et capacite a travailler sous pression.
- Excellentes competences en communication et en documentation.
- Une experience avec DevOps, les pipelines CI/CD et la gestion de configuration est un atout.
- Volonte de travailler selon des horaires flexibles, y compris en dehors des heures de bureau et lors de rotations d'astreinte.
Détails
- Ville
- Toronto, Ontario
Besoin d'assistance?
- Courriel
- support@aerowork.ca
- Téléphone
- 1-450-403-4300