Résumé du poste
L'ingénieur(e) des opérations cloud est responsable d'assurer l'intégrité opérationnelle, la stabilité et la fiabilité des systèmes et applications basés sur le cloud hébergés sur AWS. Ce rôle implique la gestion, la surveillance et l'automatisation de l'infrastructure et des services AWS, la mise en œuvre de pratiques de gestion de la configuration, l'utilisation de l'infrastructure en tant que code (IaC) pour rationaliser les opérations. Ce rôle implique une collaboration avec les parties prenantes et le respect des normes de sécurité et de conformité.
Fonctions et responsabilités
Gestion de l'infrastructure AWS
- Concevoir, installer, configurer et maintenir l'infrastructure cloud AWS, y compris les architectures de serveurs et sans serveur.
- Architecturer et concevoir des améliorations en utilisant de nouvelles solutions natives dans AWS et/ou un environnement cloud alternatif.
- Bonne connaissance des services cloud de base tels que les machines virtuelles, les conteneurs, les services d'applications, les réseaux virtuels, les ASG, les passerelles d'applications, les équilibreurs de charge et les comptes S3.
- Évaluer régulièrement les applications cloud, les conceptions et les meilleures pratiques.
- Mettre en œuvre des solutions de mise en réseau sécurisées telles que VPC, les sous-réseaux, le routage et les groupes de sécurité
- Gérer les groupes de sécurité, les rôles IAM et les politiques pour un contrôle d'accès sécurisé.
Automatisation et optimisation
- Créer et maintenir des solutions automatisées pour les tâches répétitives, y compris le provisionnement de l'infrastructure, la surveillance et les correctifs.
- Optimiser les ressources cloud pour la gestion des coûts et la performance.
- Mettre en œuvre des solutions d'auto-mise à l'échelle et d'élasticité pour assurer la fiabilité et l'efficacité de l'infrastructure.
Gestion de la configuration et Infrastructure en tant que code (IaC)
- Utiliser des outils d'infrastructure en tant que code pour provisionner, gérer et versionner les ressources AWS.
- Mettre en œuvre et maintenir des outils de gestion de la configuration pour normaliser et automatiser les configurations.
Surveillance et alertes
- Configurer et maintenir des systèmes de surveillance et d'alerte pour assurer la santé et la performance de l'infrastructure.
Déploiement et support d'applications
- Déployer, configurer et supporter des applications et des services sur l'infrastructure AWS.
- Collaborer avec les équipes DevOps pour optimiser et automatiser les pipelines CI/CD.
Gestion des changements et des incidents
- Préparer et documenter les demandes de changement et les méthodes de procédures (MOP) pour les changements d'infrastructure.
- Dépanner et résoudre les incidents affectant les services cloud conformément aux accords de niveau de service (SLA) prédéfinis.
- Transmettre les problèmes aux équipes internes ou aux fournisseurs tiers si nécessaire.
Intervention en cas d'incident et rapports post-incident
- Participer aux processus d'intervention en cas d'incident et aux rapports post-incident (PIR).
- Identifier et déployer des correctifs pour éviter la récurrence des problèmes.
Sécurité et conformité
- Collaborer avec la sécurité informatique pour s'assurer que l'infrastructure cloud est conforme aux meilleures pratiques de sécurité et aux exigences de conformité.
- Travailler avec les équipes internes d'architecture, de prestation de solutions (PMO), de gouvernance et de sécurité pour s'assurer que toutes les exigences et les meilleures pratiques en matière de sécurité, de gouvernance et de continuité des activités sont intégrées et mises en œuvre.
- Gouvernance du cloud - Optimisation des coûts, gestion des données, gestion des actifs, gestion des performances et accélération du déploiement.
- Mettre en œuvre des solutions de chiffrement, de sauvegarde et de reprise après sinistre.
Sécurité et conformité
- Participer activement au système de gestion de la sécurité (SMS) de l'entreprise en signalant les dangers et les incidents rencontrés lors des opérations quotidiennes.
Collaboration et documentation
- Coordonner avec les parties prenantes internes, DevOps et les fournisseurs tiers pour les déploiements et les correctifs.
- Travailler au sein d'une équipe interfonctionnelle d'ingénieurs des opérations système, d'administrateurs d'applications, d'ingénieurs de données DevOps et de DBA pour spécifier, concevoir, développer, tester et implémenter les services et solutions cloud AWS.
- Fournir des conseils et des connaissances aux autres membres de l'équipe, et promouvoir l'efficacité, la productivité, les innovations et le partage des connaissances entre les équipes multifonctionnelles.
- Travailler en étroite collaboration avec les partenaires commerciaux internes pour recueillir les exigences, concevoir et implémenter des solutions, gérer les opérations techniques et trier et résoudre les problèmes opérationnels.
- Maintenir une documentation détaillée et précise sur les systèmes, les applications et l'infrastructure.
Support sur appel
- Participer à une rotation d'astreinte après les heures de travail pour la résolution d'incidents critiques.
Autres responsabilités
- Accomplir d'autres tâches connexes assignées par la direction.
Compétences comportementales
Souci de la sécurité : Identifier les situations dangereuses ou potentiellement dangereuses et prendre les mesures appropriées pour maintenir un environnement sûr pour soi et les autres.
Travail d'équipe : Travailler en collaboration avec d'autres pour atteindre les objectifs organisationnels.
Service aux passagers/clients : Fournir un excellent service aux clients internes et/ou externes (passagers).
Initiative : Gérer les situations et les problèmes de manière proactive et persistante, saisir les opportunités qui se présentent.
Orientation résultats : Concentrer les efforts sur l'obtention de résultats de haute qualité conformes aux normes de l'organisation.
Favoriser la communication : Écouter et communiquer ouvertement, honnêtement et respectueusement avec différents publics, promouvoir le dialogue et bâtir un consensus.
Qualifications
- Solide expérience des services AWS tels que EC2, S3, RDS, Lambda, CloudFormation et VPC.
- 5 ans et plus d'expérience en opérations d'infrastructure informatique avec un minimum de 3 ans d'expérience dans AWS.
- Maîtrise des outils d'automatisation (par exemple, AWS CLI, Terraform ou CloudFormation).
- Familiarité avec les outils de surveillance comme CloudWatch, Dynatrace.
- Expérience avec des langages de script tels que Python, PowerShell ou Bash.
- Expérience dans la mise en œuvre, le support et la surveillance des serveurs et des applications dans les environnements Windows et Linux.
- Expérience de l'intégration d'applications et de systèmes.
- Compréhension des pratiques ITIL et des processus de gestion du changement.
- Solides compétences en résolution de problèmes et capacité à travailler sous pression.
- Excellentes compétences en communication et en documentation.
- L'expérience avec DevOps, les pipelines CI/CD et la gestion de la configuration est un atout.
- Volonté de travailler des heures flexibles, y compris les heures après le travail et les rotations d'astreinte.
Lieu
Bureau du centre-ville de Toronto (250, rue Yonge) #LI-Hybrid
Description de l'entreprise
Depuis 2006, Porter Airlines a rehaussé l'expérience du transport aérien en classe économique pour chaque passager, offrant une hospitalité authentique avec style, soin et charme. La flotte de Porter, composée d'avions Embraer E195-E2 et De Havilland Dash 8-400, dessert l'Amérique du Nord, y compris un réseau canadien domestique d'un océan à l'autre, les États-Unis, le Mexique, les Caraïbes et l'Amérique centrale. Basée à Toronto, Porter est une compagnie aérienne officielle 4 étoiles® dans le World Airline Star Rating®. Visitez www.flyporter.com ou suivez @porterairlines sur Instagram, Facebook et X.
Détails
- Ville
- Toronto, Ontario
Besoin d'assistance?
- Courriel
- support@aerowork.ca
- Téléphone
- 1-450-403-4300