Site Reliability Engineer - eFX/ Crypto
- Type de contrat
- Temps plein
- Lieu
- Gland
- Première publication
Description de l'entreprise ##
Chez Swissquote, nous sommes à fond.
À fond pour bousculer les choses. À fond pour construire la banque que les gens veulent vraiment utiliser. À fond pour rendre la finance moins ennuyeuse - et beaucoup plus puissante.
Nous sommes la principale banque numérique de Suisse - plus de 1 400 personnes à travers l'Europe, le Moyen-Orient et l'Asie, construisant de véritables solutions financières pour plus d'un million de clients dans le monde. Du trading et de l'investissement aux opérations bancaires quotidiennes, nous couvrons tout le spectre. Nous allons vite, mais nous construisons des choses dont nous sommes véritablement fiers. Jetez un coup d'œil dans les coulisses en consultant Humans of Swissquote sur Instagram.
Une croissance rapide crée de l'espace. De l'espace pour essayer des choses, s'approprier des projets et évoluer à un rythme que la plupart des endroits ne peuvent pas offrir. Que vous aimiez être sous les projecteurs ou que vous préfériez simplement vous concentrer sur votre travail pour accomplir de grandes choses, il y a de la place pour les deux ici.
Nous avons abandonné le code vestimentaire - mais jamais l'occasion de célébrer. Victoire majeure ou petite, nous la marquons. Le genre d'endroit où l'atmosphère se crée d'elle-même.
En tant qu'employeur garantissant l'égalité des chances, nous accueillons des candidats de tous horizons, expériences et perspectives pour rejoindre notre équipe et contribuer à notre succès commun.
Vous le sentez ? C'est un bon début. Postulez.
Description du poste ##
Nous recherchons un Site Reliability Engineer (SRE) pragmatique pour aider à assurer la fiabilité, la disponibilité, l'évolutivité et la performance de nos plateformes de production eFX/Crypto.
Le rôle est fortement axé sur Kubernetes, les opérations de production, l'automatisation, l'observabilité et la fiabilité de l'infrastructure. Vous travaillerez en étroite collaboration avec les ingénieurs Infrastructure et Développement pour exploiter et améliorer continuellement notre environnement de production sur les infrastructures on-premise et le cloud privé.
Responsabilités clés
• Surveiller les systèmes de production, répondre aux incidents et assurer une disponibilité et des performances optimales des applications et de l'infrastructure.
• Exploiter, maintenir et dépanner les clusters Kubernetes et les applications conteneurisées en production, ainsi que l'infrastructure on-premise.
• Contribuer à la conception et à la mise en œuvre de solutions d'infrastructure évolutives et fiables.
• Automatiser les processus informatiques et opérationnels pour réduire le travail manuel et améliorer l'efficacité.
• Mettre en œuvre et maintenir les pipelines CI/CD et l'automatisation du déploiement.
• Surveiller et améliorer l'observabilité du système à l'aide d'outils tels que Prometheus, Grafana et Elastic/Kibana.
• Analyser les défaillances, effectuer des analyses de cause racine et mettre en œuvre des actions correctives et préventives.
• Effectuer des tests de stress, de résilience, de reprise après sinistre et de BCP pour valider la stabilité de la plateforme.
• Travailler en étroite collaboration avec les équipes Infrastructure et Développement pour améliorer la préparation à la production et la fiabilité du système.
• Participer à la rotation d'astreinte et fournir un support opérationnel pour les systèmes de production.
• Améliorer continuellement les processus opérationnels, l'automatisation, la surveillance et les pratiques de fiabilité.
Qualifications ##
• Plus de 3 ans d'expérience en SRE, DevOps, ingénierie système, ingénierie de plateforme ou un rôle similaire d'ingénierie de production.
• Solide expérience pratique de Kubernetes dans des environnements de production - obligatoire.
• Bonne compréhension de l'architecture Kubernetes et des opérations quotidiennes, incluant :
• Service mesh et Istio
• Gestion des utilisateurs
• Health checks et probes
• Réseautage Kubernetes et DNS
• Dépannage et problèmes de performance
• Compétences en administration Linux et dépannage.
• Expérience avec Docker et les technologies de conteneurisation.
• Expérience pratique de l'infrastructure on-premise et/ou des environnements de cloud privé.
• Expérience avec Infrastructure as Code et les outils d'automatisation tels que Terraform et Ansible.
• Expérience avec les pipelines CI/CD.
• Expérience avec les outils d'observabilité et de surveillance tels que Prometheus, Grafana, Elastic/Kibana.
• Bonnes compétences en programmation et scripting en Python et Shell.
• Bonne compréhension des fondamentaux du réseau, incluant TCP/IP, DNS, HTTPS, HTTP et l'équilibrage de charge.
• Bonne compréhension des principes SRE, incluant les SLIs, SLOs, SLAs, la disponibilité, la fiabilité et la performance du service.
• Bonne compréhension des applications web Java et des serveurs web tels que Spring Boot et Apache Tomcat.
• Anglais courant, à l'écrit comme à l'oral, avec la volonté d'apprendre le français.
Les plus (Nice to Have)
• Certification CKA ou CKAD.
• Expérience avec Helm, ArgoCD, Github Actions, ou les Kubernetes operators.
• Connaissance d'Apache Kafka ou RabbitMQ.
• Connaissance de MT4/MT5.
• Expérience avec Windows Server 2016/2022.
• Expérience dans l'eFX, le trading, la cryptomonnaie, la banque ou d'autres services financiers.
• Expérience de travail avec des systèmes de production à haute disponibilité ou à faible latence.
Qui vous êtes :
• Un esprit d'équipe qui aime aider ses collègues et créer des ponts entre les départements,
• Soucieux du détail et méticuleux dans votre travail,
• Maîtrise de l'anglais (parlé et écrit) et volonté d'apprendre le français.
• Passionné par la technologie et désireux de rester à jour sur les innovations de l'IA.
Traduit automatiquement depuis l’original.
Publié il y a 2 jours