Djibril Faty
15 ans d'exploitation sur plateformes critiques (SLA, astreintes 24/7, incidents P1) et une spécialisation Cloud Native (Kubernetes, Terraform, GitOps, SRE). Positionné sur les transformations DevOps de contextes exigeants, notamment Cloud Souverain. J'apporte la culture de la fiabilité aux équipes qui industrialisent leurs pratiques.
Cloud Engineer / Site Reliability Engineer (SRE)
Mon approche
Ces trois valeurs guident mon travail au quotidien sur des environnements de production critiques.
Fiabilité & Disponibilité
15 ans à garantir la haute disponibilité et le Disaster Recovery de plateformes de production critiques : respect des SLA, astreintes 24/7 et gestion d'incidents P1, avec un haut niveau d'exigence sur la continuité de service.
Automatisation & SRE
Monitoring, logging et automatisation (Ansible, scripting) pour fiabiliser les opérations, avec une approche SRE de la gestion d'incidents.
Cloud Native & Souverain
Certifié AWS SysOps Administrator et spécialisé Cloud Souverain / SRE : Kubernetes, Terraform et GitOps pour industrialiser des plateformes fiables, y compris sur des infrastructures souveraines (OVH, Proxmox).
Compétences & Outils
Les technologies et outils que je maîtrise, issus de 15 ans d'exploitation en production et de ma spécialisation Cloud Souverain / SRE.
Cloud & Conteneurisation
Infrastructures cloud publiques et souveraines, virtualisation et orchestration de conteneurs, jusqu'au réseau Kubernetes.
AWS
OVH
Proxmox
Kubernetes
Helm
Docker
Ingress-NGINX
Traefik
cert-manager
Cilium
Infrastructure as Code & Automatisation
Provisionnement et configuration des infrastructures en code : reproductibles, versionnées et automatisées.
Terraform
Ansible
Python
Bash
CI/CD & GitOps
Pipelines d'intégration et de déploiement continus, déploiements GitOps, gestion centralisée des secrets et des images.
Git
GitLab CI/CD
GitHub Actions
ArgoCD
Vault
Harbor
Observabilité & SRE
Métriques, alerting et logs centralisés au service de la haute disponibilité, avec une gestion d'incidents rigoureuse jusqu'à l'analyse des causes racines.
Prometheus
Grafana
Alertmanager
Logging centralisé
Haute dispo & DR
RCA
Systèmes, Réseaux & Données
Administration Linux, fondamentaux réseau et stockage distribué, bloc et objet, pour Kubernetes.
Linux (RHEL)
TCP/IP & DNS
Load balancing
SSH / SFTP
Longhorn
MinIO
SeaweedFS
Mon parcours
15 ans d'expérience sur des plateformes de production critiques, de la formation d'ingénieur au Cloud Engineering.
Spécialisation Ingénieur Cloud Souverain / SRE
Programme intensif de 450 h orienté production : Kubernetes, Terraform, GitOps, observabilité, pratiques SRE et Cloud Souverain. Projet de synthèse d'un mois soutenu devant un jury professionnel.
Certification Cloud — AWS SysOps Administrator
Certification AWS SysOps Administrator, en complément de l'expertise Kubernetes, Terraform et Ansible acquise sur le terrain.
Ingénieur Exploitation & Support
Pilotage du support de plateformes Cloud (OVH, AWS), garantie de la fiabilité, de la haute disponibilité et du Disaster Recovery sur des comptes clients Big Data (géolocalisation, marketing contextuel, SMS Gateway), avec une approche SRE : monitoring, logging, automatisation et gestion des incidents.
Référent Technique Validation PFS
Intégration et validation de plateformes de services IPTV/VOD, tests d'interconnexion de bout en bout, automatisation des tests de non-régression et coordination des équipes internes et partenaires.
Contact
N'hésitez pas à me contacter pour toute question ou opportunité de collaboration.
linkedin.com/in/dfaty
Se connecter sur LinkedInEnvie de collaborer ?
Une question, un projet, ou simplement échanger sur le Cloud et la fiabilité des systèmes ? N'hésitez pas à me contacter.
Me contacter