Technicien systèmes et réseaux — infrastructure, sauvegarde, supervision, sécurité
Poste ou mission en administration systèmes et réseaux, exploitation / SRE, support N2-N3 ou intégration d'infrastructure.
Profil
Je conçois, exploite et documente seul une infrastructure complète sur un seul mini-PC : virtualisation, sauvegarde testée, supervision avec alertes, sécurité périmétrique, gouvernance des changements et IA locale. Chaque affirmation de ce site renvoie à une mesure datée.
Missions visées et preuves
- Administrateur systèmes et réseaux — P-01 restauration réelle d'un conteneur, chronométrée, P-02 sauvegardes : primaire, copie, copie hors disque usb, P-10 interface d'administration joignable depuis internet, P-11 retrait propre d'un contrôleur de domaine active directory
- Exploitation / SRE — P-03 cibles de supervision joignables, P-04 changements de production clos par la chaîne de contrôle, P-05 contrôles de l'auto-audit quotidien conformes, P-08 incidents consignés avec leur classe et leurs signatures
- Support N2-N3 — P-08 incidents consignés avec leur classe et leurs signatures, P-13 détection d'une porte dérobée sur les comptes et accès
- Sécurité opérationnelle — P-10 interface d'administration joignable depuis internet, P-13 détection d'une porte dérobée sur les comptes et accès, P-09 horodatage tiers des preuves
- Automatisation et intégration IA — P-06 tests automatisés du moteur d'assistants multi-clients, P-12 questions pièges refusées par l'assistant recruteur, P-04 changements de production clos par la chaîne de contrôle
Compétences
- Systèmes
- Virtualisation Proxmox VE : VM, conteneurs, stockage, profils de démarrage · Sauvegarde et reprise (Proxmox Backup Server, rétention, vérification) · Linux (Debian), systemd, confinement des services · Windows Server, Active Directory : démotion propre, DNS, DHCP, Kerberos, LDAPS
- Réseau
- Pare-feu pfSense, segmentation, VPN WireGuard · Reverse proxy Traefik, TLS automatique, listes blanches d'administration
- Observabilité
- Prometheus, Grafana, Loki, alertes, sondes externes
- Exploitation
- Réponse à incident : diagnostic, hypothèses, correction, détecteur · Gestion du changement : sauvegarde, retour arrière, registre signé · Documentation : ADR, runbooks, PRA/PCA
- Support N2/N3
- Diagnostic : symptômes → hypothèses → test discriminant → correction → détecteur · Remise en service après arrêt brutal (VM, services, démons secondaires)
- Cybersécurité
- Détection et confinement d'une porte dérobée sans interruption de service · Réduction de surface : administration hors Internet, API publiques bornées
- Développement
- Python : services multi-clients, API, bancs de test · TypeScript / Next.js : site commercial, API bornées · Bash : automatisation, sondes, primitives de déploiement
- IA
- IA locale (Ollama), RAG (Qdrant), routage et relecture croisée entre modèles · Assistant sans hallucination par construction (RAG extractif, refus explicite)
Projets
- MORPHEUS — Infrastructure de production sur un mini-PC : virtualisation, sauvegarde testée, supervision, sécurité, gestion du changement, IA locale.
- x-files.fr — Site commercial Next.js avec API bornées, démonstrations réelles d'assistants et administration fermée à Internet.
- Moteur d'assistants multi-clients — Service Python : une base et une clé par client, quotas, banc d'isolation, 1 402 tests.
Incidents traités
- 2026-09-12 — Une porte dérobée fermée… et une remédiation qui a éteint 16 VM
- 2026-09-11 — La copie de sauvegarde était morte depuis 4 semaines, et l'alerte ne voyait rien
- 2026-09-23 — 39,6 heures sans alerte : quand la métrique disparaît
- 2026-09-23 — Un gel matériel dont la cause n'est pas prouvée, et c'est écrit
- 2026-09-24 — Deux déploiements du site en erreur 502, retour arrière en moins de 2 minutes
- 2026-09-24 — La porte dérobée est revenue : neuf jours sans alerte, puis un détecteur
Méthode
Une partie du code (scripts, sites, services) est produite avec des assistants IA — Claude, Codex et des modèles locaux — que je pilote. Mon travail : définir le besoin, découper, faire relire par une IA d'une autre famille, exiger un test ou une mesure avant d'accepter, déployer avec retour arrière et exploiter. Je le dis parce qu'un recruteur doit savoir ce qu'il évalue.