2025-10-09 - 2026-10-09
Overview
47 Pull requests merged by 1 user
Merged
#66 crowdsec — aspiration de la forge : l'agent était aveugle, deux scénarios la bannissent (24 h, portée Ip)
Merged
#65 fix(crowdsec) — urgence : la LAPI démarre sans l'API centrale, qui refuse notre instance (403)
Merged
#64 fix(crowdsec) — plus d'enrôlement au démarrage : un refus de la console éteignait tout *.arcodange.fr
Merged
#62 Prometheus : rotation à 7 jours et 5 Go
Merged
#60 MinIO quitte Longhorn pour le disque externe de pi1 (volume local, /mnt/arcodange/minio)
Merged
#57 fix(crowdsec) — CUSTOM_HOSTNAME par fieldRef : le value: de #56 ne passait pas l'apply
Merged
#56 fix(crowdsec) — nom de machine stable : 594 LAPI fantômes s'étaient entassées en base
Merged
#55 Plausible attend la fin de son démarrage et évite pi2 : il y était tué par sa sonde de vivacité avant d'avoir démarré
Merged
#54 ClickHouse quitte pi3 pour pi1 : son volume y avait perdu son journal ext4 le 04/09, et Plausible n'écrivait plus rien
Merged
#51 Prometheus quitte pi1 pour pi3 : son volume y avait perdu son journal ext4 le même jour que MinIO
Merged
#50 MinIO quitte pi2 : son volume y avait perdu son journal ext4, et aucun redémarrage ne le démontait
Merged
#47 La PriorityClass de Vault était refusée par l'AppProject, et toute l'app restait OutOfSync
Merged
#46 Vault est resté scellé onze jours en silence, et c'était le pod le plus faible du cluster
Merged
#45 Les sondes de Loki cessent d'exiger une réponse en une seconde d'un Raspberry Pi
Merged
#43 grafana et redis n'avaient pas de .helmignore, donc ils ne se publiaient pas
Merged
#40 Ce qu'un pod a dit lui survit — Loki et Alloy, sous plafond (#38)
Merged
#42 La publication du chart n'atteignait pas le registre, et ne pouvait pas le dire
Merged
#39 Un veilleur HORS de Prometheus — le silence de trois jours devient du bruit en ≤ 8 min
Merged
#35 minio_app : le compte de service peut refermer et abandonner un téléversement en parts (kadans#1033)
Merged
#32 MinIO tournait sans une seule sonde — trois jours de panne invisible
Merged
#30 feat(minio) — un téléversement abandonné laisse des parts que RIEN ne montre, et le plafond du tunnel est enfin mesuré
Merged
#29 fix(vault) — PDB pour les évictions volontaires, OnRootMismatch pour les remounts
Merged
#28 fix(redis) — il mourait toutes les 90 s, et c'est le .fr qui tombait
Merged
#25 fix(pgbouncer,vault) — ce qu'un client laisse sur une connexion, le suivant n'en hérite plus
Merged
#24 doc(réseau) — le confort LAN ne se règle pas dans Traefik : la mesure, les deux pièges, la voie retenue
Merged
#23 ci — arrêter les runs qui ne peuvent pas aboutir, et le doublon push+PR
Merged
#22 fix(minio) — le provisionneur ne pouvait pas créer de bucket : s3:ListBucket manquait
Merged
#21 feat(minio) — un compte de service par app consommatrice, borné à son bucket
Merged
#20 feat(minio) — exposer l'API S3 en HTTPS public (s3.arcodange.fr) + CORS de la PWA
Merged
#19 fix(minio) — déclarer minio dans la liste centrale des applications Vault
Merged
#18 feat(minio) — stockage objet S3 du homelab (brique partagée de tools)
Merged
#16 feat(grafana): exposer grafana.arcodange.fr via le tunnel Cloudflare (pattern kadans)
Merged
#15 feat(observabilité) — jobs d'analyse Kadans : scrape du worker laptop + dashboard Grafana
Merged
#14 feat(alerting): 5e règle homelab — CertificatNonRenouvele, le mode de panne du 24/07 au matin
Merged
#13 feat(alerting): groupe homelab — être prévenu sur Telegram quand (ou juste avant que) le lab tombe
Merged
#12 fix(alerting): alerte fiable sur l'échec de la vidéo quotidienne du brief
Merged
#11 feat(grafana): complète le dashboard de monitoring du pipeline prospection
Merged
#10 fix(alerting): VaultAuth Telegram exige vaultConnectionRef dans le ns tools
Merged
#9 feat(alerting): livraison Telegram des alertes via Alertmanager
Merged
#8 fix(grafana): startupProbe pour les migrations SQLite (CrashLoop au rollout)
Merged
#7 feat(monitoring): dashboard Grafana + alertes prospection
Merged
#6 feat(vault): onboard prospection (gitea_cicd role + ops policy)
Merged
#5 feat(vault): erp prod runtime may read the shared GCS backup creds (kv_read_paths)
Merged
#4 fix(vault): rename applications.policies → ops_policies (cms CI was silently missing its R2 policy)
Merged
#3 feat(multi-env): Phase D2 — Vault policies for erp-sandbox
Merged
#2 modules: Phase A of multi-env — add env/envs parameter to app_roles and app_policy
Merged
#1 🤖 ci(vault): declare dance-lessons-coach JWT role + ops policy
1 Pull request proposed by 1 user
Proposed
#63 Vault : le rôle CI de recodanse-infra (gitea_cicd_recodanse-infra)
3 Issues closed from 1 user
Closed
#49 Incident — MinIO de prod en CrashLoopBackOff depuis au moins 26 h (« drive is faulty », pi2) : aucune vidéo ne se sauvegarde ni ne se relit
Closed
#38 Aucune collecte de journaux dans le cluster — ce qu'un pod a dit avant de redémarrer est perdu
Closed
#36 Prometheus n'a rien enregistré pendant 3 jours, et rien ne pouvait le dire
16 Issues created by 1 user
Opened
#17 Creds Postgres dynamiques : les tables restent la propriété du rôle expiré → « permission denied » au pod suivant (kadans-api en CrashLoopBackOff)
Opened
#26 997 rôles éphémères survivent dans pg_roles, dont 262 encore connectables — la révocation Vault ne révoque rien
Opened
#27 Le filet de propriété ne rattrape que les TABLES — l'angle mort est déjà occupé (citext, pgcrypto)
Opened
#31 MinIO vivant mais cluster 503 — aucune vidéo ne peut plus être stockée NI relue
Opened
#33 DEUX classes de stockage sont marquées (default) — tout PVC sans storageClassName est non déterministe
Opened
#36 Prometheus n'a rien enregistré pendant 3 jours, et rien ne pouvait le dire
Opened
#37 Le bord refuse les requêtes HEAD vers le magasin — 403 là où MinIO répond 200
Opened
#38 Aucune collecte de journaux dans le cluster — ce qu'un pod a dit avant de redémarrer est perdu
Opened
#44 Après Loki : trois restes mesurés — l'app loki non adoptée par ArgoCD, une sonde à 1 s, et pi2 saturé
Opened
#48 Remplacer MinIO par SeaweedFS — cadrage : trois bancs mesurés sur le homelab, SeaweedFS contre MinIO à charge égale, et le MinIO de prod est EN PANNE
Opened
#49 Incident — MinIO de prod en CrashLoopBackOff depuis au moins 26 h (« drive is faulty », pi2) : aucune vidéo ne se sauvegarde ni ne se relit
Opened
#52 Mémoire de pi2 : 2,5 Gi pris par un démon de bureau (gvfs-udisks2) qui fuit depuis 154 jours — relevé et options chiffrées, rien d'appliqué
Opened
#53 ClickHouse (Plausible) écrit dans un volume au journal ext4 abandonné depuis le 04/09 : erreurs d'E/S en boucle — constat, rien de réparé
Opened
#58 Incident (3ᵉ récidive) — MinIO en CrashLoopBackOff ~22 h sur pi3 (« drive is faulty ») : envois de vidéos bloqués ; réparé par remontage le 24/09 09:02 UTC
Opened
#59 Prometheus : up vide n'est pas un défaut de scrutation. La configuration, le RBAC et la découverte sont sains ; c'est le stockage (récidive de #36)
Opened
#61 Traefik v3 coupe à 60 s tout envoi vers la forge : une grosse couche d'image ne passe plus quand pi2 écrit lentement