ClickHouse quitte pi3 pour pi1 : son volume y avait perdu son journal ext4 le 04/09, et Plausible n'écrivait plus rien
Helm Charts / Detect changed charts (pull_request) Successful in 1m1s
Helm Charts / Library charts tool (pull_request) Skipped
Helm Charts / Application charts alloy (pull_request) Skipped
Helm Charts / Application charts chart (pull_request) Skipped
Helm Charts / Application charts crowdsec (pull_request) Skipped
Helm Charts / Application charts grafana (pull_request) Skipped
Helm Charts / Application charts hashicorp-vault (pull_request) Skipped
Helm Charts / Application charts loki (pull_request) Skipped
Helm Charts / Application charts minio (pull_request) Skipped
Helm Charts / Application charts pgbouncer (pull_request) Skipped
Helm Charts / Application charts pgcat (pull_request) Skipped
Helm Charts / Application charts prometheus (pull_request) Skipped
Helm Charts / Application charts redis (pull_request) Skipped

Le 04/09 à 02:42Z, ext4 a abandonné son journal sur le volume de
ClickHouse, attaché sur pi3. Depuis, onze jours d'`Input/output error`
sur les fusions et les lectures, et le migrateur de Plausible plante en
init (CrashLoopBackOff, application ArgoCD `plausible` Degraded). Un
redémarrage de conteneur ne démonte pas le volume.

Préférence de poids 100 pour pi1, pi2 toujours exclu : recréé sur un
autre nœud, le volume est détaché puis rattaché, et ext4 rejoue son
journal.

Refs arcodange-org/tools#53

Co-Authored-By: Claude Opus 5 <[email protected]>
This commit is contained in:
2026-09-15 12:15:23 +02:00
co-authored by Claude Opus 5
parent e64d708565
commit ed377299bd
+17
View File
@@ -158,6 +158,15 @@ resources: {}
# memory: 128Mi # memory: 128Mi
# -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling). # -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
#
# ⚠⚠ PRÉFÉRENCE FORTE POUR pi1 (incident arcodange-org/tools#53, 2026-09-15).
# Le 04/09 à 02:42Z, ext4 a abandonné son journal sur ce volume, alors attaché
# sur pi3 : onze jours d'`Input/output error`, et le migrateur de Plausible
# plante à la lecture. Un redémarrage de conteneur ne démonte pas le volume ;
# recréé sur le MÊME nœud, le pod pourrait reprendre le montage de staging
# mort. pi1 force détachement, rattachement et rejeu du journal — pi2 reste
# exclu tant que sa mémoire n'est pas soulagée (tools#52).
# Même remède que MinIO (#50) et Prometheus (#51).
affinity: affinity:
nodeAffinity: nodeAffinity:
requiredDuringSchedulingIgnoredDuringExecution: requiredDuringSchedulingIgnoredDuringExecution:
@@ -167,6 +176,14 @@ affinity:
operator: NotIn operator: NotIn
values: values:
- pi2 - pi2
preferredDuringSchedulingIgnoredDuringExecution:
- weight: 100
preference:
matchExpressions:
- key: kubernetes.io/hostname
operator: In
values:
- pi1
# -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling). # -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
tolerations: [] tolerations: []