ClickHouse quitte pi3 pour pi1 : son volume y avait perdu son journal ext4 le 04/09, et Plausible n'écrivait plus rien #54

Merged
arcodange merged 1 commits from arcodange/incident-clickhouse into main 2026-09-15 12:17:06 +02:00
Showing only changes of commit ed377299bd - Show all commits
+17
View File
@@ -158,6 +158,15 @@ resources: {}
# memory: 128Mi # memory: 128Mi
# -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling). # -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
#
# ⚠⚠ PRÉFÉRENCE FORTE POUR pi1 (incident arcodange-org/tools#53, 2026-09-15).
# Le 04/09 à 02:42Z, ext4 a abandonné son journal sur ce volume, alors attaché
# sur pi3 : onze jours d'`Input/output error`, et le migrateur de Plausible
# plante à la lecture. Un redémarrage de conteneur ne démonte pas le volume ;
# recréé sur le MÊME nœud, le pod pourrait reprendre le montage de staging
# mort. pi1 force détachement, rattachement et rejeu du journal — pi2 reste
# exclu tant que sa mémoire n'est pas soulagée (tools#52).
# Même remède que MinIO (#50) et Prometheus (#51).
affinity: affinity:
nodeAffinity: nodeAffinity:
requiredDuringSchedulingIgnoredDuringExecution: requiredDuringSchedulingIgnoredDuringExecution:
@@ -167,6 +176,14 @@ affinity:
operator: NotIn operator: NotIn
values: values:
- pi2 - pi2
preferredDuringSchedulingIgnoredDuringExecution:
- weight: 100
preference:
matchExpressions:
- key: kubernetes.io/hostname
operator: In
values:
- pi1
# -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling). # -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
tolerations: [] tolerations: []