ClickHouse quitte pi3 pour pi1 : son volume y avait perdu son journal ext4 le 04/09, et Plausible n'écrivait plus rien
Helm Charts / Detect changed charts (pull_request) Successful in 1m1s
Helm Charts / Library charts tool (pull_request) Skipped
Helm Charts / Application charts alloy (pull_request) Skipped
Helm Charts / Application charts chart (pull_request) Skipped
Helm Charts / Application charts crowdsec (pull_request) Skipped
Helm Charts / Application charts grafana (pull_request) Skipped
Helm Charts / Application charts hashicorp-vault (pull_request) Skipped
Helm Charts / Application charts loki (pull_request) Skipped
Helm Charts / Application charts minio (pull_request) Skipped
Helm Charts / Application charts pgbouncer (pull_request) Skipped
Helm Charts / Application charts pgcat (pull_request) Skipped
Helm Charts / Application charts prometheus (pull_request) Skipped
Helm Charts / Application charts redis (pull_request) Skipped
Helm Charts / Detect changed charts (pull_request) Successful in 1m1s
Helm Charts / Library charts tool (pull_request) Skipped
Helm Charts / Application charts alloy (pull_request) Skipped
Helm Charts / Application charts chart (pull_request) Skipped
Helm Charts / Application charts crowdsec (pull_request) Skipped
Helm Charts / Application charts grafana (pull_request) Skipped
Helm Charts / Application charts hashicorp-vault (pull_request) Skipped
Helm Charts / Application charts loki (pull_request) Skipped
Helm Charts / Application charts minio (pull_request) Skipped
Helm Charts / Application charts pgbouncer (pull_request) Skipped
Helm Charts / Application charts pgcat (pull_request) Skipped
Helm Charts / Application charts prometheus (pull_request) Skipped
Helm Charts / Application charts redis (pull_request) Skipped
Le 04/09 à 02:42Z, ext4 a abandonné son journal sur le volume de ClickHouse, attaché sur pi3. Depuis, onze jours d'`Input/output error` sur les fusions et les lectures, et le migrateur de Plausible plante en init (CrashLoopBackOff, application ArgoCD `plausible` Degraded). Un redémarrage de conteneur ne démonte pas le volume. Préférence de poids 100 pour pi1, pi2 toujours exclu : recréé sur un autre nœud, le volume est détaché puis rattaché, et ext4 rejoue son journal. Refs arcodange-org/tools#53 Co-Authored-By: Claude Opus 5 <[email protected]>
This commit is contained in:
@@ -158,6 +158,15 @@ resources: {}
|
|||||||
# memory: 128Mi
|
# memory: 128Mi
|
||||||
|
|
||||||
# -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
|
# -- Pod-level affinity. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
|
||||||
|
#
|
||||||
|
# ⚠⚠ PRÉFÉRENCE FORTE POUR pi1 (incident arcodange-org/tools#53, 2026-09-15).
|
||||||
|
# Le 04/09 à 02:42Z, ext4 a abandonné son journal sur ce volume, alors attaché
|
||||||
|
# sur pi3 : onze jours d'`Input/output error`, et le migrateur de Plausible
|
||||||
|
# plante à la lecture. Un redémarrage de conteneur ne démonte pas le volume ;
|
||||||
|
# recréé sur le MÊME nœud, le pod pourrait reprendre le montage de staging
|
||||||
|
# mort. pi1 force détachement, rattachement et rejeu du journal — pi2 reste
|
||||||
|
# exclu tant que sa mémoire n'est pas soulagée (tools#52).
|
||||||
|
# Même remède que MinIO (#50) et Prometheus (#51).
|
||||||
affinity:
|
affinity:
|
||||||
nodeAffinity:
|
nodeAffinity:
|
||||||
requiredDuringSchedulingIgnoredDuringExecution:
|
requiredDuringSchedulingIgnoredDuringExecution:
|
||||||
@@ -167,6 +176,14 @@ affinity:
|
|||||||
operator: NotIn
|
operator: NotIn
|
||||||
values:
|
values:
|
||||||
- pi2
|
- pi2
|
||||||
|
preferredDuringSchedulingIgnoredDuringExecution:
|
||||||
|
- weight: 100
|
||||||
|
preference:
|
||||||
|
matchExpressions:
|
||||||
|
- key: kubernetes.io/hostname
|
||||||
|
operator: In
|
||||||
|
values:
|
||||||
|
- pi1
|
||||||
|
|
||||||
# -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
|
# -- Pod-level tolerations. More info [here](https://kubernetes.io/docs/reference/kubernetes-api/workload-resources/pod-v1/#scheduling).
|
||||||
tolerations: []
|
tolerations: []
|
||||||
|
|||||||
Reference in New Issue
Block a user