Progetto

Generale

Profilo

Azioni

Segnalazione #362

aperta

PRISM WARNING: non era questo che avevate risolto KubePersistentVolumeFillingUp 13/07/2026 09:53 dev logging P

Aggiunto da Marco Menichelli 14 giorni fa.

Stato:
Nuovo
Priorità:
Normale
Assegnato a:
-
Inizio:
17-07-2026
Scadenza:
% Completato:

0%

Tempo stimato:

Descrizione

Problema ed evidenze operative:

  • Teams message. non era questo che avevate risolto KubePersistentVolumeFillingUp 13/07/2026 09:53 dev logging PersistentVolume logging/storage-loki-stack-0 is over 90% full Resolved SI tolto log di grandi dimensioni e notificato RTI che un loro ms logga troppi dati

Soluzione / Procedura Operativa Prioritaria:
Fonte della procedura: diagnosi conservativa costruita sull'evidenza primaria disponibile.

  • Usare logging, storage-loki-stack-0 per cercare nello stesso timeframe log applicativi, trace APM e stato persistito del workflow, evitando ricerche generiche su tutto l'ambiente.
  • Ricostruire in ordine le transizioni del workflow dall'ingresso alla risposta finale e individuare la prima transizione assente, fallita o rimasta in stato intermedio.
  • Riprodurre una sola volta il caso in ambiente controllato acquisendo correlation/trace id, richiesta, risposta e tempi di ciascuna dipendenza.
  • Applicare retry, replay o correzione dati soltanto dopo aver verificato idempotenza e stato corrente, quindi eseguire una prova funzionale end-to-end con lo stesso percorso.

Step di Diagnosi ed Esecuzione:

  • Usare la query Datadog riportata sotto per aprire log/APM nello stesso timeframe e verificare se esistono errori sul servizio coinvolto.

Dati Datadog / Telemetry:

  • finestra analizzata: ultimi 180 minuti
  • chiavi evento usate per la ricerca: storage-loki-stack-0
  • topologia: No Datadog hosts matched target: storage-loki-stack-0
  • logs: 5 campioni pertinenti trovati. Query: "storage-loki-stack-0"
  • 2026-07-17T07:03:41.522Z service=loki-stack-promtail status=info anchor=storage-loki-stack-0: level=info ts=2026-07-17T07:03:40.674403262Z caller=filetargetmanager.go:397 msg="Removing target" key="/var/log/pods/338c4dd1-1d08-42de-8ec3-bfcf6862c61e/datadog-lib-php-init/.log:{app="cv-backup-admin", container="datadog-lib-php-init", job="logging/c
  • 2026-07-17T07:03:41.522Z service=loki-stack-promtail status=info anchor=storage-loki-stack-0: level=info ts=2026-07-17T07:03:40.674391284Z caller=filetargetmanager.go:397 msg="Removing target" key="/var/log/pods/338c4dd1-1d08-42de-8ec3-bfcf6862c61e/cvcontainer/.log:{app="cv-backup-admin", container="cvcontainer", job="logging/cv-backup-admin",

Diagnosi corrente / Root cause:
Causa non ancora dimostrata; le ipotesi sotto sono ordinate e richiedono verifica tecnica.

  • Root cause non determinabile con le sole evidenze ricevute. Il sintomo osservato e: non era questo che avevate risolto KubePersistentVolumeFillingUp 13/07/2026 09:53 dev logging PersistentVolume logging/storage-loki-stack-0 is over 90% full Resolved SI tolto log di grandi dimensioni e notificato RTI che un loro ms logga troppi dati. La diagnosi deve identificare la prima transizione tecnica fallita nel workflow e confermarla con log, trace o stato persistito prima di attribuire la causa a un componente.

Dati necessari per conferma/chiusura:

  • Confermare workflow riproducibile, utenti/operazioni impattati, orario di inizio e ultimo esito corretto noto.
  • Registrare l'esito dei comandi, la correzione applicata e una prova funzionale positiva prima della chiusura.

Nessun dato disponibile

Azioni

Esporta su Atom PDF