Progetto

Generale

Profilo

Azioni

Segnalazione #343

aperta

PRISM WARNING: Backup Commvault Commvault fallito su rs-st-sharp01-PSN02951008 (Job 14351526, errore [91:373])

Aggiunto da Marco Menichelli 18 giorni fa. Aggiornato 18 giorni fa.

Stato:
Nuovo
Priorità:
Normale
Assegnato a:
-
Inizio:
13-07-2026
Scadenza:
% Completato:

0%

Tempo stimato:

Descrizione

ALLERTA PREDITTIVA (LEONARDO ENGINE)
Severita Ricalcolata dall'AI: WARNING
Probabilita Impatto Ricalcolata: 78%
Time-to-Impact Stimato: 102 minuti

Soluzione / Procedura Operativa Prioritaria:

  • Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.
  • Tenete conto che l’attività di configurazione del nuovo satellite NON avrà impatti sul monitoraggio attuale, nel senso che lasceremo tutto come ora finchè il nuovo satellite non sarà pronto.
  • Dopodichè, riconfigureremo macchina per macchina l’agent icinga per puntare al nuovo satellite, quindi sospenderemo il monitoraggio di ogni singola macchina per pochi minuti.
  • Aprire il dettaglio del job Commvault e verificare Event Viewer/log del Job ID, client, subclient e MediaAgent coinvolti.
  • Verificare sul client protetto risorse, reboot/failover, connettivita verso CommCell/MediaAgent ed eventuali blocchi antivirus sul processo di controllo.

Step di Diagnosi ed Esecuzione:

  • Aprire in Commvault il dettaglio del 14351526 e verificare fase, stream, subclient, MediaAgent e log dell'agent sul client rs-st-sharp01-PSN02951008.
  • Sul client rs-st-sharp01-PSN02951008 verificare servizi dell'agent, raggiungibilita verso CommCell/MediaAgent, risorse e eventuale failover/reboot nel timeframe dell'alert.
  • Usare la query Datadog riportata sotto per aprire log/APM nello stesso timeframe e verificare se esistono errori sul servizio coinvolto.

Dati Datadog / Telemetry:

  • finestra analizzata: ultimi 180 minuti
  • chiavi evento usate per la ricerca: 14351526, rs-st-sharp01-PSN02951008, with, psnbckcmsdcac, 91:373, Convenzione, Strategico, Nazionale
  • topologia: No Datadog hosts matched target: 14351526,rs-st-sharp01-PSN02951008,with,psnbckcmsdcac
  • logs: 5 campioni pertinenti trovati. Query: "14351526" OR "rs-st-sharp01-PSN02951008" OR "with" OR "psnbckcmsdcac" OR "91:373" OR "Convenzione" OR "Strategico" OR "Nazionale"
  • 2026-07-13T00:54:05.655Z service=adarte-ticketing-accounting-notification status=info: from dstooffsbe with(nolock)
  • 2026-07-13T00:54:00.729Z service=adarte-cms-ms-prod status=info: 10.42.4.41 - - [13/Jul/2026:00:53:59 +0000] 'GET /cms-ms/api/public/cached/museum-with-e-ticketing/?page=1&page_size=12&ordering=denominazione&orderDir=asc&offers_ticketing=true&search=pantheon HTTP/1.1' GET '/cms-ms/api/public/cached/museum-with-e-ticketing/'
  • 2026-07-13T00:54:00.461Z service=adarte-cms-ms-prod status=info: 10.42.4.41 - - [13/Jul/2026:00:53:58 +0000] 'GET /cms-ms/api/public/cached/museum-with-e-ticketing?page=1&page_size=12&ordering=denominazione&orderDir=asc&offers_ticketing=true&search=pantheon HTTP/1.1' GET '/cms-ms/api/public/cached/museum-with-e-ticketing' '
  • 2026-07-13T00:53:55.971Z service=camunda-zeebe status=info: 2026-07-13 00:53:54.716 [Broker-1] [zb-fs-workers-1] [Exporter-2] WARN

Contesto Operativo:

  • I: Alert: Backup job failed Type: Job Management - Data Protection: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]

Previsione e Contesto (RAG + LLM):
Gli eventi indicano: Alert tecnico: Job ID 14351526; stato Failed; client rs-st-sharp01-PSN02951008; CommCell psnbckcmsdcac; errore [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.].

La memoria storica piu rilevante segnala: Le risorse da assegnare alla VM sono: 2 cpu, 8GB RAM e 50 GB hard disk, hostname e ip address secondo i vostri criteri.

Causa probabile da verificare: [2024-03-28 14:31] Da: Servizio Clienti di Assistenza Tecnica ...

Prima azione consigliata: Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.

Sistemi Coinvolti: ['Commvault / Data Protection', 'CommCell psnbckcmsdcac', 'rs-st-sharp01-PSN02951008', 'Virtual Server Instance vCloud Director', 'Adarte', 'Una', 'NetEye', 'Tenete']

ROOT CAUSE PROBABILE:

  • [2024-03-28 14:31] Da: Servizio Clienti di Assistenza Tecnica ...

Tracciato Deduttivo / Ricalibrazione:

  • Eventi correlati: 2; sorgenti: graph, mail.
  • Severita matematica/predittiva: WARNING con probabilita 78%.
  • Modelli verticali selezionati: dataset commvault backup disaster recovery, dataset terraform infrastructure as code, dataset prometheus e grafana.
  • Motore usato: qwen2.5-coder-0.5b-instruct-q8_0.gguf; LoRA: nessuno.

--- EVENTI ORIGINALI CHE HANNO SCATENATO L'ALLARME ---

--- ORIGINE: GRAPH ---
Oggetto: I: Alert: Backup job failed Type: Job Management - Data Protection
Mittente:
Dettaglio: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
--- ORIGINE: MAIL ---
Oggetto: I: Alert: Backup job failed Type: Job Management - Data Protection
Mittente:
Dettaglio: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]

--- MEMORIA STORICA UTILIZZATA (RAG) ---

  • Le risorse da assegnare alla VM sono: 2 cpu, 8GB RAM e 50 GB hard disk, hostname e ip address secondo i vostri criteri.
  • Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.
  • Dopodichè, riconfigureremo macchina per macchina l’agent icinga per puntare al nuovo satellite, quindi sospenderemo il monitoraggio di ogni singola macchina per pochi minuti.
  • Tenete conto che l’attività di configurazione del nuovo satellite NON avrà impatti sul monitoraggio attuale, nel senso che lasceremo tutto come ora finchè il nuovo satellite non sarà pronto.

--- PARERI ESPERTI VERTICALI ---

  • Nessun parere multi-esperto disponibile

--- MODELLI VERTICALI UTILIZZATI ---

  • dataset commvault backup disaster recovery (dataset, score=0.52, reason=semantic contrastive match)
  • dataset terraform infrastructure as code (dataset, score=0.35, reason=semantic contrastive match)
  • dataset prometheus e grafana (dataset, score=0.35, reason=semantic contrastive match)

Predictive Ticket generato da PRISM.AI - Leonardo ML Engine

Azioni #1

Aggiornato da Marco Menichelli 18 giorni fa

PRISM.AI - Evento duplicato correlato automaticamente al ticket gia aperto.
Ticket originario rilevato: #343
Severita evento: WARNING - Probabilita: 78%
Dettagli nuovo alert:

  • job_id: 14363323
  • status: Failed
  • client: rs-st-sharp01-PSN02951008
  • agent_type: Virtual Server Instance vCloud Director
  • backup_level: Full
  • commcell: psnbckcmsdcac
  • error_code: [91:373]
  • failure_reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
Azioni #2

Aggiornato da Marco Menichelli 18 giorni fa

PRISM.AI - Evento duplicato correlato automaticamente al ticket gia aperto.
Ticket originario rilevato: #343
Severita evento: WARNING - Probabilita: 73%
Dettagli nuovo alert:

  • job_id: 14365611
  • status: Failed
  • client: rs-st-sharp01-PSN02951008
  • agent_type: Virtual Server Instance vCloud Director
  • backup_level: Full
  • commcell: psnbckcmsdcac
  • error_code: [91:373]
  • failure_reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
Azioni

Esporta su Atom PDF