Segnalazione #343
apertaPRISM WARNING: Backup Commvault Commvault fallito su rs-st-sharp01-PSN02951008 (Job 14351526, errore [91:373])
0%
Descrizione
ALLERTA PREDITTIVA (LEONARDO ENGINE)
Severita Ricalcolata dall'AI: WARNING
Probabilita Impatto Ricalcolata: 78%
Time-to-Impact Stimato: 102 minuti
Soluzione / Procedura Operativa Prioritaria:
- Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.
- Tenete conto che l’attività di configurazione del nuovo satellite NON avrà impatti sul monitoraggio attuale, nel senso che lasceremo tutto come ora finchè il nuovo satellite non sarà pronto.
- Dopodichè, riconfigureremo macchina per macchina l’agent icinga per puntare al nuovo satellite, quindi sospenderemo il monitoraggio di ogni singola macchina per pochi minuti.
- Aprire il dettaglio del job Commvault e verificare Event Viewer/log del Job ID, client, subclient e MediaAgent coinvolti.
- Verificare sul client protetto risorse, reboot/failover, connettivita verso CommCell/MediaAgent ed eventuali blocchi antivirus sul processo di controllo.
Step di Diagnosi ed Esecuzione:
- Aprire in Commvault il dettaglio del 14351526 e verificare fase, stream, subclient, MediaAgent e log dell'agent sul client rs-st-sharp01-PSN02951008.
- Sul client rs-st-sharp01-PSN02951008 verificare servizi dell'agent, raggiungibilita verso CommCell/MediaAgent, risorse e eventuale failover/reboot nel timeframe dell'alert.
- Usare la query Datadog riportata sotto per aprire log/APM nello stesso timeframe e verificare se esistono errori sul servizio coinvolto.
Dati Datadog / Telemetry:
- finestra analizzata: ultimi 180 minuti
- chiavi evento usate per la ricerca: 14351526, rs-st-sharp01-PSN02951008, with, psnbckcmsdcac, 91:373, Convenzione, Strategico, Nazionale
- topologia: No Datadog hosts matched target: 14351526,rs-st-sharp01-PSN02951008,with,psnbckcmsdcac
- logs: 5 campioni pertinenti trovati. Query: "14351526" OR "rs-st-sharp01-PSN02951008" OR "with" OR "psnbckcmsdcac" OR "91:373" OR "Convenzione" OR "Strategico" OR "Nazionale"
- 2026-07-13T00:54:05.655Z service=adarte-ticketing-accounting-notification status=info: from dstooffsbe with(nolock)
- 2026-07-13T00:54:00.729Z service=adarte-cms-ms-prod status=info: 10.42.4.41 - - [13/Jul/2026:00:53:59 +0000] 'GET /cms-ms/api/public/cached/museum-with-e-ticketing/?page=1&page_size=12&ordering=denominazione&orderDir=asc&offers_ticketing=true&search=pantheon HTTP/1.1' GET '/cms-ms/api/public/cached/museum-with-e-ticketing/'
- 2026-07-13T00:54:00.461Z service=adarte-cms-ms-prod status=info: 10.42.4.41 - - [13/Jul/2026:00:53:58 +0000] 'GET /cms-ms/api/public/cached/museum-with-e-ticketing?page=1&page_size=12&ordering=denominazione&orderDir=asc&offers_ticketing=true&search=pantheon HTTP/1.1' GET '/cms-ms/api/public/cached/museum-with-e-ticketing' '
- 2026-07-13T00:53:55.971Z service=camunda-zeebe status=info: 2026-07-13 00:53:54.716 [Broker-1] [zb-fs-workers-1] [Exporter-2] WARN
Contesto Operativo:
- I: Alert: Backup job failed Type: Job Management - Data Protection: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
Previsione e Contesto (RAG + LLM):
Gli eventi indicano: Alert tecnico: Job ID 14351526; stato Failed; client rs-st-sharp01-PSN02951008; CommCell psnbckcmsdcac; errore [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.].
La memoria storica piu rilevante segnala: Le risorse da assegnare alla VM sono: 2 cpu, 8GB RAM e 50 GB hard disk, hostname e ip address secondo i vostri criteri.
Causa probabile da verificare: [2024-03-28 14:31] Da: Servizio Clienti di Assistenza Tecnica ...
Prima azione consigliata: Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.
Sistemi Coinvolti: ['Commvault / Data Protection', 'CommCell psnbckcmsdcac', 'rs-st-sharp01-PSN02951008', 'Virtual Server Instance vCloud Director', 'Adarte', 'Una', 'NetEye', 'Tenete']
ROOT CAUSE PROBABILE:
- [2024-03-28 14:31] Da: Servizio Clienti di Assistenza Tecnica ...
Tracciato Deduttivo / Ricalibrazione:
- Eventi correlati: 2; sorgenti: graph, mail.
- Severita matematica/predittiva: WARNING con probabilita 78%.
- Modelli verticali selezionati: dataset commvault backup disaster recovery, dataset terraform infrastructure as code, dataset prometheus e grafana.
- Motore usato: qwen2.5-coder-0.5b-instruct-q8_0.gguf; LoRA: nessuno.
--- EVENTI ORIGINALI CHE HANNO SCATENATO L'ALLARME ---
--- ORIGINE: GRAPH ---
Oggetto: I: Alert: Backup job failed Type: Job Management - Data Protection
Mittente: c.ragno@prismaprogetti.it
Dettaglio: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
--- ORIGINE: MAIL ---
Oggetto: I: Alert: Backup job failed Type: Job Management - Data Protection
Mittente: c.ragno@prismaprogetti.it
Dettaglio: Job ID: 14351526; stato: Failed; client: rs-st-sharp01-PSN02951008; agent: Virtual Server Instance vCloud Director; livello: Full; CommCell: psnbckcmsdcac; errore: [91:373]; failure reason: Could not connect to vCenter. [vCenter client with host name [vc01sudpsnwkld.industrystandard.psn.local] is not configured.]
--- MEMORIA STORICA UTILIZZATA (RAG) ---
- Le risorse da assegnare alla VM sono: 2 cpu, 8GB RAM e 50 GB hard disk, hostname e ip address secondo i vostri criteri.
- Una volta fatto il deploy, a noi basta poterla raggiungere via ssh per configurarla come satellite NetEye, attività che svolgeremo noi.
- Dopodichè, riconfigureremo macchina per macchina l’agent icinga per puntare al nuovo satellite, quindi sospenderemo il monitoraggio di ogni singola macchina per pochi minuti.
- Tenete conto che l’attività di configurazione del nuovo satellite NON avrà impatti sul monitoraggio attuale, nel senso che lasceremo tutto come ora finchè il nuovo satellite non sarà pronto.
--- PARERI ESPERTI VERTICALI ---
- Nessun parere multi-esperto disponibile
--- MODELLI VERTICALI UTILIZZATI ---
- dataset commvault backup disaster recovery (dataset, score=0.52, reason=semantic contrastive match)
- dataset terraform infrastructure as code (dataset, score=0.35, reason=semantic contrastive match)
- dataset prometheus e grafana (dataset, score=0.35, reason=semantic contrastive match)
Predictive Ticket generato da PRISM.AI - Leonardo ML Engine