Un IBM i ben tenuto chiede poco, e questo è il suo pericolo: chiede così poco che ci si dimentica di guardarlo, e le cose che vanno storte lo fanno tutte insieme dopo anni di silenzio.
Questo capitolo è l'elenco delle cose da guardare quando non sta succedendo niente.
Le correzioni: le PTF
Le correzioni si chiamano PTF (Program Temporary Fix) e arrivano in tre forme: singole, raccolte in un pacchetto cumulativo, oppure raggruppate per area — Db2, HIPER, TCP/IP, Java, sicurezza. Le PTF di gruppo sono quelle che si seguono nella pratica, perché IBM le aggiorna periodicamente e ognuna ha un livello progressivo.
WRKPTFGRP
SELECT PTF_GROUP_NAME, PTF_GROUP_LEVEL, PTF_GROUP_STATUS
FROM QSYS2.GROUP_PTF_INFO
WHERE PTF_GROUP_STATUS <> 'NOT APPLICABLE'
Il livello va confrontato con quello corrente pubblicato da IBM: è il modo più rapido per sapere se un sistema è aggiornato o fermo da anni. Il gruppo di sicurezza merita un'attenzione a parte, perché è quello per cui il ritardo si paga più caro.
Nota
alcune PTF si applicano subito, altre sono differite e diventano attive solo al riavvio. È il motivo per cui una campagna di aggiornamento va pianificata insieme a un IPL, e per cui un sistema che non si riavvia mai può avere PTF caricate e non attive.
Il riavvio
Il riavvio si chiama IPL (Initial Program Load). Un IBM i può restare acceso per anni, e molti lo fanno; un riavvio periodico programmato resta comunque una buona pratica, perché attiva le PTF differite e riporta il sistema a uno stato pulito.
PWRDWNSYS OPTION(*CNTRLD) DELAY(600) RESTART(*YES)
Avvertenza
OPTION(*IMMED) spegne senza dare ai lavori il tempo di chiudere. Su un
sistema con lavori attivi è l'ultima risorsa, non la prima: *CNTRLD con un'attesa
adeguata lascia finire ciò che è a metà.
Chi conduce la macchina deve inoltre sapere due cose che vivono fuori dal sistema operativo: la modalità e il lato di IPL (A, B, C, D), impostati dal pannello o dalla console HMC. Il lato B è quello che parte con le PTF temporaneamente applicate, ed è il normale; il lato A quello senza. È una distinzione che si incontra la prima volta durante un ripristino, cioè nel momento sbagliato per scoprirla.
Lo spazio disco
Il numero da guardare è la percentuale di occupazione dell'ASP di sistema.
WRKSYSSTS
SELECT UNIT_NUMBER, UNIT_TYPE,
DEC(PERCENT_USED, 5, 1) AS PERCENTUALE
FROM QSYS2.SYSDISKSTAT
ORDER BY PERCENT_USED DESC
Sopra l'80% conviene intervenire, e ben prima del 90% è opportuno avere già una risposta pronta: il sistema si comporta male quando lo spazio finisce, e la soglia oltre la quale smette di funzionare del tutto non è un posto in cui si arriva volentieri.
Le cause, in ordine di frequenza: spool mai cancellato, journal receiver mai staccati, IFS cresciuto senza controllo, e librerie di collaudo dimenticate da un progetto finito tre anni fa.
I valori di sistema
Sono le impostazioni globali della macchina, alcune innocue e alcune decisive.
WRKSYSVAL
DSPSYSVAL SYSVAL(QSECURITY)
Quelli che vale la pena conoscere per nome sono già comparsi nei capitoli precedenti:
QSECURITY e QPWDLVL per la sicurezza, QSYSLIBL e QUSRLIBL per le liste librerie,
QPFRADJ per la memoria, QRCLSPLSTG per lo spool, QAUDCTL per la registrazione degli
eventi.
Consiglio
un elenco dei valori di sistema salvato una volta l'anno e confrontato con quello dell'anno prima è una forma di documentazione che costa cinque minuti. La domanda "chi ha cambiato questo, e quando" è fra le più frequenti e fra le più difficili da risolvere a posteriori.
Le schedulazioni
Il sistema ha uno schedulatore proprio:
WRKJOBSCDE
ADDJOBSCDE JOB(CHIUSURA) CMD(CALL PGM(PRODLIB/CHIUSURA)) +
FRQ(*MONTHLY) SCDDATE(*MONTHEND) SCDTIME(230000)
Avvertenza
una voce sospesa è la causa numero uno del "stanotte non è partito".
Qualcuno le ferma durante una manutenzione e nessuno le rilascia. Un controllo mattutino
che elenchi le voci sospese —
SELECT SCHEDULED_JOB_NAME, STATUS FROM QSYS2.SCHEDULED_JOB_INFO WHERE STATUS = 'HELD' —
costa mezz'ora di lavoro e chiude un'intera categoria di guasti.
Che cosa guardare, e ogni quanto
Non è una regola, è un punto di partenza ragionevole da adattare all'impianto.
| Quando | Che cosa |
|---|---|
| Ogni mattina | messaggi in QSYSOPR e QSYSMSG, esito dei batch notturni, voci di schedulazione sospese |
| Ogni settimana | spazio disco, esito dei salvataggi, job log dei lavori falliti |
| Ogni mese | livello dei gruppi di PTF, crescita di spool e IFS, profili fermi da tempo |
| Ogni anno | prova di ripristino, revisione dei profili con diritti speciali, confronto dei valori di sistema |
Consiglio
ognuna di queste voci è una query o un comando, e quasi tutte si possono far girare da sole e mandare per posta. Un controllo che qualcuno deve ricordarsi di fare è un controllo che, prima o poi, non viene fatto — e capita sempre nel mese in cui serviva.
Commenti
Nessun commento ancora. Sii il primo a commentare!
Devi avere un account per commentare. Accedi · Registrati