Amministrare un AS/400: come funziona il sistema Capitolo 10 di 10

La manutenzione ordinaria

Rivista il Verificata su IBM i 7.5

Accedi per salvare

Un IBM i ben tenuto chiede poco, e questo è il suo pericolo: chiede così poco che ci si dimentica di guardarlo, e le cose che vanno storte lo fanno tutte insieme dopo anni di silenzio.

Questo capitolo è l'elenco delle cose da guardare quando non sta succedendo niente.

Le correzioni: le PTF

Le correzioni si chiamano PTF (Program Temporary Fix) e arrivano in tre forme: singole, raccolte in un pacchetto cumulativo, oppure raggruppate per area — Db2, HIPER, TCP/IP, Java, sicurezza. Le PTF di gruppo sono quelle che si seguono nella pratica, perché IBM le aggiorna periodicamente e ognuna ha un livello progressivo.

WRKPTFGRP
SELECT PTF_GROUP_NAME, PTF_GROUP_LEVEL, PTF_GROUP_STATUS
  FROM QSYS2.GROUP_PTF_INFO
 WHERE PTF_GROUP_STATUS <> 'NOT APPLICABLE'

Il livello va confrontato con quello corrente pubblicato da IBM: è il modo più rapido per sapere se un sistema è aggiornato o fermo da anni. Il gruppo di sicurezza merita un'attenzione a parte, perché è quello per cui il ritardo si paga più caro.

Nota

alcune PTF si applicano subito, altre sono differite e diventano attive solo al riavvio. È il motivo per cui una campagna di aggiornamento va pianificata insieme a un IPL, e per cui un sistema che non si riavvia mai può avere PTF caricate e non attive.

Il riavvio

Il riavvio si chiama IPL (Initial Program Load). Un IBM i può restare acceso per anni, e molti lo fanno; un riavvio periodico programmato resta comunque una buona pratica, perché attiva le PTF differite e riporta il sistema a uno stato pulito.

PWRDWNSYS OPTION(*CNTRLD) DELAY(600) RESTART(*YES)

Avvertenza

OPTION(*IMMED) spegne senza dare ai lavori il tempo di chiudere. Su un sistema con lavori attivi è l'ultima risorsa, non la prima: *CNTRLD con un'attesa adeguata lascia finire ciò che è a metà.

Chi conduce la macchina deve inoltre sapere due cose che vivono fuori dal sistema operativo: la modalità e il lato di IPL (A, B, C, D), impostati dal pannello o dalla console HMC. Il lato B è quello che parte con le PTF temporaneamente applicate, ed è il normale; il lato A quello senza. È una distinzione che si incontra la prima volta durante un ripristino, cioè nel momento sbagliato per scoprirla.

Lo spazio disco

Il numero da guardare è la percentuale di occupazione dell'ASP di sistema.

WRKSYSSTS
SELECT UNIT_NUMBER, UNIT_TYPE,
       DEC(PERCENT_USED, 5, 1) AS PERCENTUALE
  FROM QSYS2.SYSDISKSTAT
 ORDER BY PERCENT_USED DESC

Sopra l'80% conviene intervenire, e ben prima del 90% è opportuno avere già una risposta pronta: il sistema si comporta male quando lo spazio finisce, e la soglia oltre la quale smette di funzionare del tutto non è un posto in cui si arriva volentieri.

Le cause, in ordine di frequenza: spool mai cancellato, journal receiver mai staccati, IFS cresciuto senza controllo, e librerie di collaudo dimenticate da un progetto finito tre anni fa.

I valori di sistema

Sono le impostazioni globali della macchina, alcune innocue e alcune decisive.

WRKSYSVAL
DSPSYSVAL SYSVAL(QSECURITY)

Quelli che vale la pena conoscere per nome sono già comparsi nei capitoli precedenti: QSECURITY e QPWDLVL per la sicurezza, QSYSLIBL e QUSRLIBL per le liste librerie, QPFRADJ per la memoria, QRCLSPLSTG per lo spool, QAUDCTL per la registrazione degli eventi.

Consiglio

un elenco dei valori di sistema salvato una volta l'anno e confrontato con quello dell'anno prima è una forma di documentazione che costa cinque minuti. La domanda "chi ha cambiato questo, e quando" è fra le più frequenti e fra le più difficili da risolvere a posteriori.

Le schedulazioni

Il sistema ha uno schedulatore proprio:

WRKJOBSCDE
ADDJOBSCDE JOB(CHIUSURA) CMD(CALL PGM(PRODLIB/CHIUSURA)) +
           FRQ(*MONTHLY) SCDDATE(*MONTHEND) SCDTIME(230000)

Avvertenza

una voce sospesa è la causa numero uno del "stanotte non è partito". Qualcuno le ferma durante una manutenzione e nessuno le rilascia. Un controllo mattutino che elenchi le voci sospese — SELECT SCHEDULED_JOB_NAME, STATUS FROM QSYS2.SCHEDULED_JOB_INFO WHERE STATUS = 'HELD' — costa mezz'ora di lavoro e chiude un'intera categoria di guasti.

Che cosa guardare, e ogni quanto

Non è una regola, è un punto di partenza ragionevole da adattare all'impianto.

Quando Che cosa
Ogni mattina messaggi in QSYSOPR e QSYSMSG, esito dei batch notturni, voci di schedulazione sospese
Ogni settimana spazio disco, esito dei salvataggi, job log dei lavori falliti
Ogni mese livello dei gruppi di PTF, crescita di spool e IFS, profili fermi da tempo
Ogni anno prova di ripristino, revisione dei profili con diritti speciali, confronto dei valori di sistema

Consiglio

ognuna di queste voci è una query o un comando, e quasi tutte si possono far girare da sole e mandare per posta. Un controllo che qualcuno deve ricordarsi di fare è un controllo che, prima o poi, non viene fatto — e capita sempre nel mese in cui serviva.

Torna all'indice della guida

← Torna al blog

Commenti

Nessun commento ancora. Sii il primo a commentare!

Devi avere un account per commentare. Accedi · Registrati