mardi 20 septembre 2011

0516-1155 lors d'un rmlvcopy

Si on a perdu des disques dans un vg mirroré, et que ceux-ci ne sont pas récupérables, on doit retirer les copies sur les disques inexistants.
Si, pendant ces manipulations, on a le message

dasgbdprodb1_PSI:root / # lslv -l lvbdb1vg10058
0516-304 : Unable to find device id 00c5b0f4a07fcac0 in the Device
Configuration Database.
lvbdb1vg10058:/db-rman/dump
PVID COPIES IN BAND DISTRIBUTION
00c5b0f4a07fcac0 016:000:000 0% 000:000:000:008:008
hdisk3 016:000:000 0% 000:000:000:008:008

serveur:root / # rmlvcopy lvbdb1vg10058 1
0516-1155 lreducelv: Last good copy of a partition cannot reside on a missing disk.
Try again after reactivating the disk using chpv and varyonvg.
0516-922 rmlvcopy: Unable to remove logical partition copies from
logical volume lvbdb1vg10058.
Il faut préciser l’id du disque à enlever dans le rmdev (et s'il y a plusieurs disques perdus, il faut tous les préciser dans la même commande):
serveur:root / # rmlvcopy lvbdb1vg10058 1 00c5b0f4a07fcac0 00c28f5506f21797
0516-622 rmlvcopy: Warning, cannot write lv control block data.
serveur:root / # lslv -l lvbdb1vg10058
lvbdb1vg10058:/db-rman/dump
PV COPIES IN BAND DISTRIBUTION
hdisk3 016:000:000 0% 000:000:000:008:008

rendev : renommer un device

Il faut que le device soit non utilisé : 
hdisk22         00c28f552e09d55e                    None
danimproda1:root:/mksysb# rendev -l hdisk22 -n hdisk77
hdisk77
danimproda1:root:/mksysb# lspv
hdisk77         00c28f552e09d55e                    None

infos mksysb : lsmksysb

Pour récupérer des infos sur le contenu d’un mksysb :

danimproda1:root:/mksysb# lsmksysb -lf mksysb
VOLUME GROUP:           rootvg
BACKUP DATE/TIME:       Sun Sep 18 00:36:32 DFT 2011
UNAME INFO:             AIX serveurname 3 5 00035B08D700
BACKUP OSLEVEL:         5.3.9.0
MAINTENANCE LEVEL:      5300-09
BACKUP SIZE (MB):       58624
SHRINK SIZE (MB):       34746
VG DATA ONLY:           no

rootvg:
LV NAME             TYPE       LPs     PPs     PVs  LV STATE      MOUNT POINT
hd5                 boot       1       2       2    closed/syncd  N/A
hd6                 paging     48      96      2    open/syncd    N/A
paging00            paging     48      96      2    open/syncd    N/A
hd8                 jfslog     1       2       2    open/syncd    N/A
hd4                 jfs        2       4       2    open/syncd    /
hd2                 jfs        20      40      2    open/syncd    /usr
hd9var              jfs        13      26      2    open/syncd    /var
hd3                 jfs        32      64      2    open/syncd    /tmp
hd1                 jfs        1       2       2    open/syncd    /syshome
hd10opt             jfs        5       10      2    open/syncd    /opt
lvtrace             jfs        24      48      2    open/syncd    /tmp/trace
lvlocal             jfs        2       4       2    open/syncd    /usr/local
lg_dumplv           sysdump    10      10      1    open/syncd    N/A
lvsysload           jfs        8       16      2    open/syncd    /usr/local/sysload
lvpatrol            jfs        8       16      2    open/syncd    /usr/local/Patrol
lvecslocal          jfs        11      22      2    open/syncd    /usr/local/binairesECS
lppsource53         jfs        32      64      2    closed/syncd  /lppsource53/TL9_SP2
lv01                jfs        240     240     1    closed/syncd  /mksysb_dmz

samedi 21 mai 2011

kdb commands

En cours de rédaction 

escape k :
set 21 vi
infos générales :
stat
status
f ou runcpu f

cpu x     # pour changer de cpu
vmker |grep pgsp # (parametres paging)

locks : 

dla
lq

system lock :
Si dans le stack du dump on a :
[005006A0]slock+000480 (0000000000000000, F1000F0A10001500 [??])

slk
slk @31 (adresse de retour dans le registre 31)
ou

(0)> slk F1000F0A10001500
F1000F0A10001500 lock 0015002F
 thread_owner............ 0015002F @ pvthread+001500



(0) slk @r31



F1000F0A001035A8 lock 168800200015002F

thread_owner............ 0015002F @ pvthread+001500

(0) th pvthread+001500


SLOT NAME STATE TID PRI RQ CPUID CL WCHAN
pvthread+001500 21>vmmd RUN 15002F 010 0 0
NAME................ vmmd
FLAGS............... KTHREAD
WTYPE............... WCPU
.................tid :000000000015002F ......tsleep :FFFFFFFFFFFFFFFF
...............flags :00001000 ..............flags2 :00000000




(0) f 21
pvthread+001500 STACK:
[00187608]v_thread_reaffin_getthrd_cache+000208 (FFFFF1000FF47600 [??])
[001B30AC]get_thread_to_migrate+0001CC (??, ??)
[0018D540]vm_thread_reaffin_kproc+000200 (??)
[00264DD4]threadentry+000094 (??, ??, ??, ??)
[kdb_read_mem] no real storage @ FFFFFFFFFFF94F0


Threads en attente d'evenements :

th -w WLOCK

th -w WPGIN

vendredi 8 avril 2011

TRUE COPY avec PowerHA sur AIX en NPIV

En cours de rédaction 


True copy on AIX with NPIV :

  • Installation CCI + HACMP XD + option TC (j'ai été obligé de creer un fichier bidon pour l'install)
  • Le VG partagé doit etre en mode normal, et non en concurrent (c'est logique, mais il est important de le configurer tel quel)
  •  Une coupure entre les 2 sites, entraine une bascule des données sur le second site, alors meme que le premier continue la production. Il est impossible pour le cluster de faire la difference. Il est alors de la responsibilité de l'admin de repositionner la paire correctement (P-VOL / S-VOL). 
  • La ressource TC est configurée en AUTO, je n'ai pas trouvé d'autre moyen de la faire basculer lors d'une coupure de serveur.


testPSI1 :

/etc/horcm0.conf
HORCM_MON
#ip_address        service         poll(10ms)     timeout(10ms)
192.168.1.1     horcm0             1000            3000


HORCM_CMD
#UnitID 0 (LDEV# * Serial# 60011)
# \\.\CMD-numerodela baie- hdisk
#
\\.\CMD-18345:/dev/rhdisk7



HORCM_LDEV
#dev_group        dev_name        serial#          CU:LDEV(LDEV#)        MU#
testPSI1_TC       dev_C007           18345                C0:07

#test2_shadow      disk1           CL4-G                0          28         0
#

HORCM_INST
#dev_group        ip_address      service
testPSI1_TC       192.168.1.2         horcm0

testPSI2 :

/etc/horcm0.conf

HORCM_MON
#ip_address        service         poll(10ms)     timeout(10ms)
192.1687.1.2             horcm0          1000              3000


HORCM_CMD
#UnitID 0 (LDEV# * Serial# 60011)
# \\.\CMD-numerodela baie- CU lDEV en decimal
#
\\.\CMD-29511:/dev/rhdisk6



HORCM_LDEV
#dev_group        dev_name        serial#          CU:LDEV(LDEV#)        MU#
testPSI1_TC       dev_C007           29511                C0:07

#test2_shadow      disk1           CL4-G                0          28         0
#

HORCM_INST
#dev_group        ip_address      service
testPSI1_TC       192.168.1.2         horcm0


sur les 2 serveurs , dans /etc/services

horcm0   66666/udp


sur testPSI1 :

/opt/CCI/HORCM/usr/bin/horcmstart.sh 0

sur testPSI2 :

/opt/CCI/HORCM/usr/bin/horcmstart.sh 0

sur testPSI1 :


/opt/CCI/HORCM/usr/bin/pairdisplay -ITC0 -g testPSI1_TC -fcx

Group   PairVol(L/R) (Port#,TID, LU),Seq#,LDEV#.P/S,Status,Fence,   %,P-LDEV# M
testPSI1_TC     dev_C007(L) (CL7-K-1, 0,   5)18345  c007.P-VOL PAIR NEVER ,  100  c007 -
testPSI1_TC     dev_C007(R) (CL3-F-1, 0,   5)29511  c007.S-VOL PAIR NEVER ,  100  c007 –


lsdev -C -c disk | grep hdisk | /opt/CCI/HORCM/usr/bin/inqraid -CLI $PHY
DEVICE_FILE     PORT    SERIAL  LDEV CTG  H/M/12  SSID R:Group PRODUCT_ID
hdisk0          -            -     -   -       -     -       - VDASD
hdisk1          -            -     -   -       -     -       - VDASD
hdisk2          -            -     -   -       -     -       - VDASD
hdisk3          -            -     -   -       -     -       - VDASD
hdisk4          -            -     -   -       -     -       - VDASD
hdisk5          -            -     -   -       -     -       - VDASD
hdisk6          -            -     -   -       -     -       - VDASD
hdisk7          CL7-K    78787 49171   -       -  A3C0 A:00050 OPEN-V-CM
hdisk8          CL7-K    78787 49159   -  P/s/ss  A3C0 A:00050 OPEN-V

paircreate -ITC0 -g testPSI1_TC -d dev_34566 -vl -f never
pairdisplay -ITC0 -g testPSI1_TC -fe
pairsplit -ITC0 -g testPSI1_TC  -S (les 2 disques passent en simplex)


root:/root# pairdisplay -ITC0 -g testPSI1_TC -fcx
Group   PairVol(L/R) (Port#,TID, LU),Seq#,LDEV#.P/S,Status,Fence,   %,P-LDEV# M
testPSI1_TC     dev_34566(L) (CL1-J-1, 0,   7)55555  8706.P-VOL PSUE NEVER ,   99  8706 -
testPSI1_TC     dev_34566(R) (CL4-P-2, 0,   7)66666  8706.S-VOL PAIR NEVER ,  100  8706 -
root:/root# pairresync -ITC0 -g testPSI1_TC
root:/root# pairdisplay -ITC0 -g testPSI1_TC -fcx
Group   PairVol(L/R) (Port#,TID, LU),Seq#,LDEV#.P/S,Status,Fence,   %,P-LDEV# M
testPSI1_TC     dev_34566(L) (CL1-J-1, 0,   7)55555  8706.P-VOL COPY NEVER ,   99  8706 -
testPSI1_TC     dev_34566(R) (CL4-P-2, 0,   7)66666  8706.S-VOL COPY NEVER ,-----  8706 -
root:/root# pairdisplay -ITC0 -g testPSI1_TC -fcx
Group   PairVol(L/R) (Port#,TID, LU),Seq#,LDEV#.P/S,Status,Fence,   %,P-LDEV# M
testPSI1_TC     dev_34566(L) (CL1-J-1, 0,   7)55555  8706.P-VOL PAIR NEVER ,  100  8706 -
testPSI1_TC     dev_34566(R) (CL4-P-2, 0,   7)66666  8706.S-VOL PAIR NEVER ,  100  8706 -




mardi 22 mars 2011

Définir NPIV sur une partition

Sur la partition virtuelle : définir une patte FIBRE CHANNEL adapter  (avec le meme slot comme pour un scsi adapter)
Il faut installer le mpio/hdlm dans la partition et non plus dans le vio server.

Pour connaitre le wwn : manage profiles -> edit -> FC adapter -> properties

Dans le vio server :

vfcmap -vadapter vfhost0 -fcp fcs0  => pour activer npiv sur fcs0

lsmap -all -npiv
lsnports (pour montrer les ports pgysiques qui supportent NPIV)

ATTENTION : le wwn est regeneré a chaque fois que le VFC est créé. Il faut donc sauvegarder précieusement les profiles.

D'autre part, il ne faut ABSOLUMENT pas mettre les wwn des cartes 8go elles memes dans le zoning, mais bien le wwn généré dans  le profile de la partition.

Il semblerait, non testé, que si le profile de la partition est détruit, on perde le wwn, et du coup, les disques ne sont plus zonés correctement. Il faut donc sauvegarder rigoureusement tous les profiles (partition et Vioserver) dès la moindre modification.

Useful NPIV commands

 vfcmap -vadapter vfchostN -fcp fcsX

►  maps the virtual FC to the physical FC port

 vfcmap -vadapter vfchostN -fcp

►  un-maps the virtual FC from the physical FC port

 lsmap –all –npiv

►  shows the mapping of virtual and physical adapters and current status

 lsmap  –npiv –vadapter vfchostN

►shows same ofr one VFC

 lsdev -dev vfchost*

►  lists all available virtual Fibre Channel server adapters

 lsdev -dev fcs*

►  lists all available physical Fibre Channel server adapters

 lsdev –dev fcs*  -vpd

►  shows all physical FC adapter properties 

 lsnports

►  shows the Fibre Channel adapter NPIV readiness of the adapter and the SAN
switch.

 lscfg -vl fcsx

►  In AIX client lpar, shows virtual fibre channel properties

jeudi 17 février 2011

Booter sur un spot en mode debug

Passer le spot en mode debug :
nim -Fo check -a debug=yes spot_53_tl8

parametrer nim pour booter le serveur en mode maintenance :
nim -o maint_boot -a spot=spot_53_tl8 monserveur

booter le serveur en mode SMS et le faire booter en réseau sur l'adresse du serveur nim
Aller sur la console :
 (le serveur doit avoir booté en mode debug)

et taper :

mw enter_dbg
>42
>.
>g

... la suite est explicite...


Pour rebasculer le spot en mode normal :   nim -Fo check spot_53_tl8
Power on rapide d'une partition en ligne de commande :

Lister les Pseries :
lssyscfg -r sys -F name

Lister les partitions d'un pseries :
lssyscfg -m Nomdemonpseries -r lpar

Lister les caracteristiques d'une partition précise :
lssyscfg -m Nomdemonpseries -r lpar --filter "lpar_names=nomdemalpar"

Power on de la partition :
chsysstate -r lpar -m Nomdemonpseries -o on -n nomdemalpar  -f profile_du_profile_nomdemalpar -b normal

Ouverture d'un terminal : 
mkvterm -m Nomdemonpseries -p nomdemalpar