把mirror解掉,再从rootvg里面提出来,再用diag确认下,再用命令删掉hdisk1,更换

更换前的准备

1.查看报错日志。

执行errpt列出报错条目

IDENTIFIER TIMESTAMP T C RESOURCE_NAME  DESCRIPTION

A39F8A49   0611123015 T S syserrlg       ERROR LOGGING BUFFER OVERFLOW
B6267342   0611123015 P H hdisk0         DISK OPERATION ERROR
A39F8A49   0611123015 T S syserrlg       ERROR LOGGING BUFFER OVERFLOW

从上面的输出中找出对应的IDENTIFIER,查看报错详情:errpt
-aj B6267342|more

LABEL: SC_DISK_ERR2

IDENTIFIER: B6267342

Date/Time: Tue Oct 24 09:15:4

9 BEIST 2017

Sequence Number: 1510

Machine Id: 00C89B354C00

Node Id: DCBJLSFX04

Class: H

Type: PERM

Resource Name: hdisk0

Resource Class: disk

Resource Type: scsd

Location: U78A0.001.DNWHKW3-P2-D4

VPD:

Manufacturer................IBM

Machine Type and Model......ST3146356SS

FRU Number..................10N7204

ROS Level and ID............45363046

Serial Number...............3QN2WT58

EC Level....................D76038

Part Number.................10N7203

Device Specific.(Z0)........000005329F001002

Device Specific.(Z1)........0120E60F

Device Specific.(Z2)........0021

Device Specific.(Z3)........09347

Device Specific.(Z4)........

Device Specific.(Z5)........22

Device Specific.(Z6)........D76038

Description

DISK OPERATION ERROR

Probable Causes

DASD DEVICE

Failure Causes

DISK DRIVE

DISK DRIVE ELECTRONICS

Recommended Actions

PERFORM PROBLEM DETERMINATION PROCEDURES

Detail Data

PATH ID

0

SENSE DATA

0A00 2A00 0751 0B30 0000 4804 0000 0000 0000 0000 0000 0000 0102 0000 7000 0100

0000 0018 0000 0000 5D00 0800 0000 0000 015D 0008 FFFF FFFF FFFF 0000 0000 0000

0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000

0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000

0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000

0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000 0000

0000 0000 0000 0000 18C2 000B D900 0000 0000 0000 0000 0000 0000 0000 0083 0000

0000 0010 000D

Diagnostic Analysis

Diagnostic Log sequence number:    2049

Resource tested:    hdisk0

Resource Description:    SAS Disk Drive

Location:        U78A0.001.DNWHKW3-P2-D4

SRN:            2556-130

Description:        Error log analysis indicates problem reported by disk

drive's self monitoring function.

Possible FRUs:

hdisk0 FRU: 10N7204 U78A0.001.DNWHKW3-P2-D4

SAS Disk Drive

2.查看HDISK0的S/N,P/N号等,在换盘的时候做对照  lscfg
–vl hdisk0
  :

hdisk0U78A0.001.DNWHKW3-P2-D4 Other SCSI Disk Drive

Manufacturer................MAXTOR

Machine Type and Model......ATLAS10K5_73SCA

ROS Level and ID............4A4E5A48

Serial Number...............D210K4XK

Device Specific.(Z0)........000003025B00013E

Device Specific.(Z1)........

注意location号U78A0.001.DNWHKW3-P2-D4要与机器对应无误

3.确认原有的状态

显示一个卷组中的所有物理卷信息,名称,状态,和分区情况:lsvg -p rootvg

rootvg:

PV_NAME PV STATE TOTAL PPs FREE PPs FREE DISTRIBUTION

hdisk0 missing 548 503 109..100..75..109..110

hdisk1 active 548 503 109..100..75..109..110

#   lsvg -p rootvg
rootvg:
PV_NAME           PV STATE          TOTAL PPs   FREE PPs    FREE DISTRIBUTION
hdisk0            active            558         351         111..12..05..111..112
hdisk1            missing           558         351         111..17..00..111..112

# lsvg -p datavg
datavg:
PV_NAME           PV STATE          TOTAL PPs   FREE PPs    FREE DISTRIBUTION
hdisk2            active            558         157         112..00..00..00..45
hdisk3            active            558         157         111..00..00..00..46

确认镜像状态 lsvg -l rootvg

rootvg:

LV NAME TYPE LPs PPs PVs LV STATE MOUNT POINT

hd5 boot 1 2 2 closed/stale N/A

hd6 paging 8 16 2 open/syncd N/A

hd8 jfs2log 1 2 2 open/stale N/A

hd4 jfs2 2 4 2 open/stale /

hd2 jfs2 19 38 2 open/stale /usr

hd9var jfs2 5 10 2 open/stale /var

hd3 jfs2 1 2 2 open/stale /tmp

hd1 jfs2 1 2 2 open/stale /home

hd10opt jfs2 4 8 2 open/stale /opt

hd11admin jfs2 1 2 2 open/stale /admin

livedump jfs2 2 4 2 open/stale /var/adm/ras/livedump

注意LPs和PPs一定要为1:2

查看rootvg卷组的详细信息及状态:lsvg rootvg

VOLUME GROUP: rootvg VG IDENTIFIER: 00c57e5f00004c000000015f342b9397

VG STATE: active PP SIZE: 128 megabyte(s)

VG PERMISSION: read/write TOTAL PPs: 1096 (140288 megabytes)

MAX LVs: 256 FREE PPs: 1006 (128768 megabytes)

LVs: 11 USED PPs: 90 (11520 megabytes)

OPEN LVs: 10 QUORUM: 1 (Disabled)

TOTAL PVs: 2 VG DESCRIPTORS: 3

STALE PVs: 1 STALE PPs: 31

ACTIVE PVs: 1 AUTO ON: yes

MAX PPs per VG: 32512

MAX PPs per PV: 1016 MAX PVs: 32

LTG size (Dynamic): 128 kilobyte(s) AUTO SYNC: no

HOT SPARE: no BB POLICY: relocatable

PV RESTRICTION: none INFINITE RETRY: no

注意STALE PVs/PPs数量

4.迁移dump设备

因为原先系统在做镜像时,dump设备不会被镜像,所以现在要确定好dump设备的位置

如果在坏盘hdisk0上,此时应当迁移至hdisk1上。反之,如果在好盘hdisk1上,则无需此迁移步骤。

确认dump设备位置:lspv -l hdisk0,lspv -l hdisk1
hdisk0:
LV NAME               LPs     PPs     DISTRIBUTION          MOUNT POINT
hd6                   2       4       00..02..00..00..00    N/A
hd8                   1       2       00..00..01..00..00    N/A
hd5                   1       2       01..00..00..00..00    N/A
hd9var                4       8       00..00..04..00..00    /var
hd3                   16      32      00..00..16..00..00    /tmp
hd4                   8       16      00..00..08..00..00    /
hd2                   16      32     00..00..16..00..00    /usr
hd1                   4       8      00..00..04..00..00    /home
hd10opt               11      22      00..00..11..00..00    /opt
livedump              1      2       00..01..00..00..00    /var/adm/ras/livedump
lg_dumplv             4       4       00..04..00..00..00    N/A
hd11admin             1       2       00..00..01..00..00    /admin

在hdisk0上,须做迁移:migratepv -l lg_dumplv hdisk0 hdisk1

确认lg_dumplv已经迁移到hdisk1上:lspv -l hdisk1

把HDISK0从ROOTVG的镜像中移除 unmirrorvg
rootvg hdisk0  

0516-1246 rmlvcopy: If hd5 is the boot logical volume, please run 'chpv -c <diskname>'

as root user to clear the boot record and avoid a potential boot

off an old boot image that may reside on the disk from which this

logical volume is moved/removed.

0516-1804 chvg: The quorum change takes effect immediately.

0516-1144 unmirrorvg: rootvg successfully unmirrored, user should perform

bosboot of system to reinitialize boot records. Then, user must modify

bootlist to just include: hdisk1.

查看物理卷状态  lspv  rootvg

hdisk0 00c57e5fa8a95af5 rootvg active

hdisk1          00c3f435d0f4916c                    rootvg          active

查看pv上的逻辑卷状态(LPs和PPs的比例为1:1)lspv
-l hdisk1hdisk1:

LV NAME LPs PPs DISTRIBUTION MOUNT POINT

LV NAME               LPs     PPs     DISTRIBUTION          MOUNT POINT
hd6                   2       2       00..02..00..00..00    N/A
hd8                   1       1       00..00..01..00..00    N/A
hd5                   1       1       01..00..00..00..00    N/A
hd9var                4       4       00..00..04..00..00    /var
hd3                   16      16      00..00..16..00..00    /tmp
hd4                   8       8       00..00..08..00..00    /
hd2                   16      16      00..00..16..00..00    /usr
hd1                   4       4       00..00..04..00..00    /home
hd10opt               11      11      00..00..11..00..00    /opt
livedump              1       1       00..01..00..00..00    /var/adm/ras/livedump
lg_dumplv             4       4       00..04..00..00..00    N/A
hd11admin             1       1       00..00..01..00..00    /admin

这时HDISK0不再和HDISK1为MIRROR  ,把hdisk0从rootvg中去除  reducevg
rootvg hdisk0  

更换新硬盘

AIX上通过diag判定DISK位置

#diag 执行命令回车

选择黑色部分

用PgDn键翻页找到Hot plug Task回车

选择黑色部分,回车

继续选择黑色部分

选择想判定位置的目标DISK,比如:hdisk0

回车,这个时候去观察硬盘,你会发现硬盘的指示灯会显示"红色",这个硬盘就是你需要判定的目标盘。

如果想把这个有故障的硬盘从SCSI剔除,用F3返回上一级菜单选择"Replace/Remove
a Device Attached to an SCSI Hot Swap Enclosure Device"

光标移到hdisk0处,回车

然后拔掉故障磁盘,插上新的磁盘,执行cfgmgr –v,重新识别出新插的磁盘。

消除系统警告灯

选择黑色部分,回车

用Enter键选择黑色部分,在按F7或者Esc+7键commit

(这里再补充另一种删除硬盘的方法:reducevg后执行rmdev -dl hdisk0 但非常不推荐使用。具体步骤请自行百度)

重做镜像

确认新盘hdisk0是否有PVID:lspv 
rootvg

hdisk000c2f65fa4a27df5 none none

hdisk1          00c3f435d0f4916c                    rootvg          active

上面标红的即是。

如果没有,需要手动添加:chdev -l hdisk0 -a pv=yes

HDISK0出现后, 把HDISK0加到ROOTVG中

#extendvg rootvg hdisk0

做MIRROR  mirrorvg –S rootvg (也可执行mirrorvg
–c 2 rootvg 等待时间较长
)

0516-1804 chvg: The quorum change takes effect immediately.

0516-1126 mirrorvg: rootvg successfully mirrored, user should perform

bosboot of system to initialize boot records. Then, user must modify

bootlist to include: hdisk1 hdisk0.

查看PV  lspv  

Hdisk0          00x9k241k2l3811n                    rootvg          active

hdisk1          00c3f435d0f4916c                    rootvg          active

在HDISK0上创建boot image

bosboot –ad hdisk0  

bosboot: Boot image is 51228 512 byte blocks

先确认当前启动顺序bootlist –m normal -o

改变启动设备的顺序  bootlist –m normal hdisk0 hdisk1 cd0 

确认修改后的启动顺序bootlist –m normal -o

后续操作:在HMC上关闭事件,系统中执行errclear 0清空相关报错。

POWER 740硬盘更换步骤的更多相关文章

  1. DS4700电池更换步骤

    DS4700电池更换步骤: 在A控制器里操作(带电热插拔控制器)对逻辑盘进行切换: (需要先将A控下挂的硬盘手工切换到B控上.然后对A控进行电池更换,更换完成后再将原A控下挂硬盘切回) 如下详细步骤: ...

  2. 分布式存储ceph——(5)ceph osd故障硬盘更换

    正常状态:

  3. Ceph添加、删除osd及故障硬盘更换

    添加或删除osd均在ceph部署节点的cent用户下的ceph目录进行. 1. 添加osd 当前ceph集群中有如下osd,现在准备新添加osd: (1)选择一个osd节点,添加好新的硬盘: (2)显 ...

  4. 分布式存储ceph--osd故障硬盘更换(6)

    正常状态:

  5. Ceph osd故障硬盘更换

    正常状态: 故障状态: 实施更换步骤: (1)关闭ceph集群数据迁移: osd硬盘故障,状态变为down.在经过mod osd down out interval 设定的时间间隔后,ceph将其标记 ...

  6. 分布式存储ceph---ceph osd 故障硬盘更换(6)

    正常状态: 故障状态: 实施更换步骤: 1.关闭ceph集群数据迁移: osd硬盘故障,状态变为down.在经过mod osd down out interval 设定的时间间隔后,ceph将其标记为 ...

  7. UNIX故障--sun m4000服务器故障硬盘更换案例

    一.故障诊断 查看messages日志c0d0t0这块盘不断报错,类型为:retryable,如下: root@gdhx # more /var/adm/messages Aug  5 16:43:0 ...

  8. Oracle VM VirtualBox虚拟机内Linux系统硬盘扩容步骤(CentOS6.5)

    1.首先获取要扩容的虚拟机的 UUID VBoxManage 改命令在C:\Program Files\Oracle\VirtualBox目录内,可先添加该目录到环境变量.C:\Users\yzkj- ...

  9. win7系统查看硬盘序列号步骤

    1.在开始那里输入cmd,打开命令窗口: 2.输入diskpart,按enter键,进入底盘查看选项: 3.输入list disk,按回车键: list disk:查看电脑上有几块硬盘: 输入sele ...

随机推荐

  1. hive的常用函数工作总结

    1.concat_ws 它是一个特殊形式的 CONCAT() concat_ws(分隔符,参数1,参数2.......) as 字段 2.split 返回值为一个数组 a.基本用法: 例1:split ...

  2. OpenGL是什么?GPU是什么?

    一.GPU与CPU CPU是处理基本算数运算的单元:它处理的数据是数:整型.浮点型.bool等等: GPU是处理图形运算的单元:它处理的数据是图形的数据矩阵:   GPU的输入是一个和多个图形,输出是 ...

  3. 兰伯特余弦定理(Lambert)

    兰伯特余弦定理(Lambert) 1.漫反射,是投射在粗糙表面上的光向各个方向反射的现象.当一束平行的入射光线射到粗糙的表面时,表面会把光线向着四面八方反射,所以入射线虽然互相平行,由于各点的法线方向 ...

  4. 监听localStorage中的数据变化

    问题描述:我们在js里面获取了某一个localstorage的值,但是后期它可能改变了,我们js只执行一遍没办法再次获取它的值,当然可以刷新页面获取,但如果是我们的但页面就不能刷新页面了,此时:我们可 ...

  5. OpenCV应用(4)雄迈相机网络取图

    第一种办法 单张图获取 网页打开#//http://192.168.1.82/webcapture.jpg?command=snap&channel= 1 网页打开直接抓一张图 python ...

  6. C++ auto 完成类型自动推导与使用

    c++11 允许声明一个变量或对象(object)而不需要指明其类型,只需说明它是auto. 1.如: auto i = 42: //i是整型 double   f(); auto d=f(); // ...

  7. 第04组alpha冲刺(4/4)

    队名:斗地组 组长博客:地址 作业博客:Alpha冲刺(4/4) 各组员情况 林涛(组长) 过去两天完成了哪些任务: 1.分配展示任务 2.收集各个组员的进度 3.写博客 展示GitHub当日代码/文 ...

  8. Android Studio中每次打开工程Gradle sync龟速解决办法

    问题描述 自己使用android studio后,发现每次一打开工程,软件就在Grandle sync.sync就算了,而且这个步骤还必须过TZ,并且时间超级长,可能睡完觉起来还没有下载好.下面是正在 ...

  9. javaScript之DOM,BOM

    javaScript之BOM / DOM: BOM(Browser Object Model)是指浏览器对象模型,它使 JavaScript 有能力与浏览器进行"对话". DOM ...

  10. cesium地下模式(地表透明)2

    接上一篇博客,这篇直接分析火星的源码,看它到底改了些什么. 注意:在cesium1.63.1版本改变了模块化方式,由AMD改为ES6模块化.注意引入文件加载模块时做出对应修改. 1.火星代码里修改了4 ...