VVR Rlink is getting disconnecting frequently

Darwin <[email protected]> Tue, 17 Apr 2012 12:15:00 +0530
Newsgroups gmane.os.solaris.managers
Message-ID <CAJB2MDiytH7YSxJMuiAcRt=9CGT7b5O5+GXTAkOXdb1ynV=_=Q@mail.gmail.com>
Hi Gurus,

I have solaris 8 and veritas volume replicator running it, for the past few
weeks Rlink is getting disconnecting frequently , The error message
follows,



Apr 9 01:30:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 160160 ms on (inet ce0) for group "ipmp0"
Apr 9 01:30:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 80080 ms on (inet ce12) for group "ipmp0"
Apr 9 01:30:31 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 40040 ms on (inet ce0) for group "ipmp0"
Apr 9 01:30:33 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20020 ms on (inet ce0) for group "ipmp0"
Apr 9 01:30:48 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20000 ms on (inet ce0) for group "ipmp0"
Apr 9 16:12:12 prd01 sshd[1412]: [ID 800047 auth.error] error: Could not
get shadow information for NOUSER
Apr 9 21:28:41 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset
(step) -0.709116 s
Apr 10 01:37:38 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet
requested failure detection time of 20000 ms on (inet ce12) new failure
detection time for group "ipmp0" is 145978 ms
Apr 10 01:38:40 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 72989 ms on (inet ce12) for group "ipmp0"
Apr 10 01:38:40 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 36494 ms on (inet ce0) for group "ipmp0"
Apr 10 01:38:42 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20000 ms on (inet ce12) for group "ipmp0"
Apr 10 01:57:13 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet
requested failure detection time of 20000 ms on (inet ce12) new failure
detection time for group "ipmp0" is 164990 ms
Apr 10 01:58:13 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 82495 ms on (inet ce12) for group "ipmp0"
Apr 10 01:58:13 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 41247 ms on (inet ce0) for group "ipmp0"
Apr 10 01:58:16 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20623 ms on (inet ce12) for group "ipmp0"
Apr 10 01:58:17 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20000 ms on (inet ce0) for group "ipmp0"
Apr 10 12:02:02 prd01 sendmail[1715]: [ID 801593 mail.crit] q3AB22h01696:
SYSERR(applmgr): openmailer: insufficient privileges to change gid
Apr 10 16:13:48 prd01 sshd[3856]: [ID 800047 auth.error] error: Could not
get shadow information for NOUSER
Apr 10 21:18:24 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset
(step) -0.764464 s
Apr 11 01:42:45 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet
requested failure detection time of 20000 ms on (inet ce0) new failure
detection time for group "ipmp0" is 100534 ms
Apr 11 01:43:46 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 50267 ms on (inet ce0) for group "ipmp0"
Apr 11 01:43:47 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 25133 ms on (inet ce0) for group "ipmp0"
Apr 11 01:43:48 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20000 ms on (inet ce12) for group "ipmp0"
Apr 11 02:33:22 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet
requested failure detection time of 20000 ms on (inet ce12) new failure
detection time for group "ipmp0" is 187138 ms
Apr 11 02:34:24 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 93569 ms on (inet ce12) for group "ipmp0"
Apr 11 02:34:24 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 46784 ms on (inet ce0) for group "ipmp0"
Apr 11 02:34:27 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 23392 ms on (inet ce12) for group "ipmp0"
Apr 11 02:34:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved
failure detection time 20000 ms on (inet ce0) for group "ipmp0"
Apr 11 16:13:18 prd01 sshd[17767]: [ID 800047 auth.error] error: Could not
get shadow information for NOUSER
Apr 11 21:23:48 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset
(step) -0.544919 s
Apr 12 01:00:08 prd01 in.mpathd[25]: [ID 168056 daemon.error] All
Interfaces in group ipmp0 have failed
Apr 12 01:00:16 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio
V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 8 seconds
Apr 12 01:00:17 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio
V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 9 seconds
Apr 12 01:00:18 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio
V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 10 seconds
Apr 12 01:00:19 prd01 vxio: [ID 754354 kern.warning] WARNING: VxVM VVR vxio
V-5-0-233 Node 10.2.134.26 disconnected from node 10.2.134.27
Apr 12 01:00:20 prd01 vxio: [ID 467919 kern.warning] WARNING: VxVM VVR vxio
V-5-0-266 Rlink rlk_10.2.134.26_oraclervg disconnected from remote
Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 237757 daemon.error] At least 1
interface (ce12) of group ipmp0 has repaired
Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 299542 daemon.error] NIC repair
detected on ce12 of group ipmp0
Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 620804 daemon.error] Successfully
failed back to NIC ce12
Apr 12 01:00:37 prd01 vxio: [ID 118803 kern.notice] NOTICE: VxVM VVR vxio
V-5-0-91 Connected from node 10.2.134.26 to node 10.2.134.27
Apr 12 01:00:38 prd01 in.mpathd[25]: [ID 299542 daemon.error] NIC repair
detected on ce0 of group ipmp0
Apr 12 01:00:38 prd01 in.mpathd[25]: [ID 620804 daemon.error] Successfully
failed back to NIC ce0
Apr 12 01:00:39 prd01 vxio: [ID 490591 kern.notice] NOTICE: VxVM VVR vxio
V-5-0-265 Rlink rlk_10.2.134.26_oraclervg connected to remote
Apr 12 01:00:39 prd01 vxio: [ID 767624 kern.notice] NOTICE: VxVM VVR vxio
V-5-0-0 Rvg oraclervg not doing secondary logging on rlink
rlk_10.2.134.26_oraclervg