VVR Rlink is getting disconnecting frequently
Darwin <[email protected]> Tue, 17 Apr 2012 12:15:00 +0530
| Newsgroups | gmane.os.solaris.managers |
|---|---|
| Message-ID | <CAJB2MDiytH7YSxJMuiAcRt=9CGT7b5O5+GXTAkOXdb1ynV=_=Q@mail.gmail.com> |
Hi Gurus, I have solaris 8 and veritas volume replicator running it, for the past few weeks Rlink is getting disconnecting frequently , The error message follows, Apr 9 01:30:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 160160 ms on (inet ce0) for group "ipmp0" Apr 9 01:30:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 80080 ms on (inet ce12) for group "ipmp0" Apr 9 01:30:31 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 40040 ms on (inet ce0) for group "ipmp0" Apr 9 01:30:33 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20020 ms on (inet ce0) for group "ipmp0" Apr 9 01:30:48 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20000 ms on (inet ce0) for group "ipmp0" Apr 9 16:12:12 prd01 sshd[1412]: [ID 800047 auth.error] error: Could not get shadow information for NOUSER Apr 9 21:28:41 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset (step) -0.709116 s Apr 10 01:37:38 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet requested failure detection time of 20000 ms on (inet ce12) new failure detection time for group "ipmp0" is 145978 ms Apr 10 01:38:40 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 72989 ms on (inet ce12) for group "ipmp0" Apr 10 01:38:40 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 36494 ms on (inet ce0) for group "ipmp0" Apr 10 01:38:42 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20000 ms on (inet ce12) for group "ipmp0" Apr 10 01:57:13 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet requested failure detection time of 20000 ms on (inet ce12) new failure detection time for group "ipmp0" is 164990 ms Apr 10 01:58:13 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 82495 ms on (inet ce12) for group "ipmp0" Apr 10 01:58:13 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 41247 ms on (inet ce0) for group "ipmp0" Apr 10 01:58:16 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20623 ms on (inet ce12) for group "ipmp0" Apr 10 01:58:17 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20000 ms on (inet ce0) for group "ipmp0" Apr 10 12:02:02 prd01 sendmail[1715]: [ID 801593 mail.crit] q3AB22h01696: SYSERR(applmgr): openmailer: insufficient privileges to change gid Apr 10 16:13:48 prd01 sshd[3856]: [ID 800047 auth.error] error: Could not get shadow information for NOUSER Apr 10 21:18:24 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset (step) -0.764464 s Apr 11 01:42:45 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet requested failure detection time of 20000 ms on (inet ce0) new failure detection time for group "ipmp0" is 100534 ms Apr 11 01:43:46 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 50267 ms on (inet ce0) for group "ipmp0" Apr 11 01:43:47 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 25133 ms on (inet ce0) for group "ipmp0" Apr 11 01:43:48 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20000 ms on (inet ce12) for group "ipmp0" Apr 11 02:33:22 prd01 in.mpathd[25]: [ID 585766 daemon.error] Cannot meet requested failure detection time of 20000 ms on (inet ce12) new failure detection time for group "ipmp0" is 187138 ms Apr 11 02:34:24 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 93569 ms on (inet ce12) for group "ipmp0" Apr 11 02:34:24 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 46784 ms on (inet ce0) for group "ipmp0" Apr 11 02:34:27 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 23392 ms on (inet ce12) for group "ipmp0" Apr 11 02:34:28 prd01 in.mpathd[25]: [ID 302819 daemon.error] Improved failure detection time 20000 ms on (inet ce0) for group "ipmp0" Apr 11 16:13:18 prd01 sshd[17767]: [ID 800047 auth.error] error: Could not get shadow information for NOUSER Apr 11 21:23:48 prd01 xntpd[2460]: [ID 774427 daemon.notice] time reset (step) -0.544919 s Apr 12 01:00:08 prd01 in.mpathd[25]: [ID 168056 daemon.error] All Interfaces in group ipmp0 have failed Apr 12 01:00:16 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 8 seconds Apr 12 01:00:17 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 9 seconds Apr 12 01:00:18 prd01 vxio: [ID 103721 kern.warning] WARNING: VxVM VVR vxio V-5-0-175 Heartbeat unacknowledged from node 10.2.134.27 for 10 seconds Apr 12 01:00:19 prd01 vxio: [ID 754354 kern.warning] WARNING: VxVM VVR vxio V-5-0-233 Node 10.2.134.26 disconnected from node 10.2.134.27 Apr 12 01:00:20 prd01 vxio: [ID 467919 kern.warning] WARNING: VxVM VVR vxio V-5-0-266 Rlink rlk_10.2.134.26_oraclervg disconnected from remote Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 237757 daemon.error] At least 1 interface (ce12) of group ipmp0 has repaired Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 299542 daemon.error] NIC repair detected on ce12 of group ipmp0 Apr 12 01:00:36 prd01 in.mpathd[25]: [ID 620804 daemon.error] Successfully failed back to NIC ce12 Apr 12 01:00:37 prd01 vxio: [ID 118803 kern.notice] NOTICE: VxVM VVR vxio V-5-0-91 Connected from node 10.2.134.26 to node 10.2.134.27 Apr 12 01:00:38 prd01 in.mpathd[25]: [ID 299542 daemon.error] NIC repair detected on ce0 of group ipmp0 Apr 12 01:00:38 prd01 in.mpathd[25]: [ID 620804 daemon.error] Successfully failed back to NIC ce0 Apr 12 01:00:39 prd01 vxio: [ID 490591 kern.notice] NOTICE: VxVM VVR vxio V-5-0-265 Rlink rlk_10.2.134.26_oraclervg connected to remote Apr 12 01:00:39 prd01 vxio: [ID 767624 kern.notice] NOTICE: VxVM VVR vxio V-5-0-0 Rvg oraclervg not doing secondary logging on rlink rlk_10.2.134.26_oraclervg