Archive for the ‘03. 配置笔记’ Category.

ESX出现“在主机的当前连接状况下不允许执行该操作”的解决方法

登陆Vcenter,启动ESX2号节点上的一台虚拟机,出现如下提示框:

解决方法:

选择数据中心,在右边框中选择相应的ESX主机,点右键选择“断开”,如下图:

断开后,再在该ESX主机上点右键,选择“连接”,如下图:

完成后,再执行启动虚拟机,没有再次出现错误。

F5负载均衡配置一例 (型号:BIG-LTM-1600-4G-R)

最近接触了很多选择F5作为负载均衡的实施案子,故整理一例资料作为笔记。

F5 提供的解决方案保证每个用户的应用实现安全、高速和高可用,帮助企业获得最大投资回报。通过在网络中增加智能和可管理性而降低应用的负荷,F5使应用得以优化,从而提高运行速度,并降低资源消耗。

此次实施的F5型号为BIG-LTM-1600-4G-R,外形如下图:

 

注:本文仅供参考。

一、实施环境概述:本次采用的为旁路接入方式,F5的1.1和1.2两个接口分别接入应用双机环境的主、备交换机。

二、实施拓扑:

三、实施目的:目前下联用户访问服务器群时只能口头通知一部用户连接192.1.100.31的服务器,另一部分用户连接192.1.100.32,以此类推,这样做的弊端为:

1、服务器之间的访问压力不能均衡
2、若遇到某台服务器的服务出现问题,只能电话通知下联人员去连接其它可用的服务器,不能实现自动化。

而完成此次的F5架设之后,用户只需访问F5的虚拟地址,然后F5会平衡负载的去访问服务器群的每台机器。访问过程如下图所示。

 四、配置步骤:

1、初始配置(license及hostname配置)

开机后,将笔记本与F5的MGMT管理口相连,笔记本IP设置为192.168.1.100,在IE浏览器里输入https://192.168.1.245,初始用户名密码都为admin。进入后首先进行license的激活工作。

点击NEXT后会出现本设备的dossier,然后进入F5 license激活网站,将dossier复制到框内,点击NEXT,就会出现license内容,将其复制到F5的激活输入框中,点击finish即可。完成后就会出现激活的相关信息,如下图:

 

完成后输入skc.www.com的主机名,然后点击完成即可。

2、创建VLAN

选择左边的”Network”->”VLANs”菜单,如下图:

然后点击右边的”Create…”,name里输入任意名称,Tag里输入vlan号,然后将1.1和1.2两个口拖进Untagged中,Finished保存。

 

3、Self IPs设置

通过设置Self IPs来管理F5设备,选择左边的”Network”->”Self IPs”菜单,如下图:

然后点击右边的”Create…”,进行设置,IP ADDRESS栏里输入管理IP,Netmask输入掩码,VLAN中选择刚才创建VLAN时的名称,完成后点击Funished。

 

4、网关设置

因为网络是三层架建,用户的IP和F5的IP不是同一网络,所以需要给F5设置默认网关,这样用户才能访问到192.1.100.57,这里网关为192.1.100.250,设置如下,选择左边的”Network”->”Routes”菜单,如下图:

然后点击右边的”Create…”,进行设置,Type选择Default Gateway,Gateway Address填入网关地址,其它默认。

5、创建Pool

创建Pool,即服务器地址池,本例中服务器群向外提供80及9080两个端口,所以建立两个Pool,如果你的服务器只有一个服务,则只需创建一个Pool即可,创建步骤哪下:

先创建80端口的Pool,首先选择右边菜单的”Local Traffic”->”Pools”,再选择右边栏的”Create…”,出现如下界面,name里输入名称,Health Monitors健康检查选择Tcp,即通过端口的好坏来判断服务器是否正常,Load Balancing Method和Priorty Group Activation两项默认,在New Members中一个个增加服务器群的地址,最后点击Finished即可。

照着同样的方法创建9080端口的Pool,如下图所示。

完成后,F5就会判断两个Pool中服务器的健康性,正常后会出现绿色图标,如下图。

6、创建Virtual Servers

完成Pool的创建,最后开始创建虚拟服务器即Virtual Servers,这里有两个服务,即创建两个,若你只有一个服务,即创建一个虚拟服务器即可,步骤如下:

先创建80服务的虚拟服务器,首先选择右边菜单的”Local Traffic”->”Virtual Servers”,再选择右边栏的”Create…”,即出现配置对话框,该对话框共有三个选项栏:General Properties、Configuration、Resources。

General Properties配置:name输入web80,Destination中输入虚拟服务地址192.1.100.58,Service Port中输入80,其它默认

Configuration配置:在configuration中选择Advanced,type选择Performance(Layer4),SNAT Pool 选择Auto Map,关闭Port Translation

Resources配置:在Default Pool中选择webpool80即刚才创建的80服务的pool。

完成后,Virtual Servers会自动检查服务的健康状态,绿色即表明服务正常,如下图。

至此全部配置结束,可以通过访问http://192.1.100.58http://192.1.100.58:9080来测试。

也可以通过右边菜单的”Overview”->”Statistics”,Statistics Type中选择”Pools”,即可看到相应服务器的流量,如下图。

硬盘安装win2003及Inter PRO/Wireless 2200BG无线网卡for win2003驱动

今天把工作用的笔记本重新装win2003,原来的系统中毒了。Sony VGN-Y18C老笔记本没有光驱,只能硬盘安装了。如下:

1、将win2003光盘文件拷贝至D盘下

2、下载<老九WinPE老毛桃修改1111版>并安装,完成后重启,在启动菜单中选择WIN PE,进入WIN PE后,格式化C盘。然后运行d:win2003下的setup.exe即可开始安装win2003

在安装无线网卡驱动时,显示操作系统不匹配。

重新下载可以在win2003上使用的驱动,完成安装。

附件:Inter PRO/Wireless 2200BG for Win 2003驱动

Storage Foundation 5.2 sp2更换(更新)序列号

当时装的一套storage foundation5.2使用的临时的序列号,现在正版序列号已购买,刚需要将原来的序列号覆盖,而使用新的序列号,在SF(storage foundaion简称)界面上找了半天也没找到输序列号的地方,只好求助symantec 800电话,一问才知道只需在[添加/删除]那改就可以,具体操作如下:

1、打开win2003的控制面板的[添加/删除]程序,选择安装条目,然后点击[更改] 

2、选择License Management,点击Next 

 3、将原来的序列号remove,然后输入新的序列号,点击update,点击finish,完成。 

安装oracle rac时出现crs-1006和crs-0215错误

在安装clusterware时为避免运行root.sh时出现错误,需在第二个节点运行VIPCA,当运行VIPCA时,就出现了如下错误:

crs-1006:No more members to consider
crs-0215:Could not start resource ‘ora.node2.vip’

搜索发现为配置的网关主机不能PING通导致,立即接入一台笔记本,然后将笔记本IP设置为网关IP。点击[retry],故障排除。

创建ASM磁盘时出现错误:Marking disk "VOL1" as an ASM disk: [FAILED]

安装oracle rac(redhat平台)时,创建asm磁盘时出现failed错误,如下:

[root@node1 /]# /etc/init.d/oracleasm createdisk VOL2 /dev/sdc1
Marking disk “VOL2” as an ASM disk: [FAILED]

首先查看了asm的状态,如下,状态正常。

[root@node1 /]# /etc/init.d/oracleasm status
Checking if ASM is loaded: yes
Checking if /dev/oracleasm is mounted: yes

接着查看asm的日志,如下:

[root@node1 /]# less /var/log/oracleasm
Creating /dev/oracleasm mount point: /dev/oracleasm
Loading module “oracleasm”: oracleasm
Mounting ASMlib driver filesystem: /dev/oracleasm
Reloading disk partitions: done
Cleaning any stale ASM disks…
Scanning system for ASM disks…
oracleasm-read-label: Unable to open device “/dev/sdb1”: No such file or directory
Disk “VOL1” does not exist or is not instantiated
Instantiating disk “VOL1”
Disk “VOL2” does not exist or is not instantiated
Instantiating disk “VOL2”
Disk “VOL1” is a valid ASM disk
Disk “VOL2” is a valid ASM disk
Device “/dev/sdb1” is already labeled for ASM disk “VOL1”
Reloading disk partitions: done
Cleaning any stale ASM disks…
Validating disk “VOL1”
Validating disk “VOL2”
Scanning system for ASM disks…
oracleasm-read-label: Unable to open device “/dev/sdb1”: No such file or directory
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
Disk “VOL1” is a valid ASM disk
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
Disk “VOL2” is a valid ASM disk
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
Disk “VOL1” is a valid ASM disk
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
Disk “VOL2” is a valid ASM disk
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
shell-init: error retrieving current directory: getcwd: cannot access parent directories: No such file or directory
Device “/dev/sdb1” is already labeled for ASM disk “VOL1”
Device “/dev/sdc1” is already labeled for ASM disk “VOL2”

显示为VOL1和VOL2已经存在,所以当我再次创建时就出现了问题。马上把当时创建的这两个ASM删除,如下操作:

[root@node1 /]# /etc/init.d/oracleasm deletedisk VOL1
Removing ASM disk “VOL1”: [ OK ]
[root@node1 /]# /etc/init.d/oracleasm deletedisk VOL2
Removing ASM disk “VOL2”: [ OK ]

然后再次运行创建命令,可以创建了。

[root@node1 /]# /etc/init.d/oracleasm createdisk VOL1 /dev/sdb1
Marking disk “VOL1” as an ASM disk: [ OK ]
[root@node1 /]# /etc/init.d/oracleasm createdisk VOL2 /dev/sdc1
Marking disk “VOL2” as an ASM disk: [ OK ]
[root@node1 /]# /etc/init.d/oracleasm scandisks
Scanning the system for Oracle ASMLib disks: [ OK ]
[root@node1 /]# /etc/init.d/oracleasm listdisks
VOL1
VOL2

安装rac执行root.sh出现rootconfig: line 815: 10338 Segmentation fault错误

在REDHAT 5.4上安装oracle 10g rac,安装cluster时,在执行/opt/ora10g/product/10.2.0/crs_1/root.sh时出现了如下错误:

WARNING: directory ‘/opt/ora10g/product/10.2.0’ is not owned by root
WARNING: directory ‘/opt/ora10g/product’ is not owned by root
WARNING: directory ‘/opt/ora10g’ is not owned by root
Checking to see if Oracle CRS stack is already configured

Setting the permissions on OCR backup directory
Setting up NS directories
/opt/ora10g/product/10.2.0/db_1/install/rootconfig: line 815: 10338 Segmentation fault $CH/bin/ocrconfig -upgrade $CRS_ORACLE_OWNER $CRS_DBA_GROUP
Failed to upgrade Oracle Cluster Registry configuration

最后查找到原因是GCC的问题,需进行如下操作:

1. cd /usr/bin
2. mv gcc gcc.script
3. mv g++ g++.script
4. ln -s gcc34 gcc
5. ln -s g++34 g++

RedHat的yum配置笔记

yum = Yellow dog Updater, Modified,主要功能是更方便的添加/删除/更新RPM包,它能自动解决包的倚赖性问题。这样对于安装软件就非常方便了。

我的系统环境为RedHat5.4企业版32位。首先将RedHat5.4安装光盘复制到/cdrom目录下。然后编辑rhel-debuginfo.repo,如下:

vi /etc/yum.repos.d/rhel-debuginfo.repo

添加:

[Cluster]
name=Red Hat Enterprise Linux $releasever – $basearch – Cluster
baseurl=file:///cdrom/Cluster
enabled=1
gpgcheck=1
gpgkey=file:///etc/pki/rpm-gpg/RPM-GPG-KEY-redhat-release

[ClusterStorage]
name=Red Hat Enterprise Linux $releasever – $basearch – ClusterStorage
baseurl=file:///cdrom/ClusterStorage
enabled=1
gpgcheck=1
gpgkey=file:///etc/pki/rpm-gpg/RPM-GPG-KEY-redhat-release

[Server]
name=Red Hat Enterprise Linux $releasever – $basearch – Server
baseurl=file:///cdrom/Server
enabled=1
gpgcheck=1
gpgkey=file:///etc/pki/rpm-gpg/RPM-GPG-KEY-redhat-release

[VT]
name=Red Hat Enterprise Linux $releasever – $basearch – VT
baseurl=file:///cdrom/VT
enabled=1
gpgcheck=1
gpgkey=file:///etc/pki/rpm-gpg/RPM-GPG-KEY-redhat-release

再编辑yumRepo.py(通过搜索remote)

vi /usr/lib/python2.4/site-packages/yum/yumRepo.py

将remote = url + ‘/’ + relative
修改为:remote = “/cdrom/Server” + ‘/’ + relative

最后运行yum clean all即完成配置。

通过以下命令来查看是否能完成集群软件的安装:

cd /cdrom/Cluster
yum install *

 

 

IBM p550 (8204-E8A)小型机增加内存

一台IBM p550 (8204-E8A)小型机,原内存为16G,4颗power6处理器。所以机器中共有4块板子,每块板子上有一颗power6处理器及4G的内存,内存条每根2G,所以每块板子上插了两根,插槽号为C2和C7。如下图:

以上为没有升级前的状态。下面开始增加内存,板子上的内存顺序为:C2和C7一组,然后是C4和C9一组,然后是C1和C3,最后为C6和C8。这次增加16G内存(单根2G),也就是每块板子上再增加2根2G的内存条,则只要将内存插到C4和C9即可。

当我将四块板子上的内存都插在C4和C9上并开机后,发现机器没有认到新插的内存条,仍然为16G。这是因为这批16G内存和原16G内存不是一个批次或者不是一家生产的,在一些参数上有些不同。所以IBM要求在一块板子上要尽量插相同批次或参数相同的内存条。后来我将原16G的8根内存插在前面两块板子上(每块板子4根,插槽号为C2,C4,C7,C9),将后来买的16G的8根内存插在后面两块板子上,如下图:

内存编号图:

再次开机后,就看到认到了后来加的16G ,一共为32G,如下图:

RHCS错误:[3652]: ASEHAagent: The directory '/disk2/sybase/ASE15_0' doesn't exist.

完成LINUX双机热备RHCS后启动时出现错误,不能正常启动。查看/var/log/messages,错误如下:

Sep 24 21:36:38 node1 clurgmgrd[3113]: <notice> Starting stopped service service:sv_sybase
Sep 24 21:36:39 node1 avahi-daemon[2205]: Registering new address record for 192.168.1.210 on eth0.
Sep 24 21:36:39 node1 fenced[3015]: fencing node “node2”
Sep 24 21:36:39 node1 fenced[3015]: fence “node2” failed
Sep 24 21:36:40 node1 kernel: kjournald starting. Commit interval 5 seconds
Sep 24 21:36:40 node1 kernel: EXT3 FS on sdb, internal journal
Sep 24 21:36:40 node1 kernel: EXT3-fs: mounted filesystem with ordered data mode.
Sep 24 21:36:41 node1 bash: [3652]: <err> ASEHAagent: The directory ‘/disk2/sybase/ASE15_0’ doesn’t exist.
Sep 24 21:36:41 node1 clurgmgrd: [3113]: <err> script:script_sybase: start of /usr/share/cluster/ASEHAagent.sh failed (returned 1)
Sep 24 21:36:41 node1 clurgmgrd[3113]: <notice> start on script “script_sybase” returned 1 (generic error)
Sep 24 21:36:41 node1 clurgmgrd[3113]: <warning> #68: Failed to start service:sv_sybase; return value: 1
Sep 24 21:36:41 node1 clurgmgrd[3113]: <notice> Stopping service service:sv_sybase

显示不能找到/disk2/sybase/ASE15_0目录。但在安装sybase时目录应该是/disk2/sybase/ASE-15_0。

立即到/usr/share/cluster下查看ASEHAagent.sh中定义的变量,如下,发现sybase_ase和sybase_ocs的变量名中都少了个“-”。

sybase_home=”/disk2/sybase”
sybase_ase=”ASE15_0″
sybase_ocs=”OCS15_0″
server_name=”sybase”
login_file=”/disk2/sybase/login_file”
interfaces_file=”/disk2/sybase/interfaces”
sybase_user=”sybase”
shutdown_timeout=30
start_timeout=30
deep_probe_timeout=30
RUNSERVER_SCRIPT=$sybase_home/$sybase_ase/install/RUN_$server_name
CONSOLE_LOG=$sybase_home/$sybase_ase/install/$server_name.log

立即将它修改成如下内容:

sybase_ase=”ASE-15_0″
sybase_ocs=”OCS-15_0″

然后再执行启动双机,可以正常启动。