Below you will find pages that utilize the taxonomy term “system”
Posts
debian upgrade to jassie
升级之后出的问题折腾了一天之后一一解决。
1.升级后让卸载NVIDIA显卡驱动,期间死机两次,进去之后还得修复依赖关系很耗时,卸载之后直接用系统自带的包就可以装,以后也不用去nv官网下驱动了。
2.升级后gnome3各种不爽还卡,虽然用wheezy的时候也是gnome3,但是可选classic模式还能凑合用。但这次升级之后选了flashback模式,但是菜单死活不出东西,网上说干净重装可用,且以后再说,搜了一下发现mate是gnome2演变而来,装上后发现十分舒服。
http://mate-desktop.org/
3.升级之后虚拟机网卡驱动竟然变了,用ghost重新装了一个kvm虚拟机,然后把驱动考出来又装回原来的虚拟机了。
4.升级之后lvm不能自动识别,开机总是lv status not available。必须手动vgchange -a y才能进系统。最后这个解决
http://www.linuxquestions.org/questions/linux-software-2/problems-booting-from-luks-on-top-of-lvm-4175487926/
按这里说的在 /etc/default/grub:
加一行
然后运行update-grub,重启后能正常启动了。
耽误了一天,之后服务器也升级的时候需要提前准备好这几点。
Posts
nagios监控磁盘空间
今天弄了一下nagios的check_snmp_storage.pl
但是发现
返回
在目标主机本地执行
返回
按snmp的计算应该是剩余12%
在目标主机上df
最后发现是df的值不对,由于是ext4分区有5%的保留块,实际的用量就应该是78%,但是由于最后5%是不能用的,78 + 5 = 83
虽然df的计算数据不正确,但是报警值应该加上5%来算。文件系统 1K-块 已用 可用 已用% 挂载点
check_snmp_storage 就应该改成
check_snmp_storage.pl -H aaa.client.com -w 85 -c 90 -T pu -m /home
Posts
cacti
cacti又折腾了两天,主要是之前snmp的一些东西都忘了,又重新看了一下。
弄明白了点觉得挺简单的,不过要是不明白,全都跟天书一样。
软件全都aptitude安装,让系统默认配置。
需要被监控的机器都要装snmpd
看说明,要是想禁用snmpd v1 和 v2,在snmpd.conf里注释掉带community的行就行了,v3的认证不需要community
在snmpd.conf里更改要监听的ip地址
然后net-snmp-config –create-snmpv3-user -ro -a xxxxxxxx -x yyyyyyyy -X DES -A MD5 snmpuser
man一下看看更好
-a是验证密码,-x是是privpass,理解是snmp进行set时的写入密码,不过我感觉cacti都是读操作,应该用不到这个密码。
建立snmpv3的用户与验证密码
密码强制至少8位
顺带一说cacti没法放到网站的根域名下,由于程序本身的设计必须被放在/cacti的虚拟目录下,不然总是redirect错误。
在cacti里建立device
填的和刚才建立的用户名和密码一致就行。
template选择 ucd/net SNMP Host,这个模板基本想要的图都包括了。
其他模板也行,就是带的图不一样而已。
如果没出图,在graph management里找这个主机的随便一个图,开debug模式调试。
图没问题了,在grahp trees 里添加新主机
Tree Item Type选Host
然后选中新主机添加
后来看图里显示的硬盘和内存,都比实际的要小大概五分之一,难道是本机和snmp的算法不一样?回头问问老于。
nagios里的nagios-snmp-plugin要用snmp v3的话,需要装以下东西
libnet-snmp-perl libcrypt-hcesha-perl libcrypt-des-perl libdigest-hmac-perl
Posts
全lvm分区安装不能安装grub到硬盘
昨天弄了一天服务器,有一个服务器重新分区后,全lvm分区,到最后总是错误,不能将grub安装到硬盘。
没辙了只好先分了一个ext4分区出来,将其他空间规划成lvm,最后才装上了。
看来是必须有一个非lvm分区负责启动。
之前明明记得装过,全lvm分区,也能安装系统的。
Posts
dpkg –remove-architecture失败
为了装skype,dpkg –add-architecture i386还装了一堆的依赖包,用不了想取消mutiarch就报错了,
得先用一下这个命令把已经安装的i386的包都卸载先
aptitude remove `dpkg –get-selections | grep i386 | awk ‘{print $1}’`
Posts
linux can not allocate memory
前几天做信息的同事的主机出现
cannot-allocate-memory-error
导致ssh连不上,去本机登录想重启ssh服务也出这个错误,后来想杀进程,ps top也都报错,只能重启了。
之后想办法看到这个
http://thedaneshproject.com/posts/cannot-allocate-memory-error/
照着把free_memory设置大一些不知道会不会有用。
Posts
系统升级后又一次找不到root,进入initramfs
dist-upgrade之后又一次进入了initramfs,这回不像上次一样改一下grub里的 uuid 就好了。这次干脆丢失了uuid。
在/dev/disk/by-uuid/里只剩下了两个内容,一个是boot的,另一个是整个lvm的(大概),没有root分区的uuid。
下班的时候也没弄好。不过还好在initramfs下lvm进去之后看了一下,发现root的lv卷是not available。
回家之后搜lvm not available的关键字。
有人指出用lvchange -a y /dev/vg/root这个命令使lv变为可用状态。
今天一早进机房,先看了看pv是not useable。
先pvchange -a y /dev/xxxxxxx了一下。
把两个pv的状态改为useable。
lvchange的命令都没用上,再lvdisplay一看lv就已经都是available的状态了。
然后ctrl+d推出initramfs,系统正常启动OK。所以当前这个blog才能又一次上线…。
可喜可贺~ 赶紧备份数据库!
Posts
ibm 3650 m3 bnx2/bnx2-rv2p-09ax-5.0.0.j3.fw
这个服务器运行了半年多,忽然发现反应慢半拍。之前提到的升级的那个破dell,6、7年前的机器ssh进去之后,进入目录,命令补全什么的都很速度。
按说ibm3650这个还是前年的新机器,竟然很慢。
据于工说是ibm的硬盘驱动问题,系统默认可能识别驱动不对。
于是安装了firmware-linux-nonfree
之后报系统错误。
update-initramfs: Generating /boot/initrd.img-2.6.32-5-amd64
W: Possible missing firmware /lib/firmware/bnx2/bnx2-rv2p-09ax-5.0.0.j3.fw for module bnx2
W: Possible missing firmware /lib/firmware/bnx2/bnx2-rv2p-06-5.0.0.j3.fw for module bnx2
W: Possible missing firmware /lib/firmware/bnx2/bnx2-mips-06-5.0.0.j3.fw for module bnx2
又说缺这个,搜了
http://packages.debian.org/squeeze/firmware-bnx2
说是网卡的驱动,总之装上
之后反应就迅速起来了。