修改16种常见的Hadoop错误整理(大讲台内部资料)

内部错误  时间:2021-04-07  阅读:()

16个hadoop常见问题及处理方法

这个是刚发的大讲台教学资料特地分享给hadoop爱好者们。mysql版本必须是MYSQL51。

查询办法mysqladmin version

在建立hive数据库的时候最好是:create database hive;oozie的数据库同样 create database oozie;

1 hadoop采集的字符集问题

修改/etc/sysconfig/i18n更改字符集为en_US UTF-8

重启机器生效。

重启机器的指令为在root下敲入如下指令 sync;sync;init 6

2修改mapreduce

在gateway/性能下修改MapReduce子Java基础选项、 Map任务Java选项库、 Reduce任务Java选项库全部配置成-X m x4294967296

在TASKTRACKER/性能下修改:MapReduce子Java基础选项、 Map任务Java选项库、 Reduce任务Java选项库全部配置成-X m x4294967296

3必须关注各个任务的详细情况

当出现如下的错误的时候请及时的将下载的进程数调小。vi /home/boco/oozie_wy/config/lte/mro/ftp/807101 xml将max_thread由原来的6个调整为3个,或者协调厂家加大FTP的最大线程数。stderr logs orgapachecommons netftp FTPConnectionClosedException: FTP response 421 received Server closed connectionat orgapachecommons netftp FTP__getReply(FTPjava:363)at orgapachecommons netftp FTP__getReply(FTPjava:290)

at orgapachecommons netftp FTPconnectAction(FTPjava:396)at orgapachecommons netftp FTPCl ientconnectAction(FTPCl ientjava:796)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:172)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:192)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:285)at com bocowangyou uti ls FtpconnectServer(Ftpjava:550)at combocowangyoultemroftptools FindFi leThreadrun(FindFi leThreadjava:67)

登录ft p服务器【10140177149】失败 FT P服务器无法打开orgapachecommons netftp FTPConnectionClosedException: FTP response 421 received Server closed connectionat orgapachecommons netftp FTP__getReply(FTPjava:363)at orgapachecommons netftp FTP__getReply(FTPjava:290)at orgapachecommons netftp FTPconnectAction(FTPjava:396)at orgapachecommons netftp FTPCl ientconnectAction(FTPCl ientjava:796)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:172)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:192)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:285)at com bocowangyou uti ls FtpconnectServer(Ftpjava:550)at combocowangyoultemroftptools FindFi leThreadrun(FindFi leThreadjava:67)

登录ft p服务器【10140177149】失败 FT P服务器无法打开orgapachecommons netftp FTPConnectionClosedException: FTP response 421 received Server closed connectionat orgapachecommonsnetftp FTP__getReply(FTPjava:363)at orgapachecommons netftp FTP__getReply(FTPjava:290)at orgapachecommons netftp FTPconnectAction(FTPjava:396)at orgapachecommons netftp FTPCl ientconnectAction(FTPCl ientjava:796)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:172)at orgapachecommons netSocketCl ientconnect(SocketCl ientjava:192)

4TASKTRACKER和HDFS组的问题

发现部分地方在安装的时候将所有的机器分组的问题。

如果分组需要将每个组的参数都要修改。

目前发现很多的地方TASKTRACKER和HDFS都分了组但是只修改一组的参数造成系统大量出问题。java heap size以及tasktracker被拉黑名单的问题。

5  namenode和datanode的内存配置问题。

建议将使用的内存修改为4G左右。

6建议将H IVE 2服务放到一个辅节点上。hive2放到辅节点上经常出现add_partation挂起报错。

7解决H IVE经常挂死的问题

修改zookeeper的最大客户端连接数maxClientCnxns修改为3600或者修改成0丌限制

自劢清空时间间隔 autopurge purgeInterval修改为1小时

8厂家XML配置的问题。

如果厂家是这样的/data/dataservice/mr/ltemro/huawei/20140815/01/362323/TD-LTE_MRO_HUAWEI_010133150144_362323_20140815011500xml gz

建议配置成这样的

路径/data/dataservice/mr/ltemro/huawei/$TIME$/$ENODEB$

时间格式yymmdd/hh

9在/home/boco/oozie_wy/config/lte/mro/ftp下禁止存放bak文件

有一个省份的mapper数超多导致解析很长时间没有完成。

进一步发现FTP在合并文件的时候报错再进一步发现同一个IP地址同一个OMC启劢了三个mapper进程去下载数据导致文件合并失败。

发现是修改了ftpxml文件没有删除原来的文件而是以一个bak文件存放。

删除这些bak文件mapper数量正常。

原mapper数1731个删除之后mapper数41个,采集正常。

打开50030看FT P的日志存在如下的报错java io Fi leNotFoundException: Fi le does not exist: /user/boco/cache/wy/ltemro/1411032293348/xml/155/2014-09-18_11/TD-LTE_MRO_ERICSSON_OMC1_303024_20140918111500xmlzipat orgapache hadoop hdfs servernamenodeINodeFi levalueOf(INodeFi lejava:39)at orgapache hadoop hdfs server namenode FSNamesystemgetBlockLocationsUpdateTimes(FSNamesystemjava:1

341)at orgapache hadoop hdfs server namenode FSNamesystemgetBlockLocationsInt(FSNamesystemjava:1293)at orgapache hadoop hdfs server namenode FSNamesystemgetBlockLocations(FSNamesystemjava:1269)at orgapache hadoop hdfs server namenode FSNamesystemgetBlockLocations(FSNamesystemjava:1242)at orgapache hadoop hdfs server namenode NameNodeRpcServergetBlockLocations(NameNodeRpcServerjava:39

2)at orgapache hadoop hdfs protocolPBCl ientNamenodeProtocolServerSideTranslatorPBgetBlockLocations(Cl ientNamenodeProtocolServerSideTranslatorPBjava:172)at org apache hadoop hdfs protocol proto Cl ientNamenodeProtocolProtos$Cl ientNamenodeProtocol$2 cal lBlockingMethod(Cl ientNamenodeProtocolProtosjava:44938)at orgapache hadoop ipc ProtobufRpcEngine$Server$ProtoBufRpcInvokercal l(ProtobufRpcEnginejava:453)at orgapache hadoop ipcRPC$Servercal l(RPCjava:1002)at orgapache hadoop ipcServer$Handler$1 run(Serverjava:1701)at orgapache hadoop ipc Server$Handler$1 run(Serverjava:1697)at java securityAccessControl lerdoPrivi leged(Native Method)

或者orgapache hadoopipc RemoteException(orgapache hadoop hdfs server namenode LeaseExpiredException):Lease mismatch on /user/boco/cache/wy/ltemro/1411032293348/xml/155/2014-09-18_11/TD-LTE_MRO_ERICSSON_OMC1_3030_20140918xml owned by DFSCl ient_NONMAPREDUCE_

-1274827212_1 but is accessed by DFSCl ient_NONMAPREDUCE_-216613905_1at orgapache hadoop hdfs servernamenode FSNamesystemcheckLease(FSNamesystemjava:2459)at orgapache hadoop hdfs servernamenode FSNamesystemcheckLease(FSNamesystemjava:2437)at orgapache hadoop hdfs servernamenode FSNamesystemcompleteFi leInternal(FSNamesystemjava:2503)at orgapache hadoop hdfs servernamenode FSNamesystemcompleteFi le(FSNamesystemjava:2480)

at orgapache hadoop hdfs servernamenode NameNodeRpcServercomplete(NameNodeRpcServerjava:535)at orgapache hadoop hdfs protocolPBCl ientNamenodeProtocolServerSideTranslatorPBcomplete(Cl ientNamenodeProtocolServerSideTranslatorPBjava:337)at org apache hadoop hdfs protocol proto Cl ientNamenodeProtocolProtos$Cl ientNamenodeProtocol$2 cal lBlockingMethod(Cl ientNamenodeProtocolProtosjava:44958)at orgapache hadoop ipc ProtobufRpcEngine$Server$ProtoBufRpcInvokercal l(ProtobufRpcEnginejava:453)at orgapache hadoop ipcRPC$Servercal l(RPCjava:1002)

解析时候报错错误如下rediscl ientsjedisexceptionsJedisConnectionException:Could not get a resource from the poolat redis cl ients uti l Pool getResource(Pooljava:22)at combocowangyouuti lsJedisUti lsgetJedis(JedisUti lsjava:47)at combocowangyou uti lsJedisUti lsgetTableValues(JedisUti lsjava:119)at com bocowangyou lte mro tdl tools LteMroXMLParser

此问题一般是因为REDIS没有启劢导致。

10克隆机器安装的问题

把一个节点的第二步都装好了把它克隆到其它主机上再把克隆到的主机的IP

(注意在修改IP配置文件的时候将HWaddr也改了一般是这种格式00:50:56:80:4E:D6

否则在连接时会找丌到硬盘)和主机名改下。

此种情况主要出现在使用vmvare vsphere克隆导致的。

注意

克隆之后的机器要修改IP地址主机名MAC地址。

11 redis挂死导致无法采集

#现象redis.clients.jedis.exceptions.JedisDataException:

MISCONF Redis is configured to save RDB snapshots,but is currently not able to persist on disk

启动客户端

/usr/local/redis/redis-cl i

输入config set stop-writes-on-bgsave-error no

12主节点7180无法访问

1)检查主节点是丌是日志空间满了如果满了需要删除/va r/l og/h ive下面日志

2)删除浏览器的cooki e访问记录hadoop相关服务启劢命令sudo service cloudera-scm-server stopsudo service cloudera-scm-server-db stopsudo service cloudera-scm-server startsudo service cloudera-scm-server-db start

13 LTEMRO采集报错

主要是在这一步报错CREATE_EXTERNAL_TABLE_NODE

有效的采样点数据是如下的八个字段必须有值

MR LteScEarfcn主小区频点

MR LteScPci主小区PCI

MR LteScRSRP主小区的RSRP

MR LteScRSRQ主小区RSRQ

MR LteNcEarfcn邻小区频点

MR LteNcPci邻小区PCI

MR LteNcRSRP邻小区的RSRP

MR LteNcRSRQ邻小区RSRQ

只要有有效数据就丌会报这个错。

14查看日志

H IVE的日志主要是在:/va r/l og/h ive/oozie的日志主要在: /va r/l og/oozie/

HDFS的日志主要在: /var/log/hadoop-hdfs/zookeeper的日志主要在:/var/log/zookeeper/

在出现问题的时候可以看看这些日志。

15 zookeeper无法启劢

处理办法到master主机的/var/lib/zookeeper 删除所有的文件重启zookeeper即可。sudo mkdir version-2sudo chown -R zookeeper:zookeeper version-2

16 loudera-manager-instal lerbin安装报错

报错如下

Loaded plugins: al iases, changelog, downloadonly, fastestmirror, kabi, presto,

: refresh-packagekit, security, tmprepo, verify, versionlock

Loading support for CentOS kernel ABI

Loading mirror speeds from cached hostfi lehttp://10233963/cdh430/cdh43/repodata/repomdxml : [Errno 14] PYCURL ERROR 22 - "The requested URL returned error:403"

Trying other mirror

Error:Cannot retrieve repository metadata (repomdxml) for repository: cloudera-cdh4 Please verify its path and try again

处理办法

删除集群中每一台机器上原有的repo文件 rm-rf/etc/yum repos d/*

然后修改cloudera-chd4 repo、 cloudera-impala repo和cloudera-manager repo文件将文件中的地址换成主节点的地址。

将cloudera-chd4 repo、 cloudera-impala repo和cloudera-manager repo文件上传到集群中每一台机器的/etc/yum repos d/目录下。

小白云 (80元/月),四川德阳 4核2G,山东枣庄 4核2G,美国VPS20元/月起三网CN2

小白云是一家国人自营的企业IDC,主营国内外VPS,致力于让每一个用户都能轻松、快速、经济地享受高端的服务,成立于2019年,拥有国内大带宽高防御的特点,专注于DDoS/CC等攻击的防护;海外线路精选纯CN2线路,以确保用户体验的首选线路,商家线上多名客服一对一解决处理用户的问题,提供7*24无人全自动化服务。商家承诺绝不超开,以用户体验为中心为用提供服务,一直坚持主打以产品质量用户体验性以及高效...

95IDC香港特价物理机服务器月付299元起,5个ip/BGP+CN2线路;美国CERA服务器仅499元/月起

95idc是一家香港公司,主要产品香港GIA线路沙田CN2线路独服,美国CERA高防服务器,日本CN2直连服务器,即日起,购买香港/日本云主机,在今年3月份,95IDC推出来一款香港物理机/香港多ip站群服务器,BGP+CN2线路终身7折,月付350元起。不过今天,推荐一个价格更美的香港物理机,5个ip,BGP+CN2线路,月付299元起,有需要的,可以关注一下。95idc优惠码:优惠码:596J...

创梦网络-江苏宿迁BGP云服务器100G高防资源,全程ceph集群存储,安全可靠,数据有保证,防护真实,现在购买7折促销,续费同价!

官方网站:点击访问创梦网络宿迁BGP高防活动方案:机房CPU内存硬盘带宽IP防护流量原价活动价开通方式宿迁BGP4vCPU4G40G+50G20Mbps1个100G不限流量299元/月 209.3元/月点击自助购买成都电信优化线路8vCPU8G40G+50G20Mbps1个100G不限流量399元/月 279.3元/月点击自助购买成都电信优化线路8vCPU16G40G+50G2...

内部错误为你推荐
重庆网络公司一九互联网络公司做一个网站大概需要多少钱中国企业在线有什么B2B网站可以做国外的?多给些。。回答的好追加dell服务器bios设置dell R410服务器 bios设置参数如何恢复出厂设置?支付宝账户是什么支付宝账户是什么?yixingjia通配符的使用方法大飞资讯新闻资讯包括什么内容?购物车什么叫淘宝购物车metinfoMetInfo跟织梦那个比较好?各自的优点跟缺点是什么,建站无忧求好点的免费建站网长沙电话号码升位湖南的电话号码什么时候从6位数升到7位数的?
187邮箱 hostmonster ion namecheap kdata 博客主机 香港cdn godaddy续费优惠码 华为云主机 免费静态空间 申请空间 qq数据库 双11秒杀 isp服务商 中国电信测速网 100mbps 空间登陆首页 空间申请 卡巴斯基试用版下载 cdn服务 更多