将关系型数据库中的表映射为一个Java类,在该类中有各列对应的各个字段。
如:
sqoop codegen --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 --table staff --bindir /home/admin/Desktop/staff --class-name Staff --fields-terminated-by "t"
生成与关系数据库表结构对应的hive表结构。
命令:
如:
sqoop create-hive-table --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 --table staff --hive-table hive_staff
参数:
可以快速的使用SQL语句对关系型数据库进行 *** 作,经常用于在import数据之前,了解一下SQL语句是否正确,数据是否正常,并可以将结果显示在控制台。
命令:
如:
sqoop eval --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 --query "SELECt * FROM staff"
参数:
可以将RDBMS中的所有表导入到HDFS中,每一个表都对应一个HDFS目录
命令:
如:
sqoop import-all-tables --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 --warehouse-dir /all_tables
用来生成一个sqoop任务,生成后不会立即执行,需要手动执行。
命令:
如:
sqoop job --create myjob -- import-all-tables --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 sqoop job --list sqoop job --exec myjob
尖叫提示:注意import-all-tables和它左边的--之间有一个空格
尖叫提示:如果需要连接metastore,则–meta-connect jdbc:hsqldb:hsql://linux01:16000/sqoop
参数:
尖叫提示:在执行一个job时,如果需要手动输入数据库密码,可以做如下优化
list-databasessqoop.metastore.client.record.password true If true, allow saved passwords in the metastore.
命令:
如:
sqoop list-databases --connect jdbc:mysql://hadoop102:3306/ --username root --password 123456
参数:与公用参数一样
list-tables命令:
如:
sqoop list-tables --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456
参数:与公用参数一样
merge将HDFS中不同目录下面的数据合并在一起并放入指定目录中
数据环境:
new_staff 1 AAA male 2 BBB male 3 CCC male 4 DDD male old_staff 1 AAA female 2 CCC female 3 BBB female 6 DDD female
尖叫提示:上边数据的列之间的分隔符应该为t,行与行之间的分割符为n,如果直接复制,请检查之。
命令:
如:
创建JavaBean:
sqoop codegen --connect jdbc:mysql://hadoop102:3306/company --username root --password 123456 --table staff --bindir /home/admin/Desktop/staff --class-name Staff --fields-terminated-by "t"
开始合并:
sqoop merge --new-data /test/new/ --onto /test/old/ --target-dir /test/merged --jar-file /home/admin/Desktop/staff/Staff.jar --class-name Staff --merge-key id
结果:
1 AAA MALE 2 BBB MALE 3 CCC MALE 4 DDD MALE 6 DDD FEMALE
参数:
记录了Sqoop job的元数据信息,如果不启动该服务,那么默认job元数据的存储目录为~/.sqoop,可在sqoop-site.xml中修改。
命令:
如:启动sqoop的metastore服务:sqoop metastore
参数:
欢迎分享,转载请注明来源:内存溢出
评论列表(0条)