千家信息网

Hive怎么实现WordCount

发表于:2025-02-06 作者:千家信息网编辑
千家信息网最后更新 2025年02月06日,这篇文章将为大家详细讲解有关Hive怎么实现WordCount,文章内容质量较高,因此小编分享给大家做个参考,希望大家阅读完这篇文章后对相关知识有一定的了解。1. 创建一个存放源数据的表(外部表)t_
千家信息网最后更新 2025年02月06日Hive怎么实现WordCount

这篇文章将为大家详细讲解有关Hive怎么实现WordCount,文章内容质量较高,因此小编分享给大家做个参考,希望大家阅读完这篇文章后对相关知识有一定的了解。

1. 创建一个存放源数据的表(外部表)t_words_src, 表中字段line为string类型, 存放一行单词

源数据示列:

hello,tomhello,jerryhello,kittyhello,worldhello,tom
hive> create external table t_words_src (line string)row format delimitedfields terminated by '\n'    # 按\n来切分字段, 一行就是一个字段location '/wc/input';    # 源数据路径为 'hdfs://node1:9000/wc/input' hive> select * from t_words;OKhello,tomhello,jerryhello,kittyhello,worldhello,tom

2. 创建一个存放所有单词的表t_words, 表中字段word为string类型, 存放单词

hive> create table t_words (word string);hive> insert into table t_words select explode(split(line,',')) as word from t_words_src;hive> select * from t_words;OKhellotomhellojerryhellokittyhelloworldhellotom

3. 创建一个存放WordCount结果的表t_wc_result, 表中字段word为string类型, 存放单词, counts为int类型, 存放单词出现次数

hive> create table t_wc_result (word string, counts int);hive> insert into table t_wc_result select word as word, count(word) as counts from t_words;hive> select * from t_wc_result;OKhello   5jerry   1kitty   1tom     2world   1

相对MapReduce来说, Hive的HQL版WordCount写起来代码量少很多, 但他们的思想都是一样的

关于Hive怎么实现WordCount就分享到这里了,希望以上内容可以对大家有一定的帮助,可以学到更多知识。如果觉得文章不错,可以把它分享出去让更多的人看到。

0