在Hive中,可以通过设置表属性 orc.compress
来压缩数据以节省存储空间。具体步骤如下:
CREATE TABLE compressed_table
STORED AS ORC
TBLPROPERTIES ("orc.compress"="ZLIB")
AS
SELECT * FROM original_table;
在上面的示例中,我们创建了一个新表 compressed_table
,并将数据存储格式设置为 ORC 格式,同时设置了压缩属性为 ZLIB。
ALTER TABLE existing_table SET TBLPROPERTIES ("orc.compress"="SNAPPY");
在上面的示例中,我们修改了现有表 existing_table
的压缩属性为 SNAPPY。
通过设置表属性 orc.compress
,可以在Hive中压缩数据以节省存储空间。压缩属性可选的值包括:NONE(不压缩,默认值)、ZLIB、SNAPPY、LZO 等。根据数据的特点和需求,选择合适的压缩算法以达到最佳的存储空间节省效果。