常用的存储格式_千锋教育

千锋教育-做有情怀、有良心、有品质的职业教育机构

手机站

千锋教育

千锋学习站 | 随时随地免费学

千锋教育

扫一扫进入千锋手机站

行业头条

大数据分析入门到就业要多久？ 查看详情>>

大数据软件开发的就业前景如何？ 查看详情>>

大数据目前就业前景怎么样？ 查看详情>>

大数据培训就业方向有哪些？ 查看详情>>

大数据分析就业高薪岗位介绍 查看详情>>

大数据分析编程就业方向如何？ 查看详情>>

女生学大数据分析就业前景好吗？ 查看详情>>

学习大数据编程好就业吗？ 查看详情>>

大数据分析就业前景及工资如何？ 查看详情>>

大数据有那些就业方向？ 查看详情>>

400-811-9990 全国咨询热线

首页视频教程培训课程师资团队技术干货常见问题面试题职场就业零基础学大数据行业资讯

【热点话题】大数据技术干货大数据学习教程大数据学习笔记大数据面试题大数据培训问答大数据培训机构哪些好大数据职场就业

当前位置：大数据培训 > 大数据学习笔记 > 常用的存储格式

常用的存储格式

来源：千锋教育

发布人：qyf

时间： 2022-12-07 18:46:12 1670409972

　　TextFile

　　默认格式，按行存储，可以压缩但压缩文件不支持分片，反序列化开销是SequenceFile的几十倍(需要判断分隔符和换行符)

　　SequenceFile

　　hadoop原生支持，将kv以二进制方式按行存储，压缩后的文件支持压缩。默认以record压缩，可以改为block性能更好。压缩率很低，查询速度一般。

　　RCFile

　　按行分块、按列存储的存储方式，反序列化速度较慢，但压缩率和查询速度最快。

　　ORC file

　　RC的改良版，每个Task输出单文件、存储索引、支付复杂类型、支持块压缩、可以直接读取，ORC比RC高效很多。

　　Parquet

　　列式存储，是spark的默认存储格式，压缩和查询性能比ORC稍差，但是支持的编码更多，而且对嵌套式结构支持的更好(json)。

　　因此对结构化数仓来说ORC file格式更好，对灵活的spark作业来说Parquet格式更好。

声明：本站稿件版权均属千锋教育所有，未经许可不得擅自转载。

上一篇

寻找两个正序数组的中位数

下一篇

大数据之回文数

猜你喜欢LIKE

无重复字符的最长子串

无重复字符的最长子串

寻找两个正序数组的中位数

寻找两个正序数组的中位数

合并两个有序链表

合并两个有序链表

合并K个排序链表

合并K个排序链表

最新文章NEW

大数据之什么是数仓

大数据之什么是数仓

手写算法-懒汉式单例

手写算法-懒汉式单例

手写算法-四大排序

手写算法-四大排序

是一个宽表好还是多个维表好？

是一个宽表好还是多个维表好？

相关推荐HOT

更多>>

大数据之蛇形矩阵

我们最终要输出的是以蛇形摆放之后的字符串再按行串联在一起之后的结果，也就是说每一个字母摆放的列并不重要，重要的是摆放的行号。我们可以很...详情>>

2022-12-07 20:58:39

大数据之两数相加

大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化，半结构化和...详情>>

2022-12-07 20:56:39

设计一个实时的流式计算Wordcount

使用Kafka对接SparkStreaming计算，那么要保证数据不丢失，和不重复的话，要使用直连方式，并且保证一次性语义，手动管理Offset即可，那么在实...详情>>

2022-12-07 20:54:49

大数据之最长回文串

大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化，半结构化和...详情>>

2022-12-07 20:51:53

两两交换链表中的节点

大数据通常包含的数据集的大小超出了常用软件工具在可容忍的经过时间内捕获、整理、管理和处理数据的能力。大数据哲学包含非结构化，半结构化和...详情>>

2022-12-07 20:46:54

大数据培训问答 更多>>

大数据都学什么？5大核心知识必学内容有哪些

大数据报班多少钱？如何选择培训机构

人工智能学什么？自学可以成才吗

数据处理包括哪些内容？是不是所有课程需要分别报课

大数据分析需要学什么？怎么学比较好

人工智能专业学什么？人工智能有哪些课程

大数据数据分析师要学什么？好就业吗

大数据面试题库 更多>>

大数据的五个V是什么?

涨薪指数

数据及集群管理（三）

涨薪指数

数据及集群管理（二）

涨薪指数

大数据的五个V是什么?

数据及集群管理（三）

数据及集群管理（二）

数据及集群管理（一）

大数据之hbase的优化读数据方面

大数据之hbase的优化写入数据方面

大数据师资团队 更多>>

14天品质课程免费学

10年以上业内强师带你蜕变精英

提交领取