
扫码联系客服
熟练搭建Hive on Spark数据仓库,通过分区、分桶及ORC文件格式优化,提升查询效率并降低存储成本。
运用Spark SQL进行复杂ETL作业,借助AQE与动态分区裁剪优化长尾任务,确保数据准时产出。
基于Kafka与Flink构建实时入仓管道,实现业务数据秒级采集、清洗与写入ClickHouse,支撑实时看板。
使用Presto/Trino进行跨源联邦查询,结合Alluxio缓存加速,满足即席分析场景下的低延迟数据访问。

对数据结构的整洁与高效有着近乎偏执的追求,享受从杂乱信息中梳理逻辑、构建稳定分析底座的成就感。严谨细致是我的工作底色,对数据质量波动和异常始终保持高度敏感,并习惯主动推动治理闭环。能熟练运用ETL及分布式计算框架应对海量数据场景,在建模与性能优化上注重平衡,不只求快,更求可维护。乐于在业务需求与技术实现之间寻找简洁路径,沟通时倾向于用数据说话,推动协作自然落地。持续关注流批一体、数据湖等演进方向,希望将新技术转化为日常工作的踏实改进,让数据仓库成为真正可信的决策基础。
熟练搭建Hive on Spark数据仓库,通过分区、分桶及ORC文件格式优化,提升查询效率并降低存储成本。
运用Spark SQL进行复杂ETL作业,借助AQE与动态分区裁剪优化长尾任务,确保数据准时产出。
基于Kafka与Flink构建实时入仓管道,实现业务数据秒级采集、清洗与写入ClickHouse,支撑实时看板。
使用Presto/Trino进行跨源联邦查询,结合Alluxio缓存加速,满足即席分析场景下的低延迟数据访问。
奇秒简历AmazingCV 数据仓库管理工程师 简历免费在线制作,包含数据仓库管理工程师简历范文,数据仓库管理工程师简历求职模板,AI辅助一键优化数据仓库管理工程师简历内容,秒变满分候选人,让心动offer拿到手软。贴合HR筛选偏好,告别千篇一律,简历通过率飙升。