01-15 求职与面经 面经复盘 八股总结 +1 🎯 海亮集团 数开实习面经 文章复盘了数仓/数据开发面试:涵盖数仓分层与维度建模、SQL优化与平台原理、指标管理与数据治理、Spark/Hive与BI、SQL实操及实习问答,并梳理自身薄弱点与待补齐知识。 86 1 0
01-11 求职与面经 面经复盘 数仓建模 +1 📝 字节跳动 大数据开发实习生 面试经历整理 文章总结两场数据方向面试:商业产品与技术、泛TikTok数据平台搜索。涵盖自我介绍、项目深挖、数仓分层、数据倾斜、Spark Shuffle/Hive/ClickHouse等知识点,并包含有序数组统计、连续登录、7日移动平均等手撕与实操题。 76 0 0
12-24 求职与面经 面经复盘 数仓建模 +1 📌 字节跳动大数据开发面经 3️⃣ 文章汇总大数据/数仓面试高频点:项目按业务域、目标或数据来源划分;Hadoop 体系(HDFS/YARN/MapReduce)与适用场景;MapReduce 全流程及 Shuffle 作用;维度建模方法、事实表与维度表区别,星型/雪花模型取舍;去重方案与 count distinct、group by 差异。 78 0 0
12-24 求职与面经 面经复盘 SQL +1 🎯 字节跳动大数据开发面经 1️⃣ 文章围绕大数据/数仓面试高频点,梳理项目深挖回答框架:职责流程、指标口径对齐、数仓分层、数据质量与性能优化、业务落地与效果验证;并总结SQL开窗函数、复杂聚合(Grouping Sets等)及Python/Java基础与UDF要点。 79 0 0
12-16 求职与面经 面经复盘 SQL +1 📋 亚信科技数据开发面经 文章汇总两份数据开发面经要点:涵盖SQL能力展示、表关联/JOIN分类、CASE WHEN与开窗排序函数;并延伸到项目STAR讲述、数据去重、数仓分层与分层价值、SCD处理、ETL流程、星型/雪花模型及Hadoop生态组件。 59 1 0
12-14 数仓建模 数据资产 指标体系 +1 📝 用户标签画像体系 文章围绕用户标签画像体系展开:解释标签的概念、七大分类与五种属性类型,并说明标签与指标的组合逻辑。进一步介绍标签加工流程、宽表建设与管理方式,以及画像生成与应用场景,强调合规采集与精准运营价值。 92 0 0
12-11 求职与面经 面经复盘 八股总结 +1 ✨ 全方面面试题解答 文章系统梳理数据侧岗位面试高频题:个人介绍、项目闭环表达与量化成果;数仓分层建模、指标体系与治理方法;Hadoop/Spark/Hive、数据倾斜与一致性等八股;SQL考点、架构选型、开放题及面试加分避坑技巧。 74 0 0
12-11 求职与面经 面经复盘 数仓建模 +1 📅 数仓面试全攻略 文章系统拆解数仓岗位四轮面试要点:一面看基础与真实性,二面重项目深度与解题能力,三面聚焦业务价值与软实力,HR面考察适配与稳定;并给出简历量化、自我介绍、知识模块(数仓/SQL/组件/场景题)及复盘心态方法。 93 0 0
12-10 求职与面经 面经复盘 数仓建模 简历提问 - ChatGPT版 文章从技术 Mentor、业务 Leader 与 HR 三视角梳理数据开发核心:用户标签体系全链路建设、生命周期与偏好标签设计、Spark 性能优化、数仓分层与数据治理;并总结大盘指标沉淀、协作排期、沟通与成长方法。 58 1 0
12-09 数据治理 数据治理 数仓建模 +1 📚 存储资源治理 本文聚焦数仓存储资源治理:以表元数据与血缘为基石,识别临时/无用/空表;通过Parquet+Snappy、分区生命周期、二级分区拆分及全量改增量降本;以量化指标与打分体系评估,并通过持续监控长期维护。 67 0 0
12-09 数据治理 数据治理 Flink +1 📊 报表治理 文章围绕报表治理展开:针对资源成本失控、无效报表泛滥与查询慢、权限乱等痛点,提出先梳理血缘与使用量、再与业务确认价值,分级下线或优化任务与表,并通过OLAP/预计算/Flink提速,配合权限隔离与定期巡检实现长效治理。 72 0 0
12-08 数据治理 数据治理 数仓建模 🎯 数据分区与链路场景优化 回顾事实维度与分层体系,聚焦分区优化痛点与原则,给出6种实战拆合分区、视图与拉链表方案,并总结链路设计与DWS取舍,强调上线前预留弹性、减少扫描与小文件,提升下游效率。 52 0 0