11-10 情感与回忆 随笔感悟 游戏 街喧嚣 人过往 且记曾相识 不为少年留 文章回忆重温《造梦西游3》时,思绪回到14、15年夏天:和发小趁午休偷玩4399小游戏,挤在邻居电脑前分工操作,单纯而幸福。如今已成年各奔东西,即便有时间设备,童年玩伴却不在身旁。 38 1 0
11-10 笔面算法 刷题打卡 求职指南 算法刷题 pause 作者因对算法题兴趣不大且大厂实习多偏重手撕SQL,决定暂缓刷题。近期已基本完成数仓项目,接下来主攻八股与SQL;算法计划明年上半年为冲刺大厂暑期再集中刷Hot100。 39 0 0
11-10 大数据组件 Spark 八股总结 +1 ⚡ Spark Core & SQL 核心知识 本文梳理 Spark 常见部署模式(Local、Standalone、YARN、Mesos)与 spark-submit 提交流程,重点解析 Driver/Executor 架构、YARN client/cluster 差异;介绍 RDD Lineage 容错、宽窄依赖及 Stage/Task 划分,并汇总常用算子与性能调优要点。 63 0 0
11-10 大数据组件 Hive 八股总结 +1 🐝 Hive 知识体系与高频面试要点 本文梳理 Hive 核心知识:架构与执行引擎、与传统数据库差异;内部/外部表及四种 By;常用函数与 UDF/UDTF、窗口函数;MapJoin、分区列存、小文件与数据倾斜优化;字段分隔符、Tez 优点、元数据备份及 UNION 区别。 93 0 0
11-07 兴趣与杂谈 游戏 随笔感悟 步枪手最长的河 MOUZ迎来17岁天才,预瞄精准;NiKo转投Falcons,枪法艺术与荣誉等身,仍惦记波士顿与斯德哥尔摩的遗憾,愿他最终圆Major冠军梦。 38 0 0
11-06 大数据组件 原理剖析 实战教程 🚀 Kafka 架构与核心机制详解 概述Kafka架构组件与ZK职责,给出集群机器/磁盘/分区估算公式,介绍副本、ISR与acks可靠性,压测瓶颈与参数调优,含监控、清理策略及顺序性要点。 58 0 0
11-06 大数据组件 原理剖析 🌀 Flume 核心原理与组件详解 本文介绍 Flume 日志采集架构:Source/Channel/Sink 三组件与 Put/Take 事务保障“至少一次”传输。重点解析 TaildirSource 断点续传与重复处理,比较 File/Memory/Kafka Channel 选型,说明 HDFS Sink 滚动写入、拦截器与通道选择器,并给出监控与性能优化建议。 52 0 0
11-06 情感与回忆 音乐 随笔感悟 今日网易云☁ 文章引用《从你的全世界路过》诗句,描绘故事常在不期而遇中开启,却在分道扬镳中落幕;以“花开两朵,天各一方”点出相遇与离别的无常与遗憾。 18 0 0
11-05 求职与面经 求职指南 随笔感悟 求职online系统升级 V2.0→V3.0 电商数仓项目已接近收尾但尚未完成,作者提前更新简历,整理1段实习经历与3个项目经历;项目完结后将全面复盘并准备面试八股,为后续投递数据开发实习打基础。 35 1 0
11-05 大数据组件 入门指南 数仓建模 DolphinScheduler 简介与入门 Apache DolphinScheduler 是分布式可扩展的可视化 DAG 工作流调度平台,支持多任务类型与监控告警。介绍其核心架构(Master/Worker/ZK/API/UI)、三种部署模式(单机/伪集群/集群)及安全中心配置要点(租户、用户、队列、告警、环境、令牌)。 82 0 0
11-02 日常随笔 随笔感悟 求职指南 随便写写 作者五天未更新,也没认真学习,更多时间用于打球和刷抖音,导致时间碎片化。11月已至,项目遇阻停滞、动力不足,但仍希望提升效率推进进度,争取12月初完成找数开实习的阶段性准备。 24 1 0