阿里大数据一次简单而失败的面试题回忆

一面

  • 简单介绍一下自己以及自己做过的项目;
  • Java HashMap 是不是线程安全的?为什么?
  • 请用 Java 写个单例模式
  • 知道几种 GC 算法?
  • 如何实现一个高效的单项列表逆向输出?
  • 数据湖和数据仓库有什么区别?
  • 详细介绍下 Flink 的 Checkpoint 执行机制(分布式快照)
  • 算法题:寻找两个正序数组的中位数

二面

  • 如何在两个进程间共享数据?线程呢?
  • 如何在 main 函数里面等待一个线程执行完毕?
  • 用MapReduce手写一个wordcount,
  • 用 MapReduce TopK 怎么实现?
  • Hudi、Iceberg 和 Delta Lake 哪个熟悉?它们之前有什么区别知道吗?
  • 请简述 Hudi 的读写流程。
  • 布隆过滤器的原理知道吗?(在回答 Hudi 写数据的时候提到布隆过滤器,所以面试官问了)。
  • 算法题:合并两个有序链表。三个有序链表合并?K 个呢?

三面

  • Spark Shuffle 读写原理说下,和 MapReduce 的 Shuffle 有什么区别?
  • Hudi 支持流批一起处理吗?他是怎么实现的?
  • Iceberg 知道吗?实现原理你知道吗?
  • Iceberg 的时间旅行是怎么实现的?什么场景下要使用它?
  • Hudi 和 Iceberg 你怎么选?为什么。
  • 算法题:一辆公交车,有 m 站,最多坐 n 人,输入一路上的票信息(即上车下车站),输出会不会超载。

四面

  • 说一下你熟悉的设计模式?
  • synchronized 和 ReentrantLock 区别是什么?
  • 都知道哪些分布式一致性算法?挑一个你熟悉的说下其原理。
  • Join 的实现有哪几种?场景是哪些?
  • 一条 SQL 从提交到拿到结果都经历了什么?
  • 说下你理解的数据湖?
  • Hudi、Iceberg 和 Delta Lake 怎么选择?
  • 请简述一下 Flink CDC 原理

小编把阿里巴巴、腾讯、美团等大厂的Java和大数据面试题整理成了电子书和资源,目录如下: 资源 链接: https://pan.baidu.com/s/1ifHfofjawqD9jn2lvoh0NA 提取码: h79x 另外,微信搜索关注【import_bigdata】,回复【资源】,还有几百G大数据资源下载!

欢迎关注,《大数据成神之路》系列文章

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

王知无(import_bigdata)

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值