数新智能 数据开发 一面

30分钟
0.自我介绍
1.谈了谈有无考公考研的打算
2.回归正题 介绍项目(某硅谷的离线实时,还有paimon湖仓)
讲了讲ads层指标什么三天登录,用户流向分析之类的,我说这三个项目指标都差不多
问了我在哪做的,我说在自己虚拟机上部署的
问数据来源,我说是有模拟生成业务库数据和日志数据的jar包,然后讲了一个这两条链路的数据的路径,maxwell,flume,kafka什么的
然后问我paimon湖仓 怎么做的  我说paimon湖仓用官方的mysql-paimon的包直接进行同步,代替了maxwell
然后我说paimon的snapshot+tag代替了传统离线的拉链表,感觉很方便,问我什么地方做的拉链,我说的用户表,然后我又讲了讲hdfs的小文件,paimon怎么解决的实时写入的小文件
问了有没有遇到过什么问题  我说遇到执行任务的时候doris fe节点崩溃,查不到数据,然后我就一直扩大内存,虚拟机也搞得一台25g了
3.flink怎么保证数据不丢不重   我答了kafka支持事务,checkpoint记录状态和kafka消费位点,又讲了paimon sink的时候自动清除没有snapshot指向的manifest来删除故障前多读的数据,说了一堆paimon相关的,比如lsm树文件结构,checkpoint时产生snapshot,还有paimon写入文件的大概流程
4.数据倾斜  我说的原因就是比如短视频业务下某个视频火了产生热点key,导致某个分区数据特别多,可以用flink的重分区算子,写代码加盐打散,或者自定义kafka的分区逻辑
5.sql优化  我说的谓词下推提前过滤,多表join优先join小表,还有starrocks,doris这些olap引擎的CBO优化查询,讲了starrocks物化视图是一个实际读出来的表,可以设置新鲜度来变更读的频率,而且CBO会自动查询sql语句的查询结果是不是某个物化视图的子集,以此来优化,然后这些引擎底层也会帮我们做些优化。
6.问我知道paimon的结构化非结构化数据的存储格式吗    不知道,没接触过
6.1讲一下什么是湖仓一体 我说是湖的各种数据都能存和仓的规范的,规定好字段名,类型等元数据便于分析的能力的结合,我自己又说了一些什么schema on write,read之类的
7.问我还知道什么数据湖技术  我说iceberg,hudi 区别我之前看过,但是忘了,我就记得paimon和flink的集成比较好,比较亲儿子,然后就没问了
8.怎么看现在很多人都投身大模型行业   我说的感觉很正常,因为这个ai本身看着就很吸引人()
8.1我说我用过那个阿里云的data什么,面试官说dataworks是吧,就是我们之前做的,问我还用过什么,我说阿里云的flink,fluss都用过,也用过神策,然后面试官讲了讲他们的产品
8.2说了说我做过的其他东西,我说我搭建过网站,做过抖音小游戏但是上架太麻烦()
9.英语好不好  我答:半废   面试官说那海外业务就不考虑你了
10.怎么看data+ai (因为我简历上写了了解data+ai)我说的就是从前我们用个什么库只能对文字完成基本情感的正负分析,而引入了大模型就可以做出更精确的判断,比如用在用户直播间识别弹幕给主播提建议,或者金融行业智能agent检测到风险实时邮件通知之类的
反问 15分钟
1.flink现实市场上用的多不多
2.paimon这类数据湖到底用的多不多

当时忘录音了(),有的问题记不清了
整场面试也是又说有笑,面试体验给到夯()🤠🤠🤠
全部评论
兄弟是在boss上投的吗,他们这个岗位好像偏实施
点赞 回复 分享
发布于 2025-12-03 16:39 江苏

相关推荐

03-22 23:01
已编辑
东莞理工学院 Java
📍面试公司:好未来🕐面试时间:03/14💻面试岗位:golang后端开发❓面试问题:1. 自我介绍(项目、技术栈、实习经历)2. 手撕三数之和最接近目标值问题3. MySQL 索引为什么用 B+ 树,B+ 树优势4. 订单表 SQL 编写:查询订单总价<10 元且存在单价>10 元商品的订单5. Redis 在礼物连击/礼物飘屏业务中的使用场景6. Redis 自增 + 过期时间为什么要放在 Lua 脚本里保证原子性7. Redis 数据结构、Key 设计8. 高并发下礼物连击方案优化、批处理、管道、限流熔断9. Redis 集群/主从架构了解10. TCP 四次挥手为什么需要四次11. TIME_WAIT 过多的解决办法12. 线上 Bug 排查案例(版本管理、ID 不一致、网关权限问题)13. Java 服务内存突然 100% 如何快速止损 & 定位问题14. 内存飙高可能原因清单(请求积压、死锁、递归、大对象、Excel 导入等)15. 线上紧急恢复思路(秒级/分钟级恢复可用)16. 离职原因17. 目前 offer 情况、职业规划、技术栈偏好(Go/Java)、行业方向🙌面试感想:二面面试完了之后,当天下午也是直接通知了HR面,今天刚面完HR面,感觉还行,希望能从池子里泡出来吧,许愿
我要悔过自新:蹲offer
查看17道真题和解析
点赞 评论 收藏
分享
评论
7
14
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务