面试大数据项目怎么准备?

(1)离线数仓:尚硅谷的电商平台v5.0。
         感觉难点在于理清业务逻辑,整体下来就是hive写hql, spark一点没用到。这到时候面试怎么包装啊?
(2)实时数仓:尚硅谷的flink实时数仓。
        正在学。

    本人自然语言处理方向垫底985硕士,准备转大数据,框架看了hadoop,hive,spark,flink,flume,zookeeper,其他的暂时不准备看了,学不完,看了也白看。
    翻经验帖子说大数据项目做这两个,但目前做完离线数仓的感觉就纯sql boy,这….自己学的时候数据规模小的离谱,基本也没碰到大bug,做完感觉平平淡淡…
   1)单上面两个项目感觉不够?各位大神又啥建议吗。
  2)或者还有其他框架需要补? #大数据#
  3)需不需要单独找一个spark的项目练一下spark ,比如spark - streaming的项目?
  
全部评论
我就做了数仓4.0和flink实时数仓
1 回复 分享
发布于 2023-05-04 11:41 北京
1)两个项目够了,但是你做了个尚硅谷离线数仓,事实数仓最后别再用尚硅谷的了,烂大街了。时间充足还想学实时的话最好再找找其他实时项目试试。我当时秋招直接没学flink然后有个后端上线的项目,但是主要找的数仓这块的,java也没怎么问我就是。2)kafka也经常被问,最好也去学学。还有些用到的调度工具偶尔也会问问。3)要是准备做flink感觉没必要再做spark的项目。项目主要在于质量,两个项目做完继续深挖各个组件之间的关系,可能碰到的问题之类的就行,很多细节问题经常会被问到
1 回复 分享
发布于 2023-05-03 08:24 江西
我也是自然语言处理方向转大数据,感觉flink实时数仓还挺重要的
点赞 回复 分享
发布于 2023-05-16 16:43 上海
我也愁,看了b站王知无的视频,感觉尚硅谷的项目好像有点low,我也不知道怎么准备了
点赞 回复 分享
发布于 2023-04-29 20:41 湖北
如果是做大数据平台开发需要再学下Java后端那一套,如果是做数仓把SQL练好就行了
点赞 回复 分享
发布于 2023-04-25 12:37 湖北
看没用,自己搭个测试环境,从采集到数据管理都搞一下
点赞 回复 分享
发布于 2023-04-24 09:04 北京

相关推荐

老粉都知道小猪猪我很久没更新了,因为秋招非常非常不顺利,emo了三个月了,接下来说一下我的情况吧本人是双非本 专业是完全不着计算机边的非科班,比较有优势的是有两段大厂实习,美团和字节。秋招面了50+场泡池子泡死的:滴滴 快手 去哪儿 小鹏汽车 不知名的一两个小厂其中字节13场 两次3面挂 两次2面挂 一次一面挂其中有2场面试题没写出来,其他的都是全a,但该挂还是挂,第三次三面才面进去字节,秋招加暑期总共面了22次字节,在字节的面评可以出成书了快手面了8场,2次实习的,通过了但没去,一次2面挂 最后一次到录用评估 至今无消息滴滴三面完 没几天挂了 所有技术面找不出2个问题是我回答不上来的,三面还来说我去过字节,应该不会考虑滴滴吧,直接给我干傻了去哪儿一天速通 至今无消息小鹏汽车hr 至今无消息美团2面挂 然后不捞我了,三个志愿全部结束,估计被卡学历了虾皮二面挂 这个是我菜,面试官太牛逼了拼多多二面挂 3道题也全写了 也没问题是回答不出来的 泡一周后挂腾讯面了5次 一次2面挂 三次一面挂,我宣布腾讯是世界上最难进的互联网公司然后还有一些零零散散的中小厂,但是数量比较少,约面大多数都是大厂。整体的战况非常惨烈,面试机会少,就算面过了也需要和各路神仙横向对比,很多次我都是那个被比下去的人,不过这也正常,毕竟谁会放着一个985的硕士不招,反而去招一个双非读化学的小子感觉现在互联网对学历的要求越来越高了,不仅仅要985还要硕士了,双非几乎没啥生存空间了,我感觉未来几年双非想要进大厂开发的难度应该直线上升了,唯一的打法还是从大二刷实习,然后苟个转正,不然要是去秋招大概率是炮灰。而且就我面字节这么多次,已经开始问很多ai的东西了,你一破本科生要是没实习没科研懂什么ai啊,纯纯白给了
不知名牛友_:爸爸
秋招你被哪家公司挂了?
点赞 评论 收藏
分享
评论
4
22
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务