9月相关大厂大数据相关面试题
腾讯一面:1、实现一个函数f(x),输入x为正整数,当x=1或者2时f(x)=1,当x2时,f(x)=f(x-1)+f(x-2)2、1T的文本中,每行就一个数字,让我怎么快速高效找出最大的那个数3、数据库表a记录了很多用户在很多城市的访问记录,字段a.user_id, a.city, a.time, a.other_info使用一条SQL查出每个user_id在每个city的最后一条访问记录4、reduceByKey和CombineByKey和aggregateByKey,groupByKey5、hive和impala的区别,有没有一些hive能实现,impala实现不了的6、order by、sort by、7、内部表、外部表8、dataFrame、RDD区别美团SG闪购-数据仓库工程师1、数仓架构分层2、user_id, url, time,使用窗口函数实现,每个用户访问url页面的最长时间top10易车数据仓库架构师面试1、Java的线程,scala的模式匹配java的gc触发条件,为啥频繁gcjvm优化参数2、给你一个其他格式的文件,hive怎么去存储建表(mr的outputformat,inputformat)3、hive或者spark sql怎么转换成底层的程序4、spark提交的一些参数5、现写一个sql,需求为求出连续用户登录的天数6、你做过序列化的事情7、spark内存管理模型8、怎么避免一个一个节点上task分配过多**易车运维架构师1、spark源码、spark RDD、spark调优,spark有哪些shufflemapreduce RPC》》kafka的分区分组》》 dataFrame、dataSet、RDD2、java基础3、scala基础火花思维一面:1、数仓事实表、维度表区别元数据的管理2、大数据生态圈:(a)flume(b)kafka架构(c)hbase的读写、rowkey设计、hbase隔离方案二面:1、hbase 查询的优化2、rowkey的设计3、spark 的kafka的堆积4、急着表达自己的想法5、维度表京东数科1、n个数中不能取相邻两个数,最大的和是多少2、一个楼梯有n阶,每次可以跨1步,也可以跨2步,问有多少种走法3、具体的场景对应的mapreduce,比如两个表进行join4、JVM的复制算法小米大数据开发工程师-商业数据职位岗位职责:1/
上一篇/下一篇内容由系统自动关联
返回资讯列表 →