久久精品国产亚洲高清|精品日韩中文乱码在线|亚洲va中文字幕无码久|伊人久久综合狼伊人久久|亚洲不卡av不卡一区二区|精品久久久久久久蜜臀AV|国产精品19久久久久久不卡|国产男女猛烈视频在线观看麻豆

千鋒教育-做有情懷、有良心、有品質(zhì)的職業(yè)教育機(jī)構(gòu)

手機(jī)站
千鋒教育

千鋒學(xué)習(xí)站 | 隨時(shí)隨地免費(fèi)學(xué)

千鋒教育

掃一掃進(jìn)入千鋒手機(jī)站

領(lǐng)取全套視頻
千鋒教育

關(guān)注千鋒學(xué)習(xí)站小程序
隨時(shí)隨地免費(fèi)學(xué)習(xí)課程

當(dāng)前位置:首頁  >  應(yīng)聘面試  >  大數(shù)據(jù)面試題  > 必看!拿下這9個(gè)大數(shù)據(jù)面試題,輕松拿下offer

必看!拿下這9個(gè)大數(shù)據(jù)面試題,輕松拿下offer

來源:千鋒教育
發(fā)布人:syq
時(shí)間: 2022-08-09 14:33:14 1660026794

  1. “消費(fèi)組中的消費(fèi)者個(gè)數(shù)如果超過topic的分區(qū),那么就會(huì)有消費(fèi)者消費(fèi)不到數(shù)據(jù)”這句話是否正確?如果正確,那么有沒有什么hack的手段?

  答案:正確,可以通過自定義分區(qū)分配策略,將消費(fèi)者指定到某個(gè)分區(qū)

大數(shù)據(jù)面試題

  2. 有哪些情形會(huì)造成重復(fù)消費(fèi)或消息丟失?

  答案:

  1)當(dāng)poll部分消息集后,立即提交offset,在這部分消息集處理,可能會(huì)發(fā)生異常,這就導(dǎo)致部分消息丟失。

  2)位移提交的動(dòng)作是在消費(fèi)完所有拉取到的消息之后才執(zhí)行的,中間可能發(fā)生異常,恢復(fù)后重新重新拉取,可能會(huì)導(dǎo)致重復(fù)消費(fèi)

  3. KafkaConsumer是非線程安全的,那么怎么樣實(shí)現(xiàn)多線程消費(fèi)?

  答案:

  1)在每個(gè)線程中新建一個(gè)KafkaConsumer

  2)單線程創(chuàng)建KafkaConsumer,多個(gè)處理線程處理消息(難點(diǎn)在于是否要考慮消息順序性,offset的提交方式)

  4. 當(dāng)你使用kafka-topics.sh創(chuàng)建(刪除)了一個(gè)topic

  答案:

  創(chuàng)建:

  1)會(huì)在zookeeper中的/brokers/topics節(jié)點(diǎn)下創(chuàng)建一個(gè)新的topic節(jié)點(diǎn),如:/brokers/topics/first

  2)觸發(fā)Controller的監(jiān)聽程序

  3)kafka Controller 負(fù)責(zé)topic的創(chuàng)建工作,并更新metadata cache

  刪除:

  調(diào)用腳本刪除topic會(huì)在zk上將topic設(shè)置待刪除標(biāo)志,kafka后臺(tái)有定時(shí)的線程會(huì)掃描所有需要?jiǎng)h除的topic進(jìn)行刪除

  5. topic的分區(qū)數(shù),增減問題

  答案:分區(qū)只能增加,不能減少(若是減少分區(qū)需要考慮的問題太多,事物性問題,順序性問題,時(shí)間戳問題,但是收益太小),副本可以減少

  6. 內(nèi)部topic

  _consumeroffsets:作用是保存 Kafka 消費(fèi)者的位移信息,logCleaner線程來完成清除無用的提交(沒有消息消費(fèi)了,默認(rèn)5s一直在提交);

  _transactionstate:用來存儲(chǔ)事務(wù)日志消息

  7. 優(yōu)先副本選舉

  答案:解決當(dāng)某個(gè)主機(jī)down機(jī)后,部分主機(jī)會(huì)有多個(gè)leader 副本,導(dǎo)致負(fù)載不均衡,優(yōu)先副本選舉就是解決此問題,生產(chǎn)上不建議開啟,可以手動(dòng)控制。

  8. 副本怎么同步?

  答案:所謂同步,必須滿足兩個(gè)條件:

  副本節(jié)點(diǎn)必須能與zookeeper保持會(huì)話(心跳機(jī)制)

  副本能復(fù)制leader上的所有寫操作,并且不能落后太多(卡主或滯后的副本控制由replica.lag.time.max.ms配置)

  利用HW,LEO進(jìn)行復(fù)制同步。

  9. 如果我指定了一個(gè)offset,Kafka怎么查找到對(duì)應(yīng)的消息?

  答案:

  1)跳躍表找到分段文件

  2)利用稀疏索引(.index),通過二分法定位到相鄰的offset

  3)接著在segment順序查找

  更多關(guān)于大數(shù)據(jù)培訓(xùn)的問題,歡迎咨詢千鋒教育在線名師,如果想要了解我們的師資、課程、項(xiàng)目實(shí)操的話可以點(diǎn)擊咨詢課程顧問,獲取試聽資格來試聽我們的課程,在線零距離接觸千鋒教育大咖名師,讓你輕松從入門到精通。

tags:
聲明:本站稿件版權(quán)均屬千鋒教育所有,未經(jīng)許可不得擅自轉(zhuǎn)載。
10年以上業(yè)內(nèi)強(qiáng)師集結(jié),手把手帶你蛻變精英
請您保持通訊暢通,專屬學(xué)習(xí)老師24小時(shí)內(nèi)將與您1V1溝通
免費(fèi)領(lǐng)取
今日已有369人領(lǐng)取成功
劉同學(xué) 138****2860 剛剛成功領(lǐng)取
王同學(xué) 131****2015 剛剛成功領(lǐng)取
張同學(xué) 133****4652 剛剛成功領(lǐng)取
李同學(xué) 135****8607 剛剛成功領(lǐng)取
楊同學(xué) 132****5667 剛剛成功領(lǐng)取
岳同學(xué) 134****6652 剛剛成功領(lǐng)取
梁同學(xué) 157****2950 剛剛成功領(lǐng)取
劉同學(xué) 189****1015 剛剛成功領(lǐng)取
張同學(xué) 155****4678 剛剛成功領(lǐng)取
鄒同學(xué) 139****2907 剛剛成功領(lǐng)取
董同學(xué) 138****2867 剛剛成功領(lǐng)取
周同學(xué) 136****3602 剛剛成功領(lǐng)取
相關(guān)推薦HOT
內(nèi)部表和外部表(重點(diǎn))

hive外部表是使用external關(guān)鍵字并指定一個(gè)hdfs目錄創(chuàng)建的表。hive內(nèi)部表在創(chuàng)建時(shí)會(huì)在對(duì)應(yīng)hive目錄下創(chuàng)建相應(yīng)的文件夾,外部表則以指定文件夾為...詳情>>

2022-09-02 17:21:00
Flink checkpoint和savepoint區(qū)別

Checkpoint是為runtime準(zhǔn)備的,Savepoint 是為用戶準(zhǔn)備的。Checkpoint 機(jī)制的目標(biāo)在于保證Flink作業(yè)意外崩潰重啟不影響exactly once 準(zhǔn)確性,通...詳情>>

2022-09-02 16:59:22
Flink State?

State:指一個(gè)具體的Task/Operator的狀態(tài)。State可以被記錄,在失敗的情況下數(shù)據(jù)還可以恢復(fù),F(xiàn)link中有兩種基本類型的State: Keyed State, Op...詳情>>

2022-09-02 16:59:19
Flink反壓機(jī)制?

Flink 內(nèi)部是基于producer-consumer模型來進(jìn)行消息傳遞的,F(xiàn)link的反壓設(shè)計(jì)也是基于這個(gè)模型。Flink 使用了高效有界的分布式阻塞隊(duì)列,就像 Jav...詳情>>

2022-09-02 16:59:16
大數(shù)據(jù)面數(shù)據(jù):Flink Allowed Lateness & Side OutPut?

雖說水位線(Watermark)表明早于它的事件不應(yīng)該再出現(xiàn),但是接收到水位線以前的的消息是不可避免的,這就是所謂的遲到事件。實(shí)際上遲到事件是亂...詳情>>

2022-09-02 16:59:00
快速通道