Welke Kafka-sollicitatievragen kan ik verwachten?
Door Aaron Cao · Bijgewerkt op

Verwacht vier lagen: kernconcepten (topics, partities, offsets, consumentengroepen), leveringsgaranties (at-least-once, exactly-once, idempotente producers), beheer (replicatie, in-sync replica's, retentie, rebalancing) en ontwerpscenario's waarin je het aantal partities bepaalt, sleutels kiest en storingen afhandelt. Interviewers vragen door naar het waarom achter elk antwoord.
Welke Kafka-kernconcepten controleert elke interviewer eerst?
Je weet al dat Kafka een gedistribueerd logboek is en je vreest dat de interviewer één niveau dieper zal gaan dan je dagelijkse gebruik. Dat is precies waar deze vragen naartoe gaan. Daarom behandelt dit gedeelte de terminologie in de volgorde die interviewers doorgaans volgen en benoemt het de vervolgvraag achter elke term.
- Topics en partities. Een topic wordt opgesplitst in partities die elk een alleen-aanvulbaar, geordend logboek vormen. Vervolgvraag: waarom schaalt Kafka schrijfbewerkingen door partities toe te voegen in plaats van één logboek sneller te maken?
- Offsets. De positie van een consumer in een partitie. Vervolgvraag: wie bewaart vastgelegde offsets en wat gebeurt er als een consumer crasht voordat die zijn offset vastlegt?
- Consumentengroepen. Consumers in een groep delen de partities van een topic, waarbij een partitie op een bepaald moment aan hoogstens één consumer in de groep is toegewezen. Vervolgvraag: wat gebeurt er met de doorvoer als de groep meer consumers dan partities heeft?
- Brokers en de controller. Brokers slaan partities op; de controller regelt de verkiezing van leaders en de metadata. Vervolgvraag: wat veranderde er toen Kafka de metadata van ZooKeeper naar KRaft verplaatste?
- Producers en sleutels. Een bericht met een sleutel komt terecht in een partitie die door hashing van de sleutel wordt gekozen; een bericht zonder sleutel wordt over partities verspreid. Vervolgvraag: welke van deze twee bewaart de volgorde van de gebeurtenissen van één klant?
Beantwoord deze vragen met het mechanisme, niet met de slogan. Zeggen dat partities parallelliteit bieden is slechts de basis; uitleggen dat volgorde alleen binnen een partitie bestaat en dat de sleutel daarom het domein van die volgorde bepaalt, is het antwoord waarmee je de volgende ronde bereikt.
Hoe verlopen vragen over leveringsgaranties en replicatie?
Dit is de laag waarop de meeste kandidaten punten verliezen, omdat de termen eenvoudig zijn maar de afwegingen niet. Verwacht dat de interviewer een garantie noemt en je vraagt die met instellingen te realiseren.
- At-most-once tegenover at-least-once. Leg je de offset vóór de verwerking vast, dan kun je een bericht verliezen; verwerk je het eerst en leg je de offset daarna vast, dan kun je het tweemaal verwerken. Leg uit welke storing elke volgorde verdraagt en welke optie jouw systeem verkiest.
- Idempotente producers en exactly-once. Een idempotente producer dedupliceert nieuwe pogingen binnen een partitie; transacties breiden dit uit over partities en naar consumer-offsets in een cyclus van consumeren, transformeren en produceren. Wees voorbereid om te vertellen wat exactly-once niet dekt: een schrijfbewerking naar een achterliggende database buiten de transactie blijft jouw probleem.
- acks, replicatiefactor en in-sync replica's.
acks=allwacht op de verzameling in-sync replica's;min.insync.replicasbepaalt hoe klein die verzameling mag worden voordat schrijfbewerkingen worden geweigerd. Interviewers vragen vaak wat je hier inruilt voor duurzaamheid: latentie en beschikbaarheid wanneer een broker uitvalt. - Retentie en compactie. Retentie op basis van tijd of omvang verwijdert oude segmenten; logcompactie behoudt de nieuwste record per sleutel. Vervolgvraag: welke optie ondersteunt een changelog voor een key-value-store en waarom?
- Rebalancing. Wanneer een consumer toetreedt of vertrekt, worden partities opnieuw toegewezen. Vervolgvraag: wat doet langdurige rebalancing met een latentiegevoelige dienst en hoe verminderen coöperatieve rebalancing en statisch lidmaatschap de hinder?
Een nuttige gewoonte: noem voor elke instelling welke storing ze voorkomt en welke kosten ze toevoegt. Met die structuur beantwoord je de vraag en de vervolgvraag in één adem.
Hoe zien de ontwerp- en scenariovragen eruit?
In sollicitatierondes voor seniorfuncties worden definities vervangen door een scenario en kijkt men hoe je redeneert. Een typische opdracht: een backend-engineer die solliciteert naar een platformfunctie bij een betaalbedrijf, moet een eventpipeline ontwerpen waarin elke transactie voor één rekening op volgorde wordt verwerkt, de doorvoer met het verkeer kan meegroeien en een brokerstoring geen gegevensverlies veroorzaakt. Een sterk antwoord gebruikt de rekening-id als berichtsleutel, zodat gebeurtenissen voor één rekening dezelfde partitie delen, bepaalt het aantal partities op basis van de verwachte piek met groeimarge, stelt replicatie en acks=all in voor duurzaamheid en legt uit hoe consumers offsets vastleggen, zodat een crash berichten opnieuw afspeelt in plaats van overslaat.
Andere terugkerende scenario's zijn: een consumer met een groeiende achterstand en hoe je lag detecteert en inloopt; een topic waarvan je spijt hebt van het aantal partities en waarom herpartitionering de volgorde per sleutel verbreekt; een problematisch bericht dat de consumer laat crashen en het dead-letter-patroon waarmee je het isoleert; schemawijzigingen bij producers en consumers en wat een schemaregister je oplevert. De interviewer zoekt niet naar één juiste architectuur. Die wil dat je de beperking benoemt, een mechanisme kiest en de afweging hardop uitspreekt.
Oefen deze vragen vóór het sollicitatiegesprek hardop in plaats van ze alleen te lezen. Scenariovragen oefenen met een AI-interviewer die doorvraagt, is precies waarvoor de oefenmodus op de pagina proefinterview bedoeld is. De bredere verzameling vragenbanken per functie en onderwerp staat onder sollicitatievragen per functie en onderwerp.
Kan een AI-sollicitatieassistent helpen met Kafka-vragen?
In een gespreksronde wel, binnen eerlijke grenzen. De native desktop-app van SubcueAI voor macOS en Windows neemt de audio van de interviewer en je microfoon op en toont korte antwoordsuggesties in een lokale overlay. Wanneer de interviewer dus vraagt waartegen min.insync.replicas bescherming biedt, staat het mechanisme op je scherm terwijl je het in je eigen woorden uitlegt. De browserextensie doet hetzelfde voor gesprekken in een browsertab en neemt alleen de audio van de vergadertab op. Geen van beide voegt een bot aan het gesprek toe of injecteert iets in de vergaderpagina; de uitleg over de configuratie staat op de pagina handleiding.
De beperkingen zijn belangrijker dan de verkooppraat. Een gesurveilleerde programmeertest, een schermopname of een door het bedrijf beheerde laptop valt buiten het toepassingsgebied, en een live programmeeroefening waarin je onder toezicht een consumer moet implementeren, is je eigen werk. De assistent is het sterkst bij de bovenstaande vragen over terminologie en afwegingen en het zwakst bij alles wat je in een beoordelingsplatform typt. Voordat je erop vertrouwt, geef je je cv aan de assistent, zodat suggesties aansluiten bij het Kafka-werk dat je werkelijk hebt gedaan; dat profiel staat in de cv-bouwer.
FAQ
Waarom kan Kafka alleen de volgorde binnen een partitie garanderen?
Wat is in Kafka het verschil tussen at-least-once en exactly-once?
Hoeveel consumers moet een consumentengroep hebben?
Wat gebeurt er wanneer een Kafka-broker uitvalt?
Kan SubcueAI helpen tijdens een programmeertoets over Kafka?
Gerelateerde vragen
- Welke Databricks-interviewvragen kan ik verwachten?
- Welke .NET-sollicitatievragen kan ik verwachten?
- Welke sollicitatievragen kan ik als quality engineer verwachten?
- Welke quant-interviewvragen kan ik verwachten?
- Welke Snowflake-interviewvragen kan ik verwachten?
- Welke sollicitatievragen kan ik als leraar verwachten?