Slow consumer group after adding an ML enricher
Your team runs a Kafka consumer group enriching payment events with fraud signals — about 2M events/day across 12 partitions and 6 consumer instances. Last sprint someone added a new ML model that takes ~80ms per event (up from ~5ms). Consumer- group lag is now spiking to 30+ minutes during peak. The on-call DE just paged you to figure it out.