Een geprovisioneerde Amazon Redshift-cluster met vijf ra3.4xlarge-nodes vertoont tijdens normale operaties frequent één node met meer dan 90% CPU-gebruik, terwijl de andere vier onder de 15% blijven. Het cluster maakt gebruik van key distribution. De engineer wil hetzelfde aantal nodes behouden, maar de belasting over de nodes verdelen. Welke wijziging zal dit bewerkstelligen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Wijzig de distribution key naar de tabelkolom met de grootste dimensie..
Waarom dit het antwoord is
De correcte optie is om de distribution key te wijzigen naar de tabelkolom met de grootste dimensie. Dit komt omdat Redshift een MPP-architectuur (Massively Parallel Processing) gebruikt, waarbij data over nodes wordt verdeeld. Een scheve datadistributie (data skew) kan leiden tot één of enkele overbelaste nodes, terwijl andere onderbenut blijven. Het kiezen van een distribution key met een hoge kardinaliteit (veel unieke waarden) en een gelijkmatige spreiding zorgt voor een betere verdeling van de data en daarmee de workload over alle nodes. De andere opties zijn minder effectief: Het wijzigen van de sort key optimaliseert de prestaties van queries met ORDER BY of GROUP BY clausules, maar lost het probleem van scheve datadistributie niet op. Het upgraden van de reserved node naar een grotere instantie verhoogt de capaciteit van elke node, maar lost de ongelijke verdeling van de workload niet op. De ene node zal nog steeds overbelast zijn, terwijl de andere onderbenut blijven. Het wijzigen van de primary key heeft geen directe invloed op de datadistributie over de nodes.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig