Google ACE: Kostenbeheer, prestaties en capaciteitsoptimalisatie — Studiegids
Onderdeel van de Google Associate Cloud Engineer — Studiegids. Oefen met geverifieerde antwoorden in het Google-examencentrum, of doe getimede oefentests op ExamRoll.io.
Overzicht
Kostenbeheer en optimalisatie van prestaties/capaciteit op Google Cloud vereisen continue zichtbaarheid, beslissingen over ‘right-sizing’ en governance die het gebruik van resources afstemt op bedrijfsdoelstellingen. Effectieve praktijken combineren financiële controles (budgetten, toewijzing), technische hefbomen (autoscaling, reserveringen, lifecycle-beleid), architecturale keuzes (datalocatie, replicatie) en operationele feedback (telemetrie, loadtests). Dit gedeelte beschrijft de belangrijkste tools, afwegingen en ‘failure modes’ voor compute, opslag, dataverwerking, netwerken, databases, quota’s en performance engineering.
Zichtbaarheid van kosten, budgetten en toewijzing
Factureringsrapporten en -exports:
- Gebruik Cloud Billing Reports voor snelle trend- en SKU-analyses; activeer de export van Cloud Billing-data naar BigQuery voor gedetailleerde, bevraagbare kosten- en gebruiksgegevens. Dit ondersteunt dagelijkse/maandelijkse prognoses, anomaliedetectie en ‘rollups’ over meerdere projecten met standaard SQL.
- De export van de prijstabel helpt bij het afstemmen van catalogusprijzen met SKU-kosten en tegoeden.
- Failure modes: Alleen de console-weergaven gebruiken beperkt de granulariteit; het niet exporteren naar BigQuery blokkeert historische modellering en nauwkeurige showback/chargeback.
Budgetten en waarschuwingen:
- Maak budgetten aan die gescoped zijn op factureringsaccounts, projecten, mappen, services of filters op labels/tags; configureer drempelwaarschuwingen (bijv. 50/90/100%) op basis van werkelijke en voorspelde kosten. Overweeg notificatiekanalen via Pub/Sub om geautomatiseerde acties te activeren (bijv. het pauzeren van non-prod).
- Afweging: Agressieve geautomatiseerde shutdowns verminderen de uitgaven, maar kunnen de betrouwbaarheid schaden als ze worden toegepast op productiesystemen.
Labels en tags voor toewijzing:
- Pas resource-labels en Resource Manager-tags consistent toe (env, app, owner, cost-center). Tags ondersteunen organisatiebeleid en verschijnen in factureringsfilters voor robuuste toewijzing.
- Governance: Dwing beleid voor labels/tags af met Organization Policy, deployment-templates en CI/CD-controles.
- Failure modes: Inconsistente sleutels of ontbrekende labels breken toewijzingsmodellen; overgeërfde tags die niet op alle resourcetypes worden toegepast als de tooling inconsistent is.
Kostenallocatiemodellen:
- Showback/chargeback gebruiken doorgaans een hiërarchie: project → service/SKU → label/tag. Gedeelde platformkosten (bijv. load balancers, VPC egress) kunnen worden toegewezen op basis van ‘drivers’ zoals het aantal verzoeken, overgedragen GB’s of CPU-uren, gemeten via logs/metrics.
- Afweging: Eenvoudige modellen (gelijke verdeling) zijn makkelijk uit te voeren, maar kunnen zware gebruikers verkeerd prijzen; granulaire modellen vereisen betrouwbare telemetrie en meer overhead.
Kort voorbeeld (BigQuery dry run voor kostenschatting):
undefined
Compute-efficiëntie en lifecycle-optimalisatie
Rightsizing en custom machine types:
- Gebruik de Recommender API/console om VM’s te ‘rightsizen’ op basis van percentielen van CPU/geheugengebruik. Geef de voorkeur aan ‘custom machine types’ voor stabiele, niet-standaard behoeften (bijv. 2 vCPU/10 GB RAM) om te voorkomen dat u betaalt voor ongebruikte capaciteit.
- Failure modes: Het verkleinen van latency-gevoelige of ‘bursty’ services kan ’throttling’ veroorzaken. Valideer met loadtests en zorg voor voldoende buffer.
Committed Use Discounts (CUDs):
- Koop resource-gebaseerde CUD’s (vCPU, geheugen, GPU’s) op regionaal niveau voor termijnen van 1 of 3 jaar via de console of CLI. Ideaal voor stabiele basiscapaciteit; gebruik autoscaling voor pieken.
- Afwegingen: ‘Commitments’ verlagen de eenheidsprijs maar zijn inflexibel. Te veel ‘committen’ legt uitgaven vast; te weinig ‘committen’ betekent dat u kortingen misloopt.
Spot VMs:
- Gebruik Spot VMs voor fouttolerante, onderbreekbare workloads (batch, CI, stateless tiers). Implementeer ‘checkpointing’ en afhandeling van ‘preemption’ (een waarschuwing van 30 seconden via metadata/Pub/Sub).
- Failure modes: Capaciteit kan op elk moment verdwijnen; plaats nooit stateful of quorum-kritieke services uitsluitend op Spot.
Autoscaling, scheduling en lifecycle:
- Managed instance groups (MIGs) met autoscaling (op basis van CPU, load balancer of aangepaste Cloud Monitoring-metrics) vangen variabele belasting op. Stel de ‘cool-down’- en ‘scale-in’-controles af om schommelingen te voorkomen; stem de initiële vertraging van de health check af op de ‘readiness’ van de applicatie.
- Scheduling: Stop of onderbreek dev/test VM’s buiten kantooruren; gebruik Instance Schedules of automatisering met Cloud Scheduler en Cloud Functions om kosten voor inactiviteit te minimaliseren.
- Lifecycle en onderhoud: Schakel automatische herstart en ‘host maintenance migrate’ in voor hoge beschikbaarheid; houd er rekening mee dat live migration mogelijk niet van toepassing is bij GPU’s of local SSD’s.
- Opruimen van ongebruikte resources: Ruim niet-gekoppelde persistent disks, verouderde snapshots en ongebruikte statische IP-adressen op met behulp van Recommender.
- Failure modes: Te korte vertragingen bij health checks of ontbrekende ‘readiness’-signalen veroorzaken overprovisioning; te agressieve ‘scale-in’ verbreekt verbindingen; het uitschakelen van ‘autohealing’ verbergt falende nodes.
Korte voorbeelden:
undefined
undefined
Economie van Opslag en Dataverwerking
Cloud Storage-klassen en levenscyclus:
- Kies klassen op basis van toegangspatroon: Standard (hot), Nearline (≥30 dagen min.), Coldline (≥90 dagen min.), Archive (≥365 dagen min.). Pas levenscyclusregels toe om data volgens schema naar een lagere tier te verplaatsen en te verwijderen.
- Afwegingen bij retrieval: Goedkopere klassen brengen per-GB retrievalkosten en kosten voor minimale opslagduur met zich mee; frequente reads op Coldline/Archive doen de besparingen teniet. Plan herstelworkflows met het oog op piek-readkosten.
- Governance: Gebruik bewaarbeleid en object holds voor compliance; activeer requester-pays voor gedeelde datasets om onverwachte facturering tussen teams te voorkomen.
Voorbeeld van een levenscyclusbeleid (eerst tiering, dan verwijderen):
- Definieer op leeftijd gebaseerde SetStorageClass- en Delete-acties om transities en het opruimen van verouderde data te automatiseren.
Kostenbeheersing in BigQuery:
- On-demand query’s worden gefactureerd per verwerkte bytes; minimaliseer dit met partition pruning en clustering. Partitioneer op opnametijd of een datumkolom; cluster op maximaal vier kolommen met hoge kardinaliteit/selectiviteit.
- Gebruik dry runs om kosten te schatten, gematerialiseerde views voor veelgebruikte aggregaties en tabeldecorators om tijdvensters te verkleinen.
- Reserveringen (slots) bieden voorspelbare prestaties en uitgaven; gebruik toewijzingen per project/folder en overweeg flex commitments voor korte pieken.
- Foutscenario’s: Niet-gepartitioneerde scans, SELECT * in brede tabellen, of slecht geordende clustering genereren een enorme hoeveelheid gescande bytes; tijdelijke tussentabellen kunnen de opslagkosten opblazen als ze niet verlopen.
Kort voorbeeld (Cloud Storage levenscyclus JSON-fragment):
- { “rule”: [ {“action”: {“type”: “SetStorageClass”, “storageClass”: “COLDLINE”}, “condition”: {“age”: 90}}, {“action”: {“type”: “Delete”}, “condition”: {“age”: 365}} ] }
Netwerken, Databases en Quota-bewuste Schaalbaarheid
Impact van netwerk-egress en architectuur:
- Egress naar het internet, tussen regio’s en via externe IP’s brengt kosten met zich mee; verkeer binnen dezelfde regio via interne IP’s is over het algemeen gratis. Kies Premium Network Tier voor prestaties of Standard voor kostengevoelige workloads met minder strikte eisen voor latency/jitter.
- Load balancers: L7 HTTP(S) en L4 TCP/UDP hebben kosten voor dataverwerking en forwarding rules; cross-region LB’s kunnen inter-regionale egress toevoegen. Het consolideren van LB’s bespaart vaste kosten, maar kan de blast radius vergroten.
- Optimalisatie: Houd verkeer binnen de regio; gebruik regionale buckets en services; vermijd hairpinning via externe IP’s. Cache statische assets aan de edge om egress vanaf de origin te verminderen.
- Foutscenario’s: Het per ongeluk gebruiken van externe IP’s tussen services in dezelfde VPC veroorzaakt onnodige egress; multi-regionale replicatie verdubbelt de egress voor schrijfacties.
Dimensionering van databases, replica’s en beschikbaarheid:
- Cloud SQL: Dimensioner vCPU/RAM op de 95e-percentielbelasting; schakel automatische opslaggroei in; gebruik read replica’s voor scale-out van reads; HA verdubbelt de compute-kosten maar verlaagt de RTO bij failover. Connection pooling voorkomt excessieve overhead van verbindingen.
- Spanner: Capaciteit wordt geprovisioneerd als nodes of processing units; multi-regionale configuraties verbeteren de beschikbaarheid en read-latency, maar verhogen de kosten en write-latency; plan splits en hotspots zorgvuldig.
- Bigtable: Het aantal nodes bepaalt de doorvoersnelheid; de autoscaler helpt het verkeer te volgen; multi-cluster replicatie voegt beschikbaarheid en kosten toe; ontwerp een schema voor een gelijkmatige key-distributie.
- Afwegingen: Replica’s verbeteren de read-doorvoersnelheid en beschikbaarheid, maar verhogen write amplification en egress; sterke consistentie en multi-regionale writes voegen latency toe.
Quota’s, rate limits en backpressure:
- Begrijp de quota’s per API en de concurrency per service. Implementeer exponential backoff met jitter voor 429/5xx-fouten. Pas wachtrij-gebaseerde load leveling toe met Pub/Sub en Dataflow of Cloud Run jobs.
- Concurrency-instellingen: In Cloud Run verlaagt een hogere concurrency de kosten, maar riskeert tail latency; stem de CPU-toewijzing per request af voor een stabiele doorvoersnelheid.
- Backpressure: Gebruik flow control in Pub/Sub subscribers, circuit breakers en admission control om cascade-storingen te voorkomen.
- Foutscenario’s: Het negeren van quota’s leidt tot plotselinge throttling; autoscaling kan de belasting op downstream systemen versterken zonder backpressure, wat leidt tot retries en oplopende kosten.
Prestatiemeting en Optimalisatie Governance
Meting en loadtesten:
- Stel SLI’s/SLO’s vast voor latency, foutpercentage en verzadiging. Gebruik Cloud Monitoring-dashboards, uptime-controles en alarmering. Instrumenteer tracing (Cloud Trace) en profiling (Cloud Profiler) om ‘hot paths’ en ’lock contention’ te lokaliseren.
- Voer loadtests uit met realistische verkeersmodellen, datakardinaliteit en ’think times’. Valideer autoscaler-parameters, warm-up en ‘readiness gates’. Neem failover- en chaosscenario’s op om capaciteitsruimte (‘headroom’) en hersteltijd te observeren.
- Knelpunt-diagnose: Gebruik de USE-methode (Utilization, Saturation, Errors) voor CPU, geheugen, schijf, netwerk en downstream-afhankelijkheden; correleer met logs en traces.
Governance voor de balans tussen kosten, beveiliging en betrouwbaarheid:
- FinOps-guardrails: Verplichte labels/tags; budgetten met voorspellingsalarmen; gecentraliseerde factureringsexports en periodieke kostenbeoordelingen. Neem Recommender-bevindingen (inactieve IP’s/schijven, rightsizing) op in de backlog met SLA’s voor eigenaren.
- Beveiliging: Geef de voorkeur aan private connectiviteit (geen externe IP’s), VPC Service Controls voor risico’s op data-exfiltratie—erken dat private paden egress-patronen en kosten kunnen veranderen. Versleutel data ‘at rest’ en ‘in transit’; neem KMS-gebruik op in kostenmodellen.
- Betrouwbaarheid: Reserveer basiscapaciteit via CUD’s of BigQuery-reserveringen; behoud ‘burst headroom’ voor SLO’s; voer regelmatig ‘game days’ uit. Documenteer wanneer Spot of agressieve autoscaling onaanvaardbaar is voor kritieke paden.
- Wijzigingsbeheer: Behandel kostenbeïnvloedende parameters (autoscaler-limieten, BigQuery-reserveringen, LB-topologie) als code met review- en rollback-plannen.
Praktijkscenario
Contoso Media beheert een multi-region video-analyseplatform dat te maken heeft met stijgende kosten en incidentele schendingen van de latency-SLO tijdens verkeerspieken. Het management wil een kostenreductie van 20% zonder de p95 latency-SLO van 300 ms voor de API en een SLA van 2 uur voor de nachtelijke batchverwerking in gevaar te brengen.
- Stel kosten- en prestatiebaselines vast
- Actie: Activeer de Cloud Billing-export naar BigQuery en maak dashboards die SKU-kosten correleren met Cloud Monitoring SLI’s (latency, CPU, bytes egressed). Voer bq dry runs uit op de top 20 queries om de gescande bytes in te schatten.
- Reden: Baselines identificeren services met een hoge impact en brengen uitgaven in kaart met prestatie-indicatoren, wat gerichte optimalisatie mogelijk maakt.
- Dwing allocatietagging en budgetten af
- Actie: Vereis labels/tags (env, service, owner, cost-center) via deployment-templates; stel per omgeving budgetten in met voorspellingsalarmen naar een FinOps Pub/Sub-topic.
- Reden: Volledige allocatiegegevens en proactieve alarmen maken snelle toewijzing van eigenaarschap en corrigerende maatregelen mogelijk voordat budgetten worden overschreden.
- Rightsize en commit basis-compute
- Actie: Pas Recommender VM-rightsizing toe op stabiele services; zet de steady-state capaciteit om in 1-jarige regionale CUD’s; houd een buffer van 20-30% aan op het maximum van de autoscaler voor pieken.
- Reden: Rightsizing en commitments verlagen de kosten per eenheid voor voorspelbare workloads, terwijl er ruimte (‘headroom’) wordt behouden voor SLO’s.
- Optimaliseer autoscaling en readiness
- Actie: Schakel voor MIG’s de autoscaling-signalen over naar request-based of aangepaste QPS/latency-metrics, stel de ‘cool-down’ in op 120-180 seconden en stem de ‘initial delay’ van de health check af op de warm-up van de applicatie. Activeer ‘scale-in controls’ om snelle neerschaling te voorkomen.
- Reden: Workload-bewuste signalen en stabilisatie voorkomen ’thrashing’ en overprovisioning die de kosten opdrijven en de latency schaden.
- Verminder netwerk-egress en load balancer-overhead
- Actie: Verwijder externe IP-communicatie tussen services; zorg ervoor dat al het oost-west verkeer interne load balancing gebruikt; co-locate ‘chatty’ services binnen regio’s; cache statische assets aan de edge.
- Reden: Interne paden elimineren onnodige egress en verminderen L7-verwerking, wat de latency en kosten verbetert.
- Opslaglevenscyclus en archivering
- Actie: Pas Cloud Storage lifecycle-regels toe om koude artefacten na 90 dagen naar Coldline te verplaatsen en na 365 dagen te verwijderen; stel ‘requester-pays’ in op gedeelde buckets; evalueer de implicaties van de minimale opslagduur voor data die zelden wordt benaderd.
- Reden: Tiering en retentie verlagen de opslag- en ophaalkosten terwijl de compliance intact blijft.
- BigQuery query- en capaciteitstuning
- Actie: Partitioneer grote feitentabellen op datum, cluster op kolommen met hoge selectiviteit; vervang SELECT * door kolomprojecties; introduceer ‘materialized views’ voor de belangrijkste aggregaties; schaf een kleine reservering aan voor piek-ETL-vensters en gebruik flex slots tijdens batch-pieken.
- Reden: Partitionering/clustering vermindert het aantal gescande bytes; capaciteitsreserveringen stabiliseren de prestaties en kosten voor kritieke workloads.
- Databaseschaal en replica’s
- Actie: Voeg voor Cloud SQL read-heavy services ‘read replicas’ toe; stem ‘connection pooling’ af; stel automatische opslaggroei in; test failover om RTO/RPO te valideren. Voor Bigtable, activeer de autoscaler en pak ‘hotspot keys’ aan.
- Reden: Replica’s ontlasten leesoperaties en beschermen schrijfpaden; autoscaling houdt de doorvoer in lijn met de vraag zonder handmatige overprovisioning.
- Quota’s, concurrency en backpressure
- Actie: Implementeer ’exponential backoff with jitter’; configureer Pub/Sub subscriber ‘flow control’; stel Cloud Run-concurrency in om een balans te vinden tussen doorvoer en latency; voeg ‘circuit breakers’ toe aan de grenzen met downstream-systemen.
- Reden: Correcte ‘backpressure’ voorkomt ‘cascading failures’ en op hol geslagen ‘retries’ die SLO’s verslechteren en de kosten opdrijven.
- Continue validatie en governance
- Actie: Voer maandelijks loadtests en ‘chaos drills’ uit; volg SLO/error-budgetten; integreer Recommender- en kostenanomalieën in de sprintplanning met eigenaren en deadlines.
- Reden: Iteratieve validatie zorgt ervoor dat besparingen behouden blijven en SLO’s groen blijven naarmate workloads evolueren.
← Betrouwbaarheid · Alle domeinen
Oefen deze vragen → · Getimede oefening op ExamRoll.io →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
Slaag voor je examen →