Skip to main content

Scans uitvoeren

Leer hoe u DQS-scans uitvoert, de voortgang volgt, grote datasets aanpakt en terugkerende scans inplant.

Bijgewerkt

Scans uitvoeren

Hoe scans werken

Wanneer u een scan uitvoert, toetst DQS uw Salesforce-records aan de mogelijkheden die u hebt geconfigureerd. De scan draait op de achtergrond met Salesforce Batch Apex, zodat u tijdens de verwerking gewoon kunt doorwerken.

DQS respecteert de Salesforce governor limits automatisch. Uw org blijft tijdens scans responsief.

Een handmatige scan uitvoeren

Een scan starten

  1. Open DQS vanuit de App Launcher
  2. Zoek uw Definition in de lijst
  3. Klik op Run Scan (of het play-icoon)
  4. Bevestig om te starten

De scan begint meteen met verwerken.

Statusindicatoren van een scan

Status Icoon Betekenis
Queued Klok Wacht om te starten
Processing Spinner Wordt momenteel uitgevoerd
Completed Vinkje Succesvol afgerond
Failed X Er is een fout opgetreden

Actieve scans bekijken

Het DQS-startscherm toont alle lopende scans:

  • Naam van de Definition
  • Voortgangspercentage
  • Verwerkte records / totaal
  • Verstreken tijd
  • Geschatte resterende tijd

Voortgang begrijpen

Voortgang volgen

DQS verwerkt records in batches. De voortgangsbalk toont:

  • Voltooide batches van het totaal aantal batches
  • Verwerkte records van het totaal aantal records
  • Huidige mogelijkheid die wordt geëvalueerd

Voorbeeld: “Processing batch 5 of 12 (2.500 of 6.000 records) - Completeness”

Verwerkingsvolgorde

DQS evalueert de mogelijkheden in deze volgorde:

  1. Volledigheid (snelle veldcontroles)
  2. Geldigheid (matching van formaatpatronen)
  3. Tijdigheid (datumvergelijkingen)
  4. Consistentie (waardeconformiteit)
  5. Uniciteit (duplicaatdetectie)
  6. AI-gereedheidsmogelijkheden

De goedkopere mogelijkheden draaien eerst om snel feedback te geven.

Geschatte tijd

De scanduur hangt af van:

Factor Impact
Aantal records Meer records = langere tijd
Aantal velden Meer velden = langere tijd
Kosten van mogelijkheid HOOG-kostende mogelijkheden duren langer
Belasting van de org Drukke orgs verwerken trager

Gebruikelijke verwerkingssnelheden:

Aantal records Geschatte tijd
1.000 Minder dan 1 minuut
10.000 2-5 minuten
100.000 15-30 minuten
1.000.000+ 1-2 uur

Dit zijn schattingen. De werkelijke tijd varieert afhankelijk van de selectie van mogelijkheden en de activiteit in de org.

Verwerkingskosten

Elke mogelijkheid heeft verwerkingskosten die de scanduur beïnvloeden.

Kostenniveaus

Kosten Mogelijkheden Opmerkingen bij verwerking
LAAG Volledigheid, Geldigheid Eenvoudige veldcontroles per record
GEMIDDELD Tijdigheid, Consistentie, PII-detectie Patroonanalyse en datumberekeningen
HOOG Uniciteit Vergelijkingen tussen records

Kostenberekening

De samenvatting van de Definition toont de geschatte totale kosten:

  • Low - alle geselecteerde mogelijkheden zijn LAAG-kostend
  • Medium - ten minste één GEMIDDELD-kostende mogelijkheid
  • High - ten minste één HOOG-kostende mogelijkheid

Tip: Begin bij uw eerste scan op een grote dataset met uitsluitend LAAG-kostende mogelijkheden. Voeg HOOG-kostende mogelijkheden toe zodra u de baseline begrijpt.

Details over batchverwerking

Hoe Batch Apex werkt

DQS gebruikt Salesforce Batch Apex om records te verwerken. Dit houdt het volgende in:

  1. Records worden verdeeld in batches (standaard: 200 records per batch)
  2. Elke batch wordt onafhankelijk verwerkt
  3. Als één batch faalt, gaan de andere door
  4. De governor limits worden tussen batches gereset

Dankzij deze aanpak kan DQS:

  • Miljoenen records verwerken
  • De Salesforce-limieten respecteren
  • Draaien zonder gebruikers te blokkeren
  • Hervatten na een onderbreking

Salesforce governor limits

Batch Apex kent deze belangrijke limieten:

Limiet Waarde Opmerkingen
Max. batchjobs in wachtrij 5 DQS gebruikt 1 job per scan
Records via QueryLocator 50 miljoen Ruim voldoende voor de meeste orgs
Dagelijkse batch-uitvoeringen 250.000 Over alle batchjobs in de org

DQS is zo ontworpen dat het ruim binnen deze limieten blijft.

Optimalisatie van de batchgrootte

DQS past de batchgrootte aan op basis van de complexiteit van de mogelijkheden:

Type mogelijkheid Batchgrootte
Alleen LAAG-kostend 200 records
GEMIDDELD-kostend inbegrepen 200 records
HOOG-kostend inbegrepen 100 records

Kleinere batches voor complexe mogelijkheden voorkomen time-outfouten.

Grote datasets aanpakken

Datasets met meer dan 100.000 records

Volg voor grote datasets deze werkwijzen:

  1. Gebruik filters om de scope te beperken
  2. Begin met LAAG-kostende mogelijkheden
  3. Voer scans uit buiten piekuren waar mogelijk
  4. Volg de voortgang op eventuele problemen

Datasets met meer dan 1 miljoen records

Voor zeer grote datasets:

  1. Segmenteer uw data met meerdere Definitions met filters
  2. Plan scans in tijdens onderhoudsvensters
  3. Voer mogelijkheden afzonderlijk uit indien nodig
  4. Gebruik segmentatie om data parallel te verwerken

Voorbeeld van segmentatie:

  • Definition A: Contacts waar Region = ‘Americas’
  • Definition B: Contacts waar Region = ‘EMEA’
  • Definition C: Contacts waar Region = ‘APAC’

Prestatietips

Tip Voordeel
Minder velden per Definition Snellere verwerking
Recordfilters gebruiken Kleinere dataset om te scannen
HOOG-kostende mogelijkheden apart uitvoeren Beter zicht op de voortgang
Inplannen buiten piekuren Minder concurrentie om resources

Voltooiing van een scan

Voltooiingsmeldingen

Wanneer een scan klaar is, ontvangt u:

  1. Melding in de app - het belicoon toont nieuwe resultaten
  2. E-mailmelding - een samenvatting wordt naar uw e-mail gestuurd
  3. Update op het startscherm - de status verandert naar Completed

Resultaten bekijken

Klik op een voltooide scan om te zien:

  • De algehele kwaliteitsscore
  • Scores per dimensie
  • Statistiekdetails
  • Inzoomen op de betrokken records

Zie Resultaten begrijpen voor begeleiding bij de interpretatie.

Scangeschiedenis

DQS houdt een geschiedenis bij van alle scans per Definition:

  • Datum en tijd
  • Duur
  • Aantal records
  • Algehele score
  • Vergelijking met de vorige scan

Gebruik de geschiedenis om verbetering in de tijd te volgen.

Scans inplannen

U kunt terugkerende scans inplannen om de monitoring van uw datakwaliteit te automatiseren.

Een planning instellen

  1. Open uw Definition
  2. Klik op Schedule (klokicoon)
  3. Kies een frequentie:
    • Dagelijks
    • Wekelijks (selecteer een dag)
    • Maandelijks (selecteer een datum)
  4. Stel de starttijd in
  5. Klik op Save Schedule

Best practices voor planning

Frequentie Use case
Dagelijks Veel data-invoer, monitoring van kritieke kwaliteit
Wekelijks Standaard kwaliteitsbewaking, trendanalyse
Maandelijks Rapportage aan de directie, compliance-audits

Tip: Plan scans in buiten piekuren (’s ochtends vroeg of in het weekend) om de impact op gebruikers te minimaliseren.

Planningen beheren

Vanaf de detailpagina van de Definition:

  • Edit - frequentie of tijd wijzigen
  • Pause - tijdelijk stoppen zonder te verwijderen
  • Resume - een gepauzeerde planning hervatten
  • Delete - de planning volledig verwijderen

Planningslimieten

Geplande scans zijn beschikbaar voor alle gebruikers, zonder limiet op het aantal planningen dat u kunt instellen.

Een scan annuleren

Hoe u annuleert

  1. Zoek de lopende scan op het startscherm
  2. Klik op het stop-icoon (of Cancel)
  3. Bevestig de annulering

Wat er gebeurt bij annulering

  • De verwerking stopt na de huidige batch
  • Gedeeltelijke resultaten worden opgeslagen
  • De status verandert naar “Canceled”
  • U kunt de verzamelde gedeeltelijke data bekijken

Geannuleerde scans tellen niet mee voor de limieten.

Probleemoplossing

“Scan queued but not starting”

Oorzaak: er draaien andere batchjobs in uw org.

Oplossing: wacht tot de andere jobs klaar zijn. Salesforce staat maximaal 5 gelijktijdige batchjobs toe.

Controleer: Setup > Apex Jobs om te zien wat er draait.

“Scan failed”

Oorzaak: meestal een dataprobleem of een rechtenprobleem.

Oplossing:

  1. Bekijk de foutmelding in de scandetails
  2. Controleer of u toegang hebt tot het object en de velden
  3. Controleer eventuele filtervoorwaarden op fouten
  4. Probeer een scan met minder records

“Scan taking too long”

Oorzaak: een grote dataset of HOOG-kostende mogelijkheden.

Oplossing:

  1. Laat de scan voltooien (hij komt uiteindelijk wel klaar)
  2. Voeg filters toe om het aantal records te verminderen
  3. Verwijder HOOG-kostende mogelijkheden
  4. Plan de scan in buiten piekuren

“Results don’t show all records”

Oorzaak: filtervoorwaarden hebben sommige records uitgesloten.

Oplossing: controleer en pas de filters van uw Definition aan.

Volgende stappen