Ta kontakt

Kursplan

Innføring i Teradata

Modul 1: Teradas grunner og arkitektur

  • Hva er Teradata, og til hva brukes det?
  • Parallell arkitektur: AMPs, PEs, BYNET
  • Datafordeling og hashing
  • Viktige konsepter: sesjoner, spool, locks
  • Tilkobling til systemet: Teradata Studio / BTEQ / SQL Assistant

Modul 2: Innføring i SQL i Teradata

  • Grunnleggende SELECT, WHERE, ORDER BY
  • Datatyper og casting
  • Matematiske og dato-funksjoner
  • Bruk av ALIAS og CASE-uttrykk
  • Spesielle operatører i Teradata (TOP, QUALIFY, SAMPLE)
  • Veiledet praksis: spørringer på ekte tabeller

Modul 3: Joins, subqueries og set-operasjoner

  • INNER, LEFT, RIGHT, FULL OUTER JOIN
  • Joins uten ON-klausul (kartesisk produkt)
  • Skalare og korrelerende subqueries
  • UNION, INTERSECT, MINUS
  • Praktiske øvelser i dataintegrering

Modul 4: Analytiske funksjoner og OLAP

  • RANK(), ROW_NUMBER(), DENSE_RANK()
  • Datapartitionering med PARTITION BY
  • Vinduer med OVER() og ORDER BY
  • LAG(), LEAD(), FIRST_VALUE()
  • Bruksområder: KPIer, trender, oppsummert data

Modul 5: Datahåndtering og tabeller

  • Tabelltyper: permanente, volatile, globale temporære
  • Oppretting og bruk av sekundærindekser og join-indekser
  • Insetting, oppdatering og sletting av poster
  • MERGE, UPSERT og kontroll av duplikater
  • Transaksjoner og låsekонтроll

Modul 6: Optimalisering og ytelsesjustering

  • Teradas optimizer: hvordan valg av eksekveringsplaner gjøres
  • Bruk av EXPLAIN og COLLECT STATISTICS
  • Skew og hvordan unngå den
  • Beste praksis for spørre-design
  • Identifisering av flaskehals (spool, locks, redistribusjon)
  • Praksis: sammenligning mellom optimaliserte og ikke-optimaliserte spørringer

Modul 7: Partisjonering og datakomprimering

  • Partisjoneringstyper: Range, Case, Multi-Level
  • Fordeler og praktisk bruk i store spørringer
  • Block Level Compression (BLC) og Columnar Compression
  • Fordeler og begrensninger

Modul 8: Inntasting og uttrekk av data

  • TPT (Teradata Parallel Transporter) vs. FastLoad / MultiLoad
  • Bulk-loading vs. batch-inntasting
  • Feilbehandling og retry logikk
  • Eksport av resultater til filer eller eksterne systemer
  • Grunnleggende automatisering med skript og verktøy

Modul 9: Grunnleggende administrasjon for tekniske brukere

  • Ruller og tillatelser
  • Ressurskontroll (Query Bands, Priority Scheduler)
  • Overvåking med DBQLOGTBL, DBC.Tables, ResUsage
  • Beste praksis for felles miljøer

Modul 10: Integrerende laboratorieøvelse

  • Praktisk case fra start til slutt:
    • Datainntasting
    • Transformasjon og aggregering
    • Oppbygging av metrikker med OLAP-funksjoner
    • Optimalisering og forklaring
    • Siste eksport
  • Diskusjon om beste praksis og vanlige feil

Krav

  • Forståelse av relasjonelle databaser og SQL-konsepter
  • Erfaring med å søke i store datamengder eller jobbe i datamiljøer
  • Kjent med BI-mål eller analytikk

Målgruppe

  • Datanalytikere og BI-fagfolk
  • SQL-utviklere og dataingeniører
  • Tekniske brukere som administrerer eller optimaliserer data i Teradata-miljøer
 35 Timer

Antall deltakere


Pris per deltaker

Referanser (1)

Kommende kurs

Relaterte kategorier