Bądźmy w kontakcie

Plan Szkolenia

Wprowadzenie do Teradata

Moduł 1: Podstawy Teradata i jego architektura

  • Czym jest Teradata i do czego służy?
  • Architektura równoległa: AMP, PE, BYNET
  • Dystrybucja danych i hashowanie
  • Kluczowe pojęcia: sesje, spool, blokady
  • Połączenie z systemem: Teradata Studio / BTEQ / SQL Assistant

Moduł 2: Wprowadzenie do SQL w Teradata

  • Podstawowy SELECT, WHERE, ORDER BY
  • Typy danych i rzutowanie
  • Funkcje matematyczne i daty
  • Użycie ALIAS, wyrażenia CASE
  • Specjalne operatory Teradata (TOP, QUALIFY, SAMPLE)
  • Ćwiczenie z przewodnikiem: zapytania na rzeczywistych tabelach

Moduł 3: Złączenia, podzapytania i operatory zbiorów

  • INNER, LEFT, RIGHT, FULL OUTER JOIN
  • Złączenia bez klauzuli ON (iloczyn kartezjański)
  • Podzapytania skalarne i skorelowane
  • UNION, INTERSECT, MINUS
  • Praktyczne ćwiczenia z integracji danych

Moduł 4: Funkcje analityczne i OLAP

  • RANK(), ROW_NUMBER(), DENSE_RANK()
  • Partycjonowanie danych za pomocą PARTITION BY
  • Okna z OVER() i ORDER BY
  • LAG(), LEAD(), FIRST_VALUE()
  • Przykłady użycia: KPI, trendy, wartości skumulowane

Moduł 5: Zarządzanie danymi i tabelami

  • Typy tabel: trwałe, lotne, globalne tymczasowe
  • Tworzenie i używanie indeksów pomocniczych oraz indeksów złączeniowych
  • Wstawianie, aktualizowanie i usuwanie rekordów
  • MERGE, UPSERT i kontrola duplikatów
  • Transakcje i kontrola blokad

Moduł 6: Optymalizacja i strojenie wydajności

  • Optymalizator Teradata: jak podejmuje decyzje dotyczące planów
  • Użycie EXPLAIN i COLLECT STATISTICS
  • Skew i jak go unikać
  • Najlepsze praktyki projektowania zapytań
  • Identyfikacja wąskich gardeł (spool, blokady, redystrybucja)
  • Ćwiczenie: porównanie zapytań zoptymalizowanych i niezoptymalizowanych

Moduł 7: Partycjonowanie i kompresja danych

  • Typy partycjonowania: zakresowe, CASE, wielopoziomowe
  • Korzyści i praktyczne zastosowanie w dużych zapytaniach
  • Kompresja na poziomie bloków (BLC) i kompresja kolumnowa
  • Zalety i ograniczenia

Moduł 8: Ładowanie i ekstrakcja danych

  • TPT (Teradata Parallel Transporter) a FastLoad / MultiLoad
  • Ładowanie masowe a wstawianie wsadowe
  • Obsługa błędów i ponowne próby
  • Eksport wyników do plików lub systemów zewnętrznych
  • Podstawowa automatyzacja za pomocą skryptów i narzędzi

Moduł 9: Podstawy administrowania dla użytkowników technicznych

  • Role i uprawnienia
  • Kontrola zasobów (Query Bands, Priority Scheduler)
  • Monitorowanie za pomocą DBQLOGTBL, DBC.Tables, ResUsage
  • Dobre praktyki dla środowisk współdzielonych

Moduł 10: Końcowe laboratorium integracyjne

  • Kompleksowy przypadek praktyczny:
    • Ładowanie danych
    • Transformacja i agregacja
    • Tworzenie wskaźników za pomocą funkcji OLAP
    • Optymalizacja i wyjaśnienie
    • Eksport końcowy
  • Omówienie dobrych praktyk i typowych błędów

Wymagania

  • Zrozumienie relacyjnych baz danych i koncepcji SQL
  • Doświadczenie w odpytywaniu dużych zbiorów danych lub pracy w środowiskach danych
  • Znajomość celów business intelligence lub analityki

Grupa docelowa

  • Analitycy danych i specjaliści business intelligence
  • Programiści SQL i inżynierowie danych
  • Użytkownicy techniczni zarządzający danymi lub optymalizujący je w środowiskach Teradata
 35 godzin

Liczba uczestników


Cena za uczestnika (netto)

Opinie uczestników (1)

Propozycje terminów

Powiązane Kategorie