Blog — Data Vault a automatizace Data Warehousu
Články o Data Vault 2.0, automatizaci data warehousu, Snowflake, Databricks a praktickém datovém inženýrství.
-
Datová suverenita a AI: Enterprise DWH
Jak udržet kontrolu nad svými daty, když AI modely potřebují přístup ke všemu? Tento webinář ukazuje, jak zkombinovat datovou governance s moderními AI schopnostmi.
Číst více → -
Data Vault a Medallion stack Databricks
Data Vault a Lakehouse jsou často vnímány jako protichůdné přístupy. Tento webinář ukazuje, že je tomu naopak.
Číst více → -
Jak přemýšlím o byznysové hodnotě v datech
Většina datových projektů neselhává kvůli technologii. Selhávají, protože hodnota přichází příliš pozdě, ve špatné formě nebo za příliš vysokou cenu.
Číst více → -
Certifikace ISO 27001:2022 a SOC 2 Type 2
V dnešní rychle se vyvíjející digitální krajině není bezpečnost dat jen prioritou — je nezbytností.
Číst více → -
Import datových modelů generovaných AI Flow.BI
Podívejte se, jak migrovat metadata generovaná AI Flow.BI do Datavault Builderu pomocí přístupu Migration Vault — mapování hubů, linků a automatizovaných ETL pipeline.
Číst více → -
Integrace a sjednocování dat
V Data Vault modelování používáme huby pro integraci dat. Je to jeden z hlavních důvodů, proč si Data Vault modelování vybíráme.
Číst více → -
DWH analytika téměř v reálném čase
V dnešním data-driven světě poskytují kreditní karty, sítě, IoT senzory a mnoho dalších zdrojů dat data v reálném čase. Jak je efektivně zpracovat?
Číst více → -
SSO na Snowflake Snowpark Container Services
Použití Datavault Builderu se Snowpark Container Services od Snowflake umožňuje datovým týmům nasazovat a spravovat datová řešení bez závislosti na infrastrukturních týmech.
Číst více → -
Bi-temporální zpracování dat
Ať už pracujete se zákaznickými účty, finančními transakcemi nebo pojistnými událostmi, tento webinář vás vybaví pro zpracování bi-temporálních dat.
Číst více → -
DVB na Snowflake Snowpark Container Services
V tomto videu demonstrujeme, jak jednoduché je provozovat Datavault Builder na Snowflake Container Services.
Číst více → -
Přímý GIT Check-In a Check-Out modelu
Vítejte u naší krátké prezentace Datavault Builderu 7.1 a jeho nové funkce GIT check-in a check-out pro agilní vývoj.
Číst více → -
Koncept Migration Vaultu
Migration Vault je specializované úložiště metadat navržené jako Data Vault. Usnadňuje migraci dat ze starého formátu do nového a zajišťuje kompatibilitu.
Číst více → -
Srovnání alternativy k Talend Open Studio
Datavault Builder nabízí širokou škálu funkcí a modulů za stejnou cenu jako dříve bezplatné ETL nástroje.
Číst více → -
Automatizace Unified Star Schema
V tomto videu se diváci ponoří do světa automatizovaného data warehousingu s Unified Star Schema, konceptem od Francesca Puppiniho a Billa Inmona.
Číst více → -
Yale University: revoluce ve správě dat — 75% úspora a rychlejší insighty
Automatizace správy dat přináší výrazný nárůst produktivity: jak Yale University využila Datavault Builder ke snížení účtovaných hodin o 75 %, rozšíření datového týmu a urychlení time to insight.
Číst více → -
Případová studie BI-SPEKTRUM: C&A na Snowflake
BI-SPEKTRUM publikoval v čísle 2023/3 článek o tom, jak jeden z našich zákazníků používá Datavault Builder pro integraci dat ze SAP.
Číst více → -
Případ užití Willibald od DDVUG
Sledujte případ užití DDVUG Willibald: vybudování kompletního Data Warehousu se 2 zdroji dat za méně než 3 hodiny pomocí Datavault Builderu.
Číst více → -
Je datové modelování mrtvé?
Potřebujeme stále datové modely? Jaká je hodnota modelů? Proč datové modelování v minulosti selhávalo? Jak vytvářet hodnotu modelováním?
Číst více → -
Data Vault bi-temporálně: Inscription Time
Jak načítat bi-temporální data do Data Vaultu pomocí Inscription Time — patterny, úskalí a praktické příklady.
Číst více → -
Data Vault vs. Data Mesh?
Mám stále dělat Data Vault, když existuje Data Mesh? V posledních týdnech a měsících jsem dostal tyto velmi zajímavé otázky, které se opakovaně objevují.
Číst více → -
CI/CD s Datavault Builderem na Snowflake
Jak použít Zero Copy Cloning od Snowflake s Datavault Builderem k vybudování silné CI/CD pipeline pro váš data warehouse.
Číst více → -
Záleží vždy na Equi-Joinech?
Občas narazím na nějaká tvrzení o tom, jak databáze fungují a jak se mají dotazovat. A rád taková doporučení čtu.
Číst více → -
3NF a Data Vault: není čeho se bát
Občas dostáváme zajímavou otázku: podporuje Datavault Builder 3NF? Odpověď je ano — a takto to funguje.
Číst více → -
DWH Temporalita Pt.4: SCD Type 2 dimenze
Kimballovský styl dimenzí — SCD Type 2 výstup. Pokud jste je nečetli, doporučuji nejdříve přečíst první 3 části.
Číst více → -
DWH Temporalita Část 3: Výstup timeline
Ačkoli v mnoha případech není nutné vystupovat timeline v reportech, existují případy, kdy je výstup timeline důležitý.
Číst více → -
DWH Temporalita Část 2: Snižování složitosti
Jak snížit temporální složitost v Data Vaultu. Uživatelé Datavault Builderu se často ptají, jak správně mapovat změny v čase.
Číst více → -
DWH Temporalita Část 1: Výzva
V uplynulých letech jsem byl konfrontován s požadavkem vytvořit reporting s dimenzemi SCD type 2.
Číst více → -
O Multi-Active satelitech v Data Vaultu
Petr Beles o implementaci Multi-Active satelitů jako Document satelitů v Data Vaultu: patterny, kompromisy a praktická doporučení.
Číst více → -
O Linkách
Petr Beles o Data Vault linkách reprezentujících transakce: patterny, úskalí a návrhová rozhodnutí při modelování transakčních linků.
Číst více → -
Qlik
Ukazují vaše Qlik aplikace a Power BI reporty různá čísla?
Chybu nemá Qlik ani Power BI. Každý má vlastní logiku načítání, vlastní definice a vlastní lineage, takže se stejná metrika počítá dvakrát a nikdo je nedokáže sladit. Pravidla patří do jednoho spravovaného modelu v datovém skladu, ze kterého čtou oba nástroje.
Číst více → -
Tableau
Máte na Tableau Serveru příliš mnoho verzí stejného čísla?
Každý publikovaný .tdsx byl v den svého vzniku rozumný. Dohromady jsou to stovky soukromých definic stejné metriky a žádný způsob, jak poznat, která je správná.
Číst více → -
Power BI
Ukazují vaše Power BI reporty pro stejnou věc různá čísla?
Finance, Obchod i Provoz si každý postavili vlastní sémantický model a každý z nich je vnitřně konzistentní. Definice nebyly špatně na jednom místě. Nebyly dohodnuté nikde.
Číst více → -
Qlik
Čistíte stejná data znovu v každém načítacím skriptu v Qliku?
Stejné mapovací loady, opravy textových řetězců a deduplikace se znovu píšou v každé aplikaci a každé vrstvě QVD a jejich kopie se rozcházejí. Čištění se opakuje v každém skriptu, protože ho žádná integrovaná vrstva datového skladu neudělá jednou.
Číst více → -
Qlik
Jsou vaše výrazy Set Analysis v Qliku příliš dlouhé a pomalé?
Set Analysis je přesný nástroj pro skutečná srovnání. Většina dlouhých výrazů ve vaší aplikaci tam je, protože model nikdy nedodal historii, příznaky ani jednu granularitu, takže je graf skládá znovu při každém výběru.
Číst více → -
Tableau
Jsou vaše LOD výrazy v Tableau tak složité, že se jich bojíte dotknout?
FIXED, INCLUDE a EXCLUDE jsou přesné nástroje pro skutečné otázky nad více granularitami. Většina těch ve vašem workbooku tam je, protože datový sklad nikdy nevyřešil granularitu ani neuchoval historii.
Číst více → -
Power BI
Je váš Power BI report v DirectQuery pomalý při každém kliknutí?
DirectQuery a Direct Lake slibují živá data. Dostanete třicetisekundový vizuál a účet za výpočetní výkon, který nikdo nechce vysvětlovat. Problém není v režimu. Je ve schématu pod ním.
Číst více → -
Qlik
Vytvářejí vaše Qlik aplikace pořád syntetické klíče?
Syntetické klíče a cyklické reference jsou jen Qlik, který přesně asociuje to, co dostal. Vznikají, protože data přicházejí bez konformních dimenzí a skutečných klíčů, takže si je musí vymyslet každá aplikace.
Číst více → -
Qlik
Selhávají vám reloady v Qliku s tím, jak data rostou?
In-memory engine je rychlý, protože všechno leží v RAM. Reloady selhávají a aplikace se zpomalují, když tuto RAM zaplní detail na úrovni řádků a transformace, které předtím neudělal žádný datový sklad.
Číst více → -
Tableau
Selhává vám refresh extractů v Tableau, nebo nestíhá doběhnout?
Backgrounder skončí timeoutem, soubor .hyper stále roste a dashboard ukazuje včerejšek. Extract je velký, protože nese surové řádky, které se výše v řetězci nikdy neagregovaly.
Číst více → -
Power BI
Je váš DAX v Power BI už příliš dlouhý na údržbu?
Dvě stě řádků CALCULATE a FILTER není známka pokročilého DAX. Obvykle je to známka toho, že vám datový sklad nikdy nedal klíče, historii ani granularitu, kterou jste potřebovali.
Číst více → -
Tableau
Je váš Tableau dashboard pomalý při každé změně filtru?
Dvacet sekund "Executing Query" při každém kliknutí na filtr. Tableau nevykresluje pomalu. Čeká na databázi, která dostala otázku, na kterou nedokáže rychle odpovědět.
Číst více → -
Power BI
Selhává vám refresh v Power BI každou noc?
Naplánovaný refresh skončí timeoutem, Power Query dojde paměť a vy se to dozvíte, až když někdo otevře dashboard. Příčinou téměř nikdy není Power BI. Je to práce, kterou po Power BI chcete.
Číst více →
Zatím tu nic není.