Rozróżnienie danych surowych, zweryfikowanych i zatwierdzonych
Projektujemy oddzielne warstwy przetwarzania z przejrzystymi przejściami między nimi. Dane wejściowe otrzymują informacje o pochodzeniu i czasie wczytania oraz schemat; reguły jakości decydują, które dane trafiają do dalszego przetwarzania, a które do wyjaśnienia. Powtarzalne procesy wczytywania zapobiegają temu, by ponowne uruchomienie podwajało wartości. Role przypisujemy do domen danych, dostęp deweloperski ograniczamy, a reguły przechowywania uwzględniamy technicznie. Decyzje architektoniczne dotyczące formatów plików, partycjonowania i mocy obliczeniowej testujemy na podstawie Państwa zapytań i ilości danych, aby tanie przechowywanie danych nie prowadziło do nieproporcjonalnie kosztownych analiz.


