Menu

Skontaktuj się
Logo
Prasa

Platformy danych

Państwa dane. Żadnych białych plam.

Raporty, prognozy i asystenci potrzebują wiarygodnych danych. OTOKO® planuje i wdraża platformę danych, która integruje Państwa źródła, kontroluje dostęp i udostępnia dane do konkretnych zadań. Punktem wyjścia może być pojedyncza domena, na przykład sprzedaż, produkcja lub serwis.

Szafy serwerowe do centralnego przetwarzania danych, zdjęcie ilustracyjne
Gotowa do pracy platforma danych z infrastrukturą jako kod · planowanie i realizacja przez OTOKO®

Państwa zlecenie dla OTOKO®

Czym się dla Państwa zajmujemy.

Na początku są decyzje, które mają być wspierane danymi: które zasoby muszą być dostępne codziennie, które zdarzenia natychmiast, a które wartości historyczne są potrzebne? Na tej podstawie określamy model danych, zapotrzebowanie na pamięć masową, rytm aktualizacji i osoby odpowiedzialne. Data lake przyjmuje różnorodne dane surowe; hurtownia danych (data warehouse) udostępnia starannie przygotowane dane do analiz. Lakehouse łączy odpowiednie cechy obu rozwiązań, ale nie zastępuje odpowiedzialności za dane. Zanim wprowadzimy nową platformę, najpierw sprawdzamy, czy istniejącą można rozbudować.

Możliwy zakres usług

  • Architektura docelowa z warstwami przechowywania, strefami dla danych surowych i przygotowanych oraz koncepcją dostępu
  • Budowa z Terraform i Kubernetes, powtarzalna dla testów, odbioru i produkcji
  • Katalog danych z pochodzeniem, osobami odpowiedzialnymi, regułami jakości i terminami przechowywania
  • Szyfrowanie w spoczynku i podczas przesyłania, zarządzanie kluczami na życzenie w HSM
  • Monitoring, kopie zapasowe i przywracanie z udokumentowanymi czasami przywracania

Konkretny zakres, Państwa udział i kryteria odbioru ustalamy przed rozpoczęciem.

Technika przedstawiona w zrozumiały sposób

Jak realizujemy to zadanie.

01

Rozróżnienie danych surowych, zweryfikowanych i zatwierdzonych

Projektujemy oddzielne warstwy przetwarzania z przejrzystymi przejściami między nimi. Dane wejściowe otrzymują informacje o pochodzeniu i czasie wczytania oraz schemat; reguły jakości decydują, które dane trafiają do dalszego przetwarzania, a które do wyjaśnienia. Powtarzalne procesy wczytywania zapobiegają temu, by ponowne uruchomienie podwajało wartości. Role przypisujemy do domen danych, dostęp deweloperski ograniczamy, a reguły przechowywania uwzględniamy technicznie. Decyzje architektoniczne dotyczące formatów plików, partycjonowania i mocy obliczeniowej testujemy na podstawie Państwa zapytań i ilości danych, aby tanie przechowywanie danych nie prowadziło do nieproporcjonalnie kosztownych analiz.

02

Przywracanie działania musi sprawdzać się w praktyce

Przy odbiorze uwzględniamy nie tylko udaną analizę, ale też brakujące źródła, uszkodzone dane wejściowe i ponowne uruchomienie po awarii. Państwa zespół otrzymuje model danych, instrukcję eksploatacji i wskazane osoby odpowiedzialne. W planowaniu pomagają przykładowe raporty, lista źródeł danych, znane wolumeny oraz przewidziane grupy użytkowników. Katalog danych pokazuje, co zostało zarejestrowane i gdzie obraz jest jeszcze niepełny.

Sala spotkań w biurze OTOKO® w Kolonii

Wynik możliwy do zweryfikowania

Z tym mogą Państwo dalej pracować.

  1. Gotowa do pracy platforma danych z infrastrukturą jako kod
  2. Katalog danych i model danych
  3. Podręcznik eksploatacji z koncepcją dostępu i koncepcją postępowania awaryjnego

Przekazanie łączy realizację z dokumentacją. Wspólnie sprawdzamy uzgodnione przypadki i zapisujemy pozostałe zadania.

Państwa przedsięwzięcie w szczegółach

Zasób danych, z którego działy biznesowe naprawdę mogą korzystać.

Techniczne miejsce przechowywania danych to tylko część platformy danych. Łączymy model danych, ścieżki ładowania, kontrolę dostępu i eksploatację w przejrzysty proces pracy: od źródła do zatwierdzonego wskaźnika.

Domeny danych zamiast nieprzejrzystego składowiska danych

Sprzedaż, finanse i produkcja często rozumieją pod pojęciem klienta lub zamówienia różne rzeczy. Na warsztatach wyjaśniamy klucze, pojęcia biznesowe oraz miejsce, w którym zmiany stają się wiążące. Platforma świadomie odwzorowuje te różnice, zamiast bez sprawdzenia scalać pola o tej samej nazwie. Każda udostępniona tabela ma określony cel, odpowiedzialny dział biznesowy oraz informację o aktualności danych.

Dla danych surowych, danych oczyszczonych i opublikowanych produktów danych ustalamy odrębne ścieżki przetwarzania. Zmiany wersji są dokumentowane; zależne raporty są sprawdzane przed zatwierdzeniem. Dzięki temu dział biznesowy może korzystać ze wskaźnika, bez konieczności odtwarzania przy każdym zapytaniu całej technicznej historii jego powstania.

Dopasowanie przechowywania i mocy obliczeniowej do rzeczywistego użycia

Sama duża ilość danych nie uzasadnia jeszcze złożonej architektury. Analizujemy typowe zapytania, liczbę równoczesnych użytkowników, okna ładowania i okresy przechowywania. Partycjonowanie, kompaktowanie oraz rozdzielenie przechowywania i przetwarzania wybieramy w zależności od tego, które zadania rzeczywiście staną się szybsze lub bardziej ekonomiczne. Pojedynczy raport miesięczny wymaga innego doboru zasobów niż regularnie aktualizowana analiza operacyjna.

Do modelu eksploatacji należą kontrola kosztów, uprawnienia i odtwarzanie danych. Określamy, które przetwarzanie zatrzymuje się w przypadku błędnych danych wejściowych, a które może być kontynuowane z widoczną informacją o aktualności. Państwa zespół otrzymuje instrukcję ponownego przetwarzania oraz sprawdzania, czy odtworzony zbiór danych jest kompletny z punktu widzenia biznesowego.

Poglądowy scenariusz projektu

Jak usługa pomaga w codziennej pracy.

Przykład: dział zakupów i kontroling pracują na różnych listach dostawców. Pierwsza domena danych łączy zamówienia, przyjęcia towaru i faktury. Zamiast od razu migrować wszystkie dane firmowe, dostarczamy najpierw uzgodniony zbiór danych dotyczący terminów dostaw i wydatków. Kolejne domeny są dodawane dopiero po wyjaśnieniu zakresów odpowiedzialności i korzyści.

Ten przykład opisuje możliwy przebieg i nie jest referencją klienta.

Przed pierwszym krokiem

Platformy danych: Państwa pytania.

Czy potrzebujemy do tego od razu dużej platformy Lakehouse?

Nie. Przy ograniczonym zakresie raportowania może wystarczyć niewielka hurtownia danych. Dobieramy wielkość na podstawie rodzajów danych, aktualności i sposobu wykorzystania; dodatkowe warstwy muszą pełnić konkretną funkcję.

Czy istniejące bazy danych mogą pozostać?

Tak. Systemy źródłowe mogą pozostać i udostępniać dane w sposób kontrolowany. To, czy sensowne są kopie, zapytania czy zdarzenia, zależy od obciążenia, aktualności i uprawnień dostępu.

Państwa przedsięwzięcie

Jakie zadanie chcą Państwo rozwiązać?

Proszę opisać swoją sytuację wyjściową i oczekiwany wynik. Wybrana usługa zostanie uwzględniona w zapytaniu kontaktowym.

Zapytaj o tę usługę

Nasi partnerzy

  • Microsoft
  • Microsoft Azure
  • Amazon AWS
  • Google Cloud
  • Thales Group
  • Arrow ECS
  • Vodafone
  • IBM
  • Veeam
  • Atlassian
  • JetBrains
  • NinjaOne
  • OPSWAT
  • Utimaco
  • Eviden

Dostępność

Dostosuj wygląd strony do swoich potrzeb.

Dla tej strony nie ma jeszcze wersji w prostym języku.

Ustawienia obowiązują obecnie tylko podczas tej wizyty. Trwałe zapisywanie możesz włączyć w ustawieniach plików cookie.