Menu

Skontaktuj się
Logo
Prasa

MLOps i eksploatacja AI

Państwa AI się zmienia. Kto ją kontroluje?

Po zakończeniu pilotażu dane, modele i wymagania nadal się zmieniają. OTOKO® wdraża wersjonowanie, zatwierdzenia, monitorowanie i kontrolowany proces aktualizacji dla Państwa aplikacji AI. Państwa zespół wie, która wersja działa, jak oceniono jej jakość i jak wrócić do poprzedniej wersji w razie problemów.

Jednostki obliczeniowe w środowisku serwerowym, zdjęcie ilustracyjne
Model eksploatacji z rolami i runbookami · planowanie i realizacja przez OTOKO®

Państwa zlecenie dla OTOKO®

Czym się dla Państwa zajmujemy.

W przypadku modeli klasycznych łączymy kod, stan danych, definicje cech i artefakt modelu. W aplikacjach generatywnych dochodzą prompt, indeks wyszukiwania, narzędzia i konfiguracja modelu. Rejestr modeli dokumentuje zatwierdzenia i zakres odpowiedzialności. Dane dostępowe nie są przekazywane razem z artefaktami. Środowiska deweloperskie i produkcyjne otrzymują oddzielne uprawnienia. Dzięki temu można sprawdzać zmiany i przy awariach odtworzyć faktycznie wdrożone komponenty, zamiast patrzeć wyłącznie na ostatni znany kod źródłowy.

Możliwy zakres usług

  • Łączenie wersji modeli, danych i konfiguracji z zatwierdzeniami
  • Konfiguracja zautomatyzowanych testów jakości przed każdym wdrożeniem
  • Monitorowanie dryfu danych, czasu odpowiedzi i zużycia zasobów
  • Porównywanie aktualizacji z wersją produkcyjną
  • Udostępnianie inwentarza AI i dokumentacji technicznej właściwym organom kontrolnym

Konkretny zakres, Państwa udział i kryteria odbioru ustalamy przed rozpoczęciem.

Technika przedstawiona w zrozumiały sposób

Jak realizujemy to zadanie.

01

Wspólne monitorowanie jakości, kosztów i eksploatacji

Techniczna dostępność niewiele mówi o merytorycznie błędnych odpowiedziach. Łączymy wskaźniki czasu odpowiedzi, błędów i zużycia zasobów z odpowiednimi informacjami zwrotnymi o jakości. Dryf danych wskazuje na zmienione dane wejściowe, ale nie jest jeszcze dowodem na gorsze wyniki. Dlatego ponowne trenowanie lub zmiana modelu są oceniane względem stabilnego zbioru testowego. Stopniowe wdrażanie ogranicza skutki; przygotowywane są wersje awaryjne, do których można wrócić, oraz możliwości wyłączenia. W przypadku modeli zewnętrznych uwzględniamy zmiany wersji i awarie po stronie dostawcy.

02

Ustalanie odpowiedzialności eksploatacyjnej i dowodów zgodności

Zakres eksploatacji określa godziny, ścieżki alarmowania i zakresy odpowiedzialności za usterki techniczne i merytoryczne. Osoby odpowiedzialne za zatwierdzenia decydują o jakości nowych wersji. Do przekazania należą runbooki, przegląd wersji i udokumentowane ograniczenia. W zakresie ochrony danych i ewentualnych mających zastosowanie wymogów dotyczących AI dostarczamy informacje techniczne właściwym podmiotom; sama eksploatacja nie zapewnia zgodności prawnej.

Sala spotkań w biurze OTOKO® w Kolonii

Wynik możliwy do zweryfikowania

Z tym mogą Państwo dalej pracować.

  1. Model eksploatacji z rolami i runbookami
  2. Monitoring z alarmowaniem
  3. Przegląd wersji i dokumentacja techniczna na potrzeby kontroli

Przekazanie łączy realizację z dokumentacją. Wspólnie sprawdzamy uzgodnione przypadki i zapisujemy pozostałe zadania.

Państwa przedsięwzięcie w szczegółach

Kontrolowane udostępnianie i dalszy rozwój modeli.

Tworzymy ścieżkę od eksperymentu do nadzorowanej eksploatacji modelu. Wersje danych, przebiegi treningowe, artefakty i zatwierdzenia łączymy w taki sposób, aby decyzja produkcyjna pozostała możliwa do prześledzenia także po zmianie modelu.

Rozdzielenie eksperymentów od modeli produkcyjnych

Notebook często zawiera niejawne założenia dotyczące plików, bibliotek i kroków wykonywanych ręcznie. Istotne kroki przetwarzania przekształcamy w odtwarzalne procesy z udokumentowanymi zależnościami. Artefakty modelu otrzymują jednoznaczną wersję oraz odniesienie do treningu, konfiguracji i oceny.

Samo zarejestrowanie modelu nie jest jeszcze zatwierdzeniem. Określamy, jakie kontrole jakości, bezpieczeństwa i eksploatacji muszą zostać pozytywnie zaliczone przed udostępnieniem. Ocena merytoryczna i techniczne wdrożenie pozostają rozróżnialne, aby technicznie działający model nie trafił do produkcji bez weryfikacji merytorycznej.

Wykrywanie pogorszeń i kontrolowana reakcja

W eksploatacji obserwujemy dostępność, czasy odpowiedzi i zmiany danych wejściowych. Zmieniony rozkład danych jest powodem do zbadania, ale jeszcze nie dowodem na gorsze prognozy. Tam, gdzie wyniki merytoryczne są znane dopiero później, planujemy ich przekazywanie z powrotem do oceny jakości.

Zmiana modelu odbywa się na podstawie uzgodnionego porównania i ścieżki powrotu. W zależności od zastosowania sensowne mogą być najpierw oceny w tle (shadow) lub ograniczone grupy użytkowników. W przypadku wycofania modelu muszą do niego pasować także powiązane z nim przetwarzanie wstępne i interfejsy. Państwa zespół eksploatacyjny otrzymuje instrukcje dotyczące zakłóceń, ponownego wdrożenia oraz eskalacji nieprawidłowości merytorycznych.

Poglądowy scenariusz projektu

Jak usługa pomaga w codziennej pracy.

Przykład: prognoza popytu jest ponownie trenowana co miesiąc. Nowa wersja jest najpierw sprawdzana względem ustalonych okresów referencyjnych i aktualnych wyników biznesowych. Do produkcji trafia tylko zatwierdzona kombinacja przetwarzania danych i modelu; poprzednia kombinacja pozostaje dostępna na potrzeby ścieżki powrotu.

Ten przykład opisuje możliwy przebieg i nie jest referencją klienta.

Przed pierwszym krokiem

MLOps i eksploatacja AI: Państwa pytania.

Czy każdy model jest automatycznie trenowany ponownie?

Nie. Ustalane są wyzwalacze i zatwierdzenia. Nowe dane mogą być nieodpowiednie; zaktualizowana wersja musi przejść uzgodnione porównanie.

Czy istniejące pilotaże AI mogą zostać przejęte?

Tak, po inwentaryzacji uprawnień, ścieżek danych, wersji i możliwości testowania. Brakujące podstawy są celowo uzupełniane przed przejęciem do środowiska produkcyjnego.

Państwa przedsięwzięcie

Jakie zadanie chcą Państwo rozwiązać?

Proszę opisać swoją sytuację wyjściową i oczekiwany wynik. Wybrana usługa zostanie uwzględniona w zapytaniu kontaktowym.

Zapytaj o tę usługę

Nasi partnerzy

  • Microsoft
  • Microsoft Azure
  • Amazon AWS
  • Google Cloud
  • Thales Group
  • Arrow ECS
  • Vodafone
  • IBM
  • Veeam
  • Atlassian
  • JetBrains
  • NinjaOne
  • OPSWAT
  • Utimaco
  • Eviden

Dostępność

Dostosuj wygląd strony do swoich potrzeb.

Dla tej strony nie ma jeszcze wersji w prostym języku.

Ustawienia obowiązują obecnie tylko podczas tej wizyty. Trwałe zapisywanie możesz włączyć w ustawieniach plików cookie.