Przed wyłączeniem starego narzędzia firma sprawdza, czy nowa automatyzacja podejmuje te same decyzje.
Najpierw spisujemy sytuacje, które obsługuje stary system, oraz oczekiwany wynik każdej z nich. Potem uruchamiamy te same przypadki w nowym środowisku. Każda różnica trafia do właściciela procesu, a możliwość powrotu jest sprawdzana przed przełączeniem.
Co zmierzyliśmy
Wersja demonstracyjna pokazuje pełny proces migracji: porównanie 336 zachowań, siedem nierozstrzygniętych różnic, test nowego środowiska i próbę powrotu. Nie łączy się z systemem klienta ani ze starym środowiskiem produkcyjnym.
- Test w nowym środowisku
- Co zmierzyliśmy
- Zakres pomiaru
- Migracja automatyzacji do nowego środowiska
- Zweryfikowano
- dane syntetyczne
Problem, rozwiązanie i wynik
Problem
Krytyczna automatyzacja często działa w narzędziu, które ma zostać wyłączone, a jej reguły nie są w pełni opisane. Przepisanie samego przepływu nie daje pewności, że wyjątki i decyzje pozostaną takie same.
Jak to działa
Zespół najpierw zapisuje oczekiwane odpowiedzi dla reprezentatywnych przypadków. Następnie uruchamia ten sam zestaw w nowym środowisku i rejestruje różnice. Przełączenie jest możliwe dopiero po ich zaakceptowaniu lub poprawieniu.
Co zmierzył pomiar
Wersja demonstracyjna pokazuje pełny proces migracji: porównanie 336 zachowań, siedem nierozstrzygniętych różnic, test nowego środowiska i próbę powrotu. Nie łączy się z systemem klienta ani ze starym środowiskiem produkcyjnym.
Dla kogo
Ten sposób migracji ma sens, gdy krytyczny proces działa w wygaszanym narzędziu, a jego reguły i wyjątki nie są w pełni opisane.
Katalog → porównanie → próba → powrót
- 01Nowe środowisko rozlicza się z 336 zachowań starego, przypadek po przypadku
- 02Rozbieżność bez decyzji zatrzymuje przełączenie, ruch zostaje na źródle
- 03Powrót jest przećwiczony przed przełączeniem, a o otwartych różnicach rozstrzyga przegląd właściciela
- Typ firmy
- Firmy utrzymujące produkcyjne automatyzacje w starszym środowisku
- Wejście
- Zamrożony zestaw zachowań: 336 przypadków z wejściami i oczekiwanymi decyzjami
- Granica
- Rozbieżność bez decyzji zatrzymuje przełączenie; ruch zostaje na źródle
- Koszt
- 0,030373 USD za zapisany przebieg 12 przypadków, czyli około 0,002531 USD za przypadek.
- Bezpieczeństwo
- Nierozstrzygnięta różnica zatrzymuje przełączenie. Zespół może pozostawić ruch w dotychczasowym środowisku.
- Tempo
- Czas przełączenia i powrotu mierzymy w próbie na infrastrukturze klienta.
- Ślad
- Historia pokazuje porównane zachowania, zaakceptowane różnice, decyzję o przełączeniu i próbę powrotu.
- Budowa podobnego systemu
- od 25 000 zł netto · 6–16 tygodni
Kurs referencyjny do przeliczeń: 1 USD = 3,72 zł; 1 EUR = 4,30 zł. Kwoty w PLN są zaokrąglone, a waluta pomiaru pozostaje podana w nawiasie.
Granica przełączenia
Nierozstrzygnięta różnica zatrzymuje migrację
Rozbieżność bez decyzji zatrzymuje przełączenie i nie przykryje jej żaden zbiorczy procent zgodności. O każdej z siedmiu otwartych pozycji rozstrzyga przegląd po stronie właściciela automatyzacji, a do tego czasu ruch zostaje na źródle. Publiczny test ma jedno narzędzie i może wyłącznie odczytać zamówienie; odpowiedź obiecująca wysyłkę, zmianę danych albo inny zapis zostaje odrzucona.
- Granica
- Rozbieżność bez decyzji zatrzymuje przełączenie; ruch zostaje na źródle
- Koszt
- 0,030373 USD za zapisany przebieg 12 przypadków, czyli około 0,002531 USD za przypadek.
- Bezpieczeństwo
- Nierozstrzygnięta różnica zatrzymuje przełączenie. Zespół może pozostawić ruch w dotychczasowym środowisku.
- Tempo
- Czas przełączenia i powrotu mierzymy w próbie na infrastrukturze klienta.
Siedem różnic, których nie zamknęliśmy
Siedem rozbieżności przetrwało przegląd bez rozstrzygnięcia i w publicznym scenariuszu nadal blokuje pełne przełączenie; publikujemy je, bo raport migracji bez nierozwiązanych pozycji nie przekona nikogo, kto migrację robił. Pojedynczy rollback w 2,086 ms dowodzi, że procedura działa raz, na lokalnym routerze; niezawodność produkcyjną trzeba by mierzyć seriami. Czas odpowiedzi zmierzyliśmy przy wywołaniach idących jedno po drugim, więc pod równoległym ruchem klienta trzeba go zmierzyć od nowa. Nie porównaliśmy też kosztów starego i nowego środowiska, bo zamrożony zestaw źródłowy nie ma porównywalnego zapisu zużycia.
Szacowany efekt
Policz efekt na swoim wolumenie
To szacunek oparty na podanym wolumenie. Wpisz własne liczby do formuły, aby ocenić możliwy efekt w swojej firmie. Wynik potwierdzamy dopiero podczas pilotażu.
Dziś
Założenie: 120 dni/program (8 × 15 dni)
Po uruchomieniu
Scenariusz: 72 dni/program (8 × 9 dni)
Oszczędność czasu lub kosztu
Wynik modelowany: 36–60 dni, baza 48
- Wolumen
- 8 agentów
- Formuła
- 8 × (15 − 9) = 48 dni/program
- Status wyliczenia
- niska
Dane na zrzutach. Nazwy, kwoty i dokumenty widoczne na zrzutach są syntetyczne. Dane klientów pozostają prywatne. Pomiary dotyczą opisanej wersji demonstracyjnej i są wyraźnie oddzielone od wyników produkcyjnych.
Powierzchnie pracy
Przegląd po stronie właściciela rozstrzyga otwarte różnice i zatwierdza przełączenie.
Właściciel automatyzacji otwiera jeden widok i czyta z niego to, czego wcześniej nie wiedział nikt: ile zachowań się zgadza, kto odpowiada za każdą otwartą różnicę i czy powrót do źródła działa zgodnie z testem. Do rozmowy o przełączeniu przychodzi z aktami, a siedem otwartych pozycji jest w nich widoczną blokadą do rozstrzygnięcia. Na danych klienta należy jeszcze zmierzyć zachowanie pod rzeczywistym ruchem i koszt nowego środowiska.
Akta migracji: stan, raport różnic, bramki przełączenia.
Stan migracji
Zestaw wzorcowy, wynik zapisanego testu, licznik rozbieżności i status powrotu w jednym widoku.
Raport zgodności
Każda różnica z klasyfikacją oraz decyzją przeglądu albo jawnym statusem otwartym.
Bramki przełączenia
Runbook od inwentarza źródła po próbę wycofania, z jawnym stanem każdej bramki.
Ekrany systemu
Zobacz, jak system działa w praktyce
To zrzuty z działającej aplikacji w wersji komputerowej i mobilnej. Pokazują opisany proces oraz miejsca, w których decyzję podejmuje człowiek.
- Ekrany
- 13
- px
- 1440 · 390
- 021440×3517
Zapisany test nowego środowiska: 12/12 zgodnych wyników, 36 sprawdzeń i 12/12 zweryfikowanych śladów. - 031440×1100
Mobilny widok stanu migracji.
Otwórz archiwum pozostałych ekranów (10)
- 041440×1100
Pole decyzji i podpis właściciela - 051440×1100
Rejestr 48 rozbieżności - 061440×1100
Katalog 336 zachowań - 071440×1100
Inwentarz źródła - 081440×1100
Zweryfikowany pomiar docelowego środowiska - 091440×1100
Pełny zapis testu, zgodność - 101440×1100
Pełny zapis testu, rozbieżność - 111440×1100
Obserwacja równoległa: stan zerowy - 121440×1100
Karta przełączenia: wstrzymana - 131440×1100
Zmierzony lokalny test wycofania
Stos technologiczny
Nowe środowisko na wspieranym SDK i sprawdzalny proces porównania.
Do migracji nie trzeba nowej platformy. Potrzebne jest środowisko, które da się rozliczyć z zachowania: dlatego używamy utrzymywanego OpenAI Agents SDK jako celu, typowanych kontraktów na wejściu i wyjściu oraz bazy, która pamięta każdą decyzję. Sześć kontenerów rozdziela web, API, bazę, wskaźniki obu środowisk i router przełączenia, więc jest jeden jawny punkt zmiany, a źródło zostaje zamrożonym punktem odniesienia. Dla utrzymania znaczy to, że każdy element da się sprawdzić osobno, a zestaw wzorcowy zostaje jako testy na kolejne zmiany.
- OpenAI Agents SDK 0.7.0
- nowe środowisko agenta: klasyfikacja intencji, jedno narzędzie odczytowe i sprawdzany wynik
- FastAPI + Pydantic
- publikują kontrakt inwentarza i decyzji oraz odrzucają odpowiedzi poza zakresem
- PostgreSQL 17 + pgvector
- przechowuje inwentarz, decyzje przeglądu i łańcuch audytu każdego przebiegu
- Router przełączenia
- jawny punkt zmiany środowiska z wykonanym i zapisanym powrotem do źródła
- Next.js 16 + React 19
- udostępniają akta migracji: stan, raport zgodności i bramki przełączenia
Klient przejmuje kod, instrukcje dla modeli, zestaw wzorcowy i dokumentację. Po migracji zostaje z testami, których wcześniej nie miał. Wersja demonstracyjna działa w Docker Compose na fikcyjnych danych testowych, bez połączenia z systemami klienta i źródłowym środowiskiem wykonawczym.
Szczegóły techniczne i pomiar
Pętla pracy
Zatwierdzony katalog definiuje poprawność, a nowe środowisko musi się z niego wytłumaczyć.
Porównanie przypadek po przypadku zamienia przeczucie „odpowiada podobnie” w listę zgodności, rozbieżności i decyzji. Ta lista jest w aktach, razem z tym, czego jeszcze nie rozstrzygnięto.
Zamrożony katalog: 336 oczekiwanych zachowań z decyzjami
Porównanie przypadek po przypadku: każda różnica z decyzją albo jawnie otwarta
Próba nowego środowiska → intencja, bramka przeglądu, tylko odczyt
Próba przełączenia → powrót do źródła
Ruch zostaje na źródle do zamknięcia wszystkich bramek
Architektura systemu
Zamrożony katalog, raport zgodności, zapisany test i sprawdzona droga powrotu.
Cztery elementy, każdy do sprawdzenia osobno: katalog oczekiwań, porównanie z decyzjami przeglądu, test w docelowym SDK i mechanizm przełączania, w którym powrót do starego środowiska został już wykonany i zapisany.
- 01
Zamrożony zestaw
Oczekiwane zachowanie staje się zestawem wzorcowym.
336 przygotowanych przypadków syntetycznych z wejściami i oczekiwanymi decyzjami tworzy jawną definicję poprawności. To krok najczęściej pomijany w migracjach, a bez niego zdanie „zachowuje się tak samo” nie znaczy nic.
- 02
Zgodność
Rozbieżności są policzone co do jednej.
48 rozbieżności przeszło przegląd: 41 ma zamkniętą decyzję, 7 pozostaje otwartych i stoi w aktach jako blokada pełnego przełączenia.
- 03
Zapisany test
Nowe środowisko dostaje kontrolowaną próbę.
Po dwa syntetyczne przypadki na każdą z sześciu intencji przechodzą przez OpenAI Agents SDK. Test sprawdza intencję, skierowanie do przeglądu i zakres tylko do odczytu, a wynik oraz ślad zostają zapisane.
- 04
Router
Przełączenie z wykonanym powrotem.
Osobna próba przestawia router na nowy inwentarz, potwierdza cel i wraca do źródła w 2,086 ms. Rollback został wykonany i zapisany, więc nie jest planem na papierze.
Dlaczego tak mało maszynerii
Docelowy agent obejmuje klasyfikację intencji, jedno narzędzie odczytowe i walidowany wynik. Pozostałe elementy służą porównaniu zachowania. Mniejsza liczba ruchomych części ułatwia wykazanie, że po migracji zachowanie się nie zmieniło.
- Zestaw wzorcowy definiuje poprawność przed zmianą
- Rozbieżność bez decyzji zatrzymuje przełączenie
- Test obejmuje skierowanie do przeglądu i narzędzie tylko do odczytu
- Rollback jest wykonany i zapisany
Chcesz sprawdzić podobny proces w swojej firmie?
- 30 minut z inżynierem, który może prowadzić Twoje wdrożenie.
- Przegląd procesów, które kosztują Cię najwięcej czasu i pieniędzy.
- Pisemne podsumowanie: co zautomatyzować, w jakiej kolejności, z widełkami kosztów.
Terminy zobaczysz w swojej strefie czasowej.
Bez prezentacji sprzedażowej i bez zobowiązań. Jeśli automatyzacja nie ma sensu, też to napiszemy.