Plan uruchomienia pilotażu
11 pilotaży krajowych w czterech falach
11 pilotaży krajowych (§24) plus trajektoria pierwszego roku (§29, ekran 16). Terminy to robocza hipoteza, doprecyzowywana wspólnie z instytucjami.
Zasada wspólna dla wszystkich pilotaży: żaden nie wymaga rozwoju oprogramowania na zamówienie. Wykorzystywane są gotowe środowiska agentowe (OpenAI Codex, Anthropic Claude Code, otwarte odpowiedniki); „wdrożenie" = publikacja konfiguracji (instrukcje, role, umiejętności) + podłączenie danych + przeszkolenie ludzi. Techniczny start dowolnego pilotażu jest możliwy w dniu podpisania umowy.
1. Paszporty pilotaży
Format paszportu: użytkownik docelowy · problem · minimalne dane · konfiguracja · artefakty · kluczowe ryzyka · kryteria sukcesu · czas do efektu praktycznego.
P-1. Stanowisko pracy prawnika samorządu lokalnego
- Użytkownik: prawnik komitetu wykonawczego hromady (gminy) — często 1–2 prawników na całą hromadę.
- Problem: najszerszy możliwy zakres zagadnień (najem, grunty, kadry, zamówienia, skargi obywateli) przy braku wąskiej specjalizacji i mentorów.
- Minimalne dane: ustawodawstwo (otwarte API), typowe umowy hromady, akty lokalne.
- Konfiguracja: poziom bazowy + umiejętności „umowa najmu", „odpowiedź na skargę obywatela", „weryfikacja projektu decyzji".
- Artefakty: poziom bazowy; poziom rozszerzony — dla decyzji sesji/komitetu wykonawczego.
- Ryzyka: słabe wsparcie techniczne na miejscu; dane osobowe w skargach obywateli.
- Kryteria sukcesu: czas przygotowania typowej odpowiedzi ↓ ≥40%; 100% odpowiedzi z rejestrem źródeł; satysfakcja prawnika.
- Czas do efektu: 4–6 tygodni.
P-2. Asystent do analizy projektów aktów normatywnych
- Użytkownik: prawnicy sekretariatów komisji Rady Najwyższej, ministerstw, centralnych organów władzy wykonawczej.
- Problem: duży strumień projektów; ręczne wyszukiwanie kolizji z obowiązującym ustawodawstwem i prawem UE.
- Minimalne dane: API Rady (projekty ustaw, akty obowiązujące), teksty odpowiednich dyrektyw UE.
- Konfiguracja: rola „analityk normatywny"; umiejętności „mapa kolizji", „tabela zgodności z acquis".
- Artefakty: poziom rozszerzony: rules_matrix według norm, critique_pack z listą kolizji.
- Ryzyka: polityczna wrażliwość sformułowań; odpowiedzialność za pominiętą kolizję pozostaje po stronie człowieka.
- Kryteria sukcesu: pokrycie weryfikowanych aktów ↑; wykryte kolizje potwierdzane przez ekspertów (precyzja ≥80% na przypadkach referencyjnych).
- Czas do efektu: 6–8 tygodni.
P-3. Asystent sędziego do strukturyzacji akt sprawy
- Użytkownik: sędzia i asystent sędziego (pilotaż — 1–2 sądy, jurysdykcja cywilna/gospodarcza).
- Problem: obciążenie wielokrotnie przewyższające normę; godziny na chronologizację tomów akt i mapę dowodów.
- Minimalne dane: materiały konkretnych spraw (izolowany perymetr bezpieczeństwa!), Jednolity Państwowy Rejestr Orzeczeń Sądowych (JPRO) do praktyki orzeczniczej.
- Konfiguracja: rola „strukturyzator sprawy": oś czasu, fact_matrix, mapa dowodów; bez projektów orzeczeń na starcie (obniżenie wrażliwości pilotażu).
- Artefakty: poziom audytowy (wysoka cena błędu), przetwarzanie lokalne.
- Ryzyka: maksymalna wrażliwość; postrzeganie jako „AI sądzi"; wymogi JSSIT (Jednolitego Sądowego Systemu Informacyjno-Telekomunikacyjnego).
- Kryteria sukcesu: czas przygotowania sprawy do rozprawy ↓ ≥30%; zero incydentów naruszenia poufności; subiektywna użyteczność wg ankiety sędziów.
- Czas do efektu: 8–12 tygodni. Partner: Państwowa Administracja Sądowa / Narodowa Szkoła Sędziów + Pravo-Justice.
P-4. Asystent urzędnika państwowego do przygotowywania odpowiedzi prawnych
- Użytkownik: departamenty prawne centralnych organów władzy wykonawczej / administracji obwodowych.
- Problem: strumień wniosków i zapytań z ostrymi terminami; praca szablonowa przy wysokiej cenie nieścisłości.
- Minimalne dane: ustawodawstwo, baza wcześniejszych odpowiedzi urzędu (zanonimizowana).
- Konfiguracja: umiejętności „odpowiedź na skargę", „odpowiedź na wniosek o informację publiczną" z weryfikacją cytatów.
- Artefakty: poziom bazowy + obowiązkowa kontrola cytatów (citation-check).
- Kryteria sukcesu: czas odpowiedzi ↓; udział odpowiedzi zwracanych przez kierownika do poprawy ↓ ≥50%.
- Czas do efektu: 4–6 tygodni.
P-5. Uniwersyteckie stanowisko pracy studenta i wykładowcy
- Użytkownik: wydział prawa (2–3 uczelnie partnerskie).
- Problem: absolwenci nie potrafią profesjonalnie pracować z AI; uczelnie nie mają metodyk.
- Minimalne dane: dane otwarte (JPRO, ustawodawstwo) — warstwa poufna niepotrzebna.
- Konfiguracja: edukacyjna: przypadki dydaktyczne, tryb „pokaż tok rozumowania", ocena artefaktów.
- Artefakty: poziom rozszerzony jako format dydaktyczny (student oddaje pakiet, a nie esej).
- Kryteria sukcesu: kurs włączony do programu studiów; ≥100 studentów; bank ≥20 przypadków dydaktycznych w otwartym repozytorium.
- Czas do efektu: jeden semestr.
P-6. Asystent do harmonizacji ustawodawstwa z prawem UE
- Użytkownik: rządowe biuro integracji europejskiej, właściwe ministerstwa.
- Problem: przegląd zgodności (screening) zakończony; przed nami systematyczne dostosowywanie tysięcy aktów do acquis, klaster po klastrze negocjacyjnym.
- Minimalne dane: EUR-Lex (ELI, format maszynowo czytelny), ustawodawstwo ukraińskie, tabele screeningowe.
- Konfiguracja: rola „harmonizator": powiązanie dyrektywa↔ustawa, tabele zgodności, śledzenie zmian acquis.
- Artefakty: poziom rozszerzony; tabele zgodności to kluczowy zasób wielokrotnego użytku.
- Kryteria sukcesu: czas przygotowania tabeli zgodności ↓ ≥50%; tabele wykorzystywane ponownie między urzędami.
- Czas do efektu: 8–10 tygodni. Finansowanie: logicznie poprzez mechanizmy Ukraine Facility.
P-7. Stanowisko pracy do analizy praktyki orzeczniczej
- Użytkownik: analitycy Sądu Najwyższego, Narodowej Szkoły Sędziów, kancelarii prawnych, instytutów naukowych.
- Problem: 120+ mln orzeczeń; ręczna analiza prób nie jest reprezentatywna.
- Minimalne dane: zbiory danych JPRO (już otwarte, aktualizowane codziennie).
- Konfiguracja: umiejętności „dobór próby orzecznictwa", „mapa stanowisk", „wykrywanie rozbieżności w praktyce orzeczniczej".
- Artefakty: poziom rozszerzony; pokrycie źródłami (source coverage) krytyczne (każda teza → konkretne orzeczenia).
- Kryteria sukcesu: odtwarzalność przeglądów (inny analityk powtarza dobór próby na podstawie queries.jsonl); wykryte rozbieżności w praktyce orzeczniczej są potwierdzane.
- Czas do efektu: 6–8 tygodni.
P-8. Asystent dla państwowych służb prawnych
- Użytkownik: prawnicy reprezentujący państwo w sądach (Ministerstwo Sprawiedliwości, urzędy).
- Problem: masowe, jednorodne spory; przegrane z powodu pominiętych argumentów i terminów.
- Minimalne dane: JPRO (praktyka orzecznicza wg kategorii), zanonimizowane akta sprawy urzędu.
- Konfiguracja: role „analityk sporu" i „recenzent"; umiejętność „mapa argumentów stron".
- Artefakty: poziom rozszerzony + wymiana zespołowa między prawnikami regionalnymi (powiązanie z P-11).
- Kryteria sukcesu: spójność stanowisk w ramach kategorii sporów; czas przygotowania odpowiedzi na pozew ↓ ≥40%.
- Czas do efektu: 8–12 tygodni.
P-9. Narzędzie do weryfikacji umów i regulaminów
- Użytkownik: prawnicy przedsiębiorstw sektora państwowego, przedsiębiorstw komunalnych, specjaliści ds. zamówień.
- Problem: typowe ryzyka w umowach są wykrywane dopiero po podpisaniu.
- Minimalne dane: ustawodawstwo, biblioteka typowych umów i list kontrolnych instytucji.
- Konfiguracja: umiejętność „weryfikacja umowy": lista kontrolna ryzyk + kontrola cytatów (citation-check) + czerwone flagi.
- Artefakty: poziom bazowy; raport z weryfikacji to ustandaryzowany artefakt.
- Kryteria sukcesu: pokrycie listy kontrolnej 100%; ryzyka wykryte na próbie referencyjnej ≥85% wobec oznaczeń eksperckich.
- Czas do efektu: 3–4 tygodnie (najszybszy pilotaż, dobry jako pierwszy przypadek publiczny).
P-10. System szkolenia i certyfikacji mentorów Legal AI
- Użytkownik: przyszli mentorzy: doświadczeni prawnicy, specjaliści legaltech, wykładowcy.
- Problem: bez warstwy mentorskiej pozostałe pilotaże się nie skalują.
- Minimalne dane: program szkoleniowy, przypadki referencyjne, otwarte repozytorium.
- Konfiguracja: ścieżka szkoleniowa: konfiguracja stanowiska pracy → formalizacja procesu → standard artefaktów → bezpieczeństwo.
- Artefakty: projekt dyplomowy — rzeczywista konfiguracja dla konkretnej instytucji.
- Kryteria sukcesu: pierwsza kohorta 20–30 certyfikowanych mentorów; każdy towarzyszy ≥1 wdrożeniu.
- Czas do efektu: 10–12 tygodni na kohortę.
P-11. Grupa robocza przy pełnej wymianie ustrukturyzowanych artefaktów (pilotaż kluczowy)
- Użytkownik: jeden realny zespół 5–8 prawników (departament prawny urzędu lub kancelaria prawna-partner).
- Problem: udowodnić efekt zespołowy — centralną hipotezę koncepcji (T14).
- Minimalne dane: przepływ pracy zespołu; standard artefaktu zespołowego v0.1; perymetr Git.
- Konfiguracja: pełny cykl: role autor/recenzent/kierownik, bramki przekazania (handoff gates), walidatory.
- Artefakty: wszystkich 8 typów; trzy poziomy wg typów zadań.
- Ryzyka: opór wobec zmiany nawyków; nadmierne skomplikowanie standardu.
- Kryteria sukcesu (metryki standardu): czas do weryfikacji (time to review) ↓ ≥50%; wskaźnik twierdzeń bez pokrycia dowodowego (unsupported claim rate) → 0; kompletność przekazania (handoff completeness) ≥80%; pokrycie źródłami (source coverage) ≥90%; zespół dobrowolnie kontynuuje po zakończeniu pilotażu.
- Czas do efektu: 12 tygodni. Wynik pilotażu to główny materiał dowodowy całej koncepcji.
2. Macierz priorytetów
| Fala | Pilotaże | Logika |
|---|---|---|
| Fala 1 (szybkie zwycięstwa) | P-9, P-1, P-4 | Niska wrażliwość, szybki mierzalny efekt, przypadki publiczne |
| Fala 2 (rdzeń dowodowy) | P-11, P-10, P-5 | Hipoteza zespołowa + warstwa kadrowa + edukacja |
| Fala 3 (instytucjonalne) | P-2, P-6, P-7, P-8 | Wymagają partnerstw resortowych |
| Fala 4 (maksymalna wrażliwość) | P-3 | Po wypracowaniu bezpieczeństwa i zaufania |
3. Trajektoria pierwszego roku
0–3 miesiące. Otwarte repozytorium · konfiguracje fali 1 (5–10 szt.) · standard artefaktów v0.1 + walidatory · materiały szkoleniowe · umowy z 3–5 instytucjami pilotażowymi · pomiary bazowe (jak działają obecnie).
3–6 miesięcy. Uruchomienie fal 1–2 · pilotaż P-11 · pierwsza kohorta mentorów (P-10) · comiesięczne przeglądy metryk · publikacja przypadków pośrednich na stronie lądowania.
6–12 miesięcy. Fale 3–4 · standard artefaktów v0.2 na podstawie informacji zwrotnej · sieć praktyk (regularne spotkania instytucji) · publiczny raport metryk · propozycje instytucjonalizacji państwowej (rola centrum koordynacyjnego, certyfikacja).
Stale: szkolenia, zbieranie informacji zwrotnej, aktualizacja bazy dowodowej.
4. Zasoby i partnerstwa
- Rdzeń: 2–4 osoby (architekt koncepcji, inżynier konfiguracji, metodyk, koordynator pilotaży).
- Partnerzy instytucjonalni: 1 uczelnia (P-5), 1 hromada (P-1), 1 urząd (P-4/P-8), 1 zespół dla P-11; dla P-3 — Państwowa Administracja Sądowa / Narodowa Szkoła Sędziów w fali 4.
- Programy wsparcia: EU Project Pravo-Justice (wymiar sprawiedliwości), EU4DigitalUA / programy cyfrowe (dane), mechanizmy Ukraine Facility (harmonizacja — P-6), granty dla uczelni.
- Infrastruktura: minimalna — gotowe środowiska agentowe użytkowników (licencje komercyjne lub open source, bez jakiegokolwiek rozwoju) + Git + otwarte repozytorium; izolowany perymetr bezpieczeństwa wyłącznie dla P-3/P-8.
5. Kryteria zatrzymania (uczciwość pilotażu)
Pilotaż zostaje wstrzymany lub zrewidowany, jeśli: metryki jakości nie osiągają progów przez dwa kolejne przeglądy · dojdzie do incydentu naruszenia poufności · koszty ogólne standardu pochłaniają zysk czasowy (czas przygotowania (time to prepare) ↑ o ponad 25% bez kompensacji w postaci zysku w czasie weryfikacji (time to review)) · po szkoleniu zespół nie korzysta z narzędzia dobrowolnie. Wynik negatywny jest publikowany tak samo jak pozytywny — to część naukowej rzetelności projektu.