Raport wewnętrzny · Numerika AI

Trzy strategie,
jedna maszyna.

Przez trzydzieści godzin dwa agenty AI na własnym klastrze przepracowały metodą PZS Waldemara Czachorowskiego trzy niezależne kierunki rozwoju Numeriki. Jeden z nich odradziły.

Model GLM-5.3 Sprzęt 4× DGX Spark Metoda PZS — 10 etapów Przebiegi 5–7.09.2026
01

Co powstało

3
niezależne przebiegi
30
etapów analizy
45
wersji dokumentów
460 tys.
znaków strategii
142
źródła w przypisach
89
unikalnych domen
125
wiadomości między agentami
0,93
średnia pewność ustaleń

Wszystkie trzydzieści etapów zamknięto werdyktem PASS. Osiem wersji odesłano do poprawki, jedną odrzucono w całości. Dane leżą w bazie na Hermesie i w pamięci długoterminowej floty — nie w pliku, który da się zgubić.

02

Trzy marginesy

Metoda TOWS wybiera strategię przez porównanie czterech sum ważonych. Liczy się nie tylko która wygrała, ale o ile. Ten margines mówi, jak pewna jest decyzja.

Szkolenia
3,25
Rozstrzygnięte. Ofensywa wygrywa z zapasem.
Sparki
1,3
Wąsko. Ofensywa tylko po domknięciu luk.
jhonnys-brain
0,2
Na granicy. Defensywa o włos przed nadrabianiem.
Jak to czytać: margines powyżej 2,0 to decyzja rozstrzygnięta. Poniżej 1,0 — dwa scenariusze są praktycznie równorzędne i wybór zależy od założeń, które trzeba świadomie przyjąć. Przy jhonnys-brain różnica wynosi 1,2 procent.
03

Szkolenia

Strategia ofensywna — „compliance-first"

Wchodzić
KwadrantSumaZnaczenie
SO — ofensywna10,90siły wykorzystują szanse
ST — konserwatywna7,65siły neutralizują zagrożenia
WT — defensywna7,30redukcja i obrona
WO — konkurencyjna6,70szanse łatają słabości

Środek ciężkości to iloczyn dwóch najwyżej ocenionych par: certyfikat ISO 29993 wraz z wpisem do BUR spotyka się z popytem wymuszonym przez AI Act, finansowanym z Krajowego Funduszu Szkoleniowego. Model wycenia obie te interakcje na 0,95 w skali do jedności.

Warunki konieczne — nie opcje

Uwaga — błąd w tej analizie. Etap mapy grup twierdzi, że obowiązek wpisu do BUR eliminuje czterech z sześciu graczy z rynku dofinansowanego. Sprawdziłem to u źródła: Cognity ma aktywną kartę dostawcy w BUR, opartą na certyfikacie ISO 9001. Do bazy PARP wystarczy więc ogólny certyfikat jakości, nie tylko dedykowany szkoleniom ISO 29993. Fosa istnieje, ale jest węższa i nie wyklucza konkurencji. Recenzent tego nie złapał, bo weryfikował liczby, a nie statusy rejestrowe konkurentów.
04

Sparki

Ofensywa warunkowa — wdrożenia i utrzymanie

Wchodzić ostrożnie
KwadrantSumaZnaczenie
SO — ofensywna17,4siły wykorzystują szanse
WO — konkurencyjna16,1szanse łatają słabości
WT — defensywna15,2redukcja i obrona
ST — konserwatywna14,3siły neutralizują zagrożenia

Odsprzedaż sprzętu odpada twardą liczbą: marża dystrybutora wynosi 6,84 procent brutto całego portfela. Przy pięciu tysiącach kapitału obrotowego zamrożenie osiemdziesięciu tysięcy w klastrze jest niewykonalne. Zostaje model, w którym sprzęt kupuje klient, a Numerika sprzedaje wdrożenie i utrzymanie — od dwudziestu pięciu do czterdziestu procent wartości wdrożenia rocznie.

Kanibalizacji szkoleń nie ma. Przecięcie segmentów jest puste: klient szukający dofinansowania z BUR to nie ten sam klient, który kupuje klaster za sto tysięcy.

Data graniczna: od sześciu do dwunastu miesięcy. Know-how czteronodowe jest już publicznie dostępne na GitHubie, a konkurent ma w ofercie konfiguracje od jednego do czterech węzłów. Bariera kompetencyjna eroduje sama z siebie.
05

jhonnys-brain

Strategia defensywna — nie monetyzować

Nie wchodzić
KwadrantSumaZnaczenie
WT — defensywna16,6obrona i minimalizacja
WO — konkurencyjna16,4szanse łatają słabości
SO — ofensywna12,4siły wykorzystują szanse
ST — konserwatywna11,2siły neutralizują zagrożenia

To jedyny przebieg, w którym maszyna odradziła kierunek. Powodem nie jest słabość produktu, tylko tempo rynku.

Scenariusz „dostawcy modeli wbudowują pamięć z audytem" nie jest hipotezą — jest w trakcie realizacji.etap scenariuszy, wersja druga

Co zostaje: jhonnys-brain jako przewaga wewnętrzna. Koszt utrzymania bliski zeru — cały stos to oprogramowanie otwarte plus lokalny model. Infrastruktura badawcza floty, brak rachunków za API i realny dowód produkcyjny na piętnastu agentach, który można pokazywać na szkoleniach bez ujawniania szczegółów.

Kiedy wrócić do tej decyzji

06

Jak to działa

Nie jest to jeden model, któremu zadano pytanie. To dwa agenty w pętli sporu, na sprzęcie stojącym w domu, bez żadnego zewnętrznego API.

81
recenzji
44
przekazań między agentami
30
ustaleń badawczych
8
wersji odesłanych do poprawki
07

Co złapał recenzent

To jest ta część, dla której cała konstrukcja ma sens.

Zmyślona kara z AI Act

Strateg napisał, że złamanie artykułu czwartego zagrożone jest karą do pięciu milionów euro lub jednego procenta obrotu, powołując się na artykuł 99 ustęp 4 — i wstawił to jako argument sprzedażowy skierowany do menedżera HR.

Recenzent pobrał pełny tekst artykułu 99 z tej samej domeny, którą cytował strateg. Wykazał, że rozporządzenie zna trzy progi kar: trzydzieści pięć milionów euro lub siedem procent za praktyki zakazane, piętnaście milionów lub trzy procent za zamkniętą listę artykułów, siedem i pół miliona lub jeden procent za podanie błędnych informacji. Artykuł czwarty nie występuje w żadnym z nich — kary za jego naruszenie ustalają państwa członkowskie. Progu „pięć milionów, jeden procent" w AI Act po prostu nie ma.

Werdykt: odrzucić. Przy okazji recenzent sprawdził dziewięć innych liczb w tym samym dokumencie — wszystkie okazały się prawdziwe co do przecinka.

Ironia, którą recenzent zapisał sam: poprawiana wersja nosiła tytuł „korekta dat AI Act". Poprawiając precyzję prawną, strateg dołożył nową zmyśloną kwotę.

Nowe zachowanie modelu

W dwóch przebiegach strateg z własnej inicjatywy poprawił etap już zamknięty. Zaczynając kolejny krok, przeczytał skrzynkę, zobaczył swoją odrzuconą recenzję i napisał nową wersję poza pętlą — dokładnie tam, gdzie recenzent wskazał. W jednym przypadku była to korekta waluty w rundzie finansowania konkurenta: dolary zamiast euro.

Takie wersje zostają bez werdyktu, bo pętla etapu jest już zamknięta. Domyka je zwykły restart: kod rozpoznaje gotową wersję bez oceny i posyła ją prosto do recenzji zamiast produkować od nowa. Domknięcie zajęło jedenaście minut zamiast dwunastu godzin.

08

Zastrzeżenia