N4–N12 — AI, Creative i Professional Workers¶
Wspólny kontrakt workera¶
Cel: wykonać typowane zadanie obliczeniowe w izolacji. Wejście: job envelope, referencje do artefaktów, capability, profil modelu, limity VRAM/RAM/energii/czasu i walidator. Wyjście: artefakt, metryki, hash środowiska, receipt i stan końcowy. Zależności: broker, Artifact Store, Model Registry, Secret Broker, Audit Event Store i N16.
Worker może A3 ponawiać bezpieczny krok w limicie, zmniejszyć batch lub odtworzyć podpisany artefakt. Nie może zatwierdzić własnego wyniku, zmienić egressu, aktywować niepodpisanego modelu/pluginu ani podnieść własnego priorytetu. OOM nie uruchamia potajemnie chmury.
N4 — Utility Worker 8GB¶
Cel i zadania: tani OCR, ASR, klasyfikacja, proste Vision, modele 3B–7B, enkodowanie i worker awaryjny. Nie powinien: obsługiwać modeli wymagających ponad 8GB, dużego kontekstu ani krytycznych zadań 24/7 bez redundancji. BOM: Ryzen 5 7600, B650 Eagle AX, 64GB DDR5, NM790 2TB, RTX 5060 8GB, Supremo FM5 850W, Arx 500 Air, Fortis 5; 10 958 zł brutto.
Polecenie: „Wykonaj OCR 200 stron, zwróć confidence i wyjątki.” Przebieg: batch → ekstrakcja → schema validation → ręczna kolejka wyjątków. Walidacja: OOM, jakość, termika i porównanie próbki. Ryzyko/fallback: offload niszczy latency; wybierz mniejszy model lub CPU.
N5 — AI Worker 12GB¶
Cel: 7B, coding, transkrypcja, dokumenty, klasyfikacja i ComfyUI light. BOM: platforma N4 z RTX 5070 12GB; 12 358 zł brutto. Kontrakt: scheduler nie planuje profilu powyżej 11–11,5GB bez rezerwy runtime. Polecenie: „Przeanalizuj repozytorium, przygotuj patch i test report bez commita.” Walidacja: diff, testy, limity ścieżek i brak sekretów. Ryzyko: wysoki throughput nie zwiększa VRAM. Fallback: N6 dla większego modelu lub mniejszy kontekst.
N6 — Light AI Worker 16GB¶
Cel: Voice, OCR, embeddingi, Vision, modele 7B–14B i małe workflow. BOM: platforma N4 z RTX 5060 Ti 16GB; 12 058 zł brutto. Kontrakt: wynik Voice ma timestamp, confidence, speaker mapping i zgodę na retencję. Polecenie: „Transkrybuj rozmowę, oddziel rozmówców i przygotuj zadania do zatwierdzenia.” Walidacja: WER na próbce, PII, latency i utrata SIP. Ryzyko: brak ECC i zmienna jakość audio. Fallback: nagranie do bezpiecznej kolejki albo operator.
N7 — Creative Worker¶
Cel: Blender, Adobe, DaVinci Resolve, ComfyUI, proxy i rendering. BOM bazowy: Ryzen 5 7600, 64GB, 2TB NVMe, RTX 5080 16GB, 850W; 15 458 zł brutto. Tańsza alternatywa to RTX 5070 Ti; profesjonalna — karta PRO i platforma ISV.
Kontrakt: źródła są read-only, wynik trafia do katalogu wersji. Polecenie: „Wyrenderuj scenę w Blenderze do EXR, zgłoś brakujące assety, nie publikuj.” Przebieg: preflight assetów → proxy/test frame → render → kontrola klatek/audio/koloru → artefakt. Walidacja: checksums, profile, brakujące klatki. Błąd: awaria aplikacji wykonuje jeden kontrolowany retry. Fallback: niższy batch, kolejka nocna lub N10.
N8 — Professional Worker 24GB¶
Cel: ECC, CAD/DCC/Vision i 24/7 przy niskim poborze lub dużej gęstości. Warianty: RTX PRO 4000 Blackwell 24GB (145W, aktywny single-slot) albo NVIDIA L4 24GB (72W, pasywna karta serwerowa). BOM: baza 9 259 zł + jawny budżetowy ESTIMATE 15 000 zł GPU; finalnie B2B_QUOTE_REQUIRED.
Kontrakt: sterownik, chassis i airflow są częścią certyfikacji. L4 nie trafia do zwykłej obudowy desktop. Polecenie: „Uruchom vision 24/7 i raportuj ECC/thermal telemetry.” Walidacja: 24h burn-in, sterownik ISV, utrata wentylatora i canary modelu. Ryzyko: profesjonalna karta w niekwalifikowanej platformie nie daje profesjonalnego SLA. Fallback: certyfikowana stacja OEM lub N6 dla zadań odtwarzalnych.
N9 — Main Worker 32GB¶
Cel: główny orchestrator, reasoning, 30–35B i ciężkie Vision. Warianty: RTX 5090 — wydajność za złotówkę, 575W, bez ECC; RTX PRO 4500 — 32GB ECC, 200W, profesjonalne sterowniki. BOM konsumencki: 35 788,99 zł, lecz wskazany PSU jest niedostępny i musi zostać zastąpiony.
Polecenie: „Załaduj zatwierdzony profil 35B, wykonaj test regresji i zwróć candidate.” Walidacja: VRAM headroom, 24h thermals, kabel zasilania, jakość i p95. Ryzyko: pojedynczy Main Worker jest SPOF. Fallback: N6/N5 obsługuje usługi pomocnicze, a krytyczna kolejka czeka lub przechodzi do drugiego N9; VRAM nie sumuje się automatycznie.
N10 — Datacenter Worker 48GB¶
Cel: większy model, wielu użytkowników i serwerowa inferencja. Warianty: RTX 6000 Ada 48GB, aktywna i dojrzała workstation; L40S 48GB, pasywna, 350W, kwalifikowany serwer i B2B. BOM workstation: 44 856,98 zł. Cena kanału Cisco L40S nie jest ceną samego OEM GPU.
Kontrakt: tenant quotas, replikacja, canary i telemetry ECC. Walidacja: utrata GPU/NIC/PSU, saturacja, p99 i degradacja. Ryzyko: mylenie przepustowości wielu replik z latency jednego modelu. Fallback: druga replika, zatwierdzony mniejszy model lub kontrolowane odrzucenie nadmiaru.
N11 — Large Context Worker 72GB¶
Cel: duże modele, większy kontekst i wielodostęp. BOM punktu kosztowego: RTX PRO 5000 Blackwell 72GB oraz baza workstation, 60 970,98 zł; przed zakupem wymagane 256GB RAM, płyta workstation i ponowna wycena. Polecenie: „Uruchom profil 70B, ustaw quota i wykonaj benchmark bez aktywacji produkcyjnej.”
Walidacja: pressure RAM/VRAM, storage throughput, checkpoint i fairness. Ryzyko: duży kontekst podnosi pamięć KV i latency. Fallback: krótszy kontekst, RAG, kwantyzacja albo kolejka; system nie wyrzuca autonomicznie zadań właściciela.
N12 — Enterprise Worker 96GB¶
Cel: duże lokalne modele, ECC i wysokie SLA. Warianty: RTX PRO 6000 Blackwell Workstation 600W, Max-Q 300W i Server Edition. BOM punktu kosztowego: 94 684,98 zł, ale płyta/PSU/chassis wymagają kwalifikowanej zamiany; to nie jest gotowy koszyk.
Kontrakt: oddzielny approval dla firmware i aktywacji modelu. Walidacja: 24–72h burn-in, ECC/Xid, zasilanie, chłodzenie, KVM, recovery i aplikacje ISV. Ryzyko: 600W GPU bez projektu termicznego. Fallback: Max-Q, drugi host lub N11; brak bezpiecznej platformy daje BLOCKED niezależnie od dostępności GPU.
Walidacja wyników i scenariusz awaryjny¶
Walidator jest oddzielny od procesu generującego. Kod przechodzi testy i analizę diffu; obraz — wymiary, kolor i podobieństwo; wideo — kontener, klatki i audio; LLM — schemat, źródła i regresję. OOM zmniejsza batch, thermal throttling drenuje kolejkę, błąd sterownika dopuszcza jeden restart runtime, a kolejna awaria izoluje host. Brak audytu blokuje nowy job.