Lokalny Tesseract OCR na tym samym serwerze co PHP-FPM
Pakiet MyDevil MD4 (8 GB RAM, limit 400% CPU = 4 rdzenie) kosztuje ~100 PLN/mc, ale uruchamianie procesu tesseract bezpośrednio z poziomu PHP (1.5–2 rdzenie CPU i 200 MB RAM per strona) powodowało, że zaledwie 4 jednoczesne dokumenty OCR nasycały 100% CPU serwera.
Przy 8–12 jednoczesnych użytkownikach wyczerpywał się RAM, a procesy były natychmiast ubijane przez kernel (OOM Killer), rzucając HTTP 503 Service Unavailable / 504 Gateway Timeout.
→ Konsekwencja: Przymusowa migracja na kosztowny MyDevil Hosting Dedykowany (~800 PLN/mc) oraz 2 instancje Unicloud pod NER/BERT (~500 PLN/mc).
Koszt Serwera Dedykowanego MyDevil
Hosting Dedykowany pod PHP + Tesseract
Koszt 2x Unicloud (NER + BERT)
2 instancje (SpaCy + HerBERT PyTorch)
Koszt OpenAI GPT-4o (per-pole)
1 000 spraw × 0.61 PLN
Nowy Stos GCP Genkit Serverless
Oszczędność: -1 810 PLN/mc -94.8%
Parametry Ruchu i Skali (Wspólne)
Parametry Serwerów Dedykowanych Legacy
Status Limitów i Skalowania BEZPIECZNY
Struktura Kosztów Miesięcznych (USD / PLN)
Suma: 0 PLNProfil Dobowy 24h & Autoscaling Zasobów (08:00 - 20:00)
Skalowanie do 0 w nocyLiczba aktywnych zapytań/min oraz liczba aktywnych jednostek compute w ciągu doby.
Porównanie Całkowitych Kosztów Miesięcznych: Legacy vs Nowy Genkit
-0 PLN OszczędnościSzczegółowe Porównanie Komponentów Infrastruktury (TCO & Architektura)
1. Serwer Aplikacji & Bazy: MyDevil Hosting Dedykowany (Managed FreeBSD/Linux) – 800 PLN / mc (konieczny, bo współdzielony MD4 za 100 zł padał przy 10 użytkownikach).
2. OCR Tesseract: Wykonywany lokalnie na serwerze PHP (thiagoalessio/tesseract_ocr) – blokowanie wątków CPU, wysokie zużycie RAM.
3. Pseudoanonimizacja (NER/BERT): 2 dedykowane instancje na Unicloud.pl z modelami SpaCy i HerBERT PyTorch – 500 PLN / mc.
4. Ekstrakcja LLM: OpenAI GPT-4o odpytywany 15 razy per sprawa (redundancja 45k tokenów OCR) – 0.61 PLN per sprawa.
5. Czas pracy personelu: 18 min na sprawę (weryfikacja i poprawki) → 0.0 roboczogodzin (0 PLN).
6. Skalowalność w piku: Sztywna granica fizycznej maszyny. Przy 50+ osobach znowu błędy 503 i przekroczenie 500 RPM na OpenAI.
1. Serwer Aplikacji & Bazy: Google Cloud Run (Autoskalowanie 0–50 kontenerów) + Cloud SQL HA – płatność wyłącznie za realne zużycie w godzinach 08:00–20:00.
2. OCR & Ekstrakcja: Usunięto lokalny Tesseract. Zastąpiono go bezpośrednim, multimodalnym odczytem PDF przez Firebase Genkit & Google Gemini 2.0 Flash.
3. Pseudoanonimizacja: Zintegrowana z 1-shot ekstrakcją Gemini i modułem PromptManager (eliminacja serwerów Unicloud → 0 PLN na Unicloud).
4. Ekstrakcja LLM: 1 zapytanie 1-shot (JSON Schema) → 0.0052 PLN per sprawa (0.00 PLN).
5. Czas pracy personelu: 2 min na sprawę → 0.0 roboczogodziny (0 PLN).
6. Skalowalność w piku: Pełna odporność na piki 500+ użytkowników (brak błędów 503, brak przekroczeń limitów RPM).