BitSharp · studio inżynierii AI · Rzeszów

2026-03-05 arXiv 2603.04162 · v2 opublikowana
2026-02 9 modeli + 3 datasety na HF
2026-07-24 PolAgentBench: draft ukończony · 67 zadań
2026-07-23 3 tezy notatek w akceptacji
openhaft.pl · produkcja · live

Dwa własne badania, autorski benchmark agentowy, dziewięć publicznych modeli Bielika i wdrożenia, które można kliknąć. Tak wygląda prowadzenie, nie obiecywanie — każde twierdzenie na tej stronie wskazuje swój dowód.

dniminuty

czas importu katalogu 4000+ produktów · openhaft.pl · → wdrożenia

Praca, nie deklaracje. Wybierz rejestr.

miniatury: realne zrzuty z tego projektu · duoton

Inżynieria AI z górnej półki — na dowodach, nie na sloganach.

BitSharp · studio inżynierii AI · Rzeszów

Obszary pracy

RAG i wyszukiwanie wiedzy

Systemy pytań do wiedzy firmy, które cytują źródło co do akapitu — hybrydowy retrieval, reranking, ewaluacja trafności na złotych zbiorach.

dowód → notatki/retrieval
Systemy agentowe

Orkiestracja narzędzi, obsługa awarii, punkt wejścia człowieka — mierzone własnym benchmarkiem 67 zadań agentowych po polsku.

dowód → PolAgentBench
Ekstrakcja danych z dokumentów

Faktury, umowy, korespondencja: schemat wymuszony na dekodowaniu, walidacja deterministyczna, człowiek zatwierdza wyłącznie odstępstwa.

dowód → wdrożenia
Produkcja i optymalizacja LLM

Serwowanie z pełną obserwowalnością, routing modeli, kwantyzacja — od 22 GB do 3,26 GB bez utraty polszczyzny.

dowód → warsztat · badania

Standard pracy

  • Deterministycznie: seed, temperatura 0, wyniki odtwarzalne co do bitu.
  • Commit-stamped: każdy wynik nosi hash kodu, który go policzył.
  • Testy przed GPU: 204 testy jednostkowe zanim ruszy jakikolwiek run.
  • Zastrzeżenia wprost: artefakty metodologiczne opisujemy w tekście, nie w przypisie.
  • Otwarte artefakty: modele, dane i logi ewaluacji są publiczne.
  • Deterministyczny kod tam, gdzie wygrywa — LLM tylko tam, gdzie reguł nie da się spisać.

Założyciel

Jakub Prejzner — AI Engineer. Buduje systemy RAG, automatyzację procesów i ekstrakcję danych z dokumentów; dziedzinę śledzi i wdraża na bieżąco. Publikacje o kwantyzacji to dowód, że potrafi wejść w temat na poziomie badawczym.

badania własne2 (arXiv + draft)
publiczne modele Bielika9 · HF
benchmark agentowy67 zadań
wdrożenie produkcyjneopenhaft.pl
bazaRzeszów / PL