2026-03-05 arXiv 2603.04162 · v2 opublikowana
2026-02 9 modeli + 3 datasety na HF
2026-07-24 PolAgentBench: draft ukończony · 67 zadań
2026-07-23 3 tezy notatek w akceptacji
openhaft.pl · produkcja · live
Dwa własne badania, autorski benchmark agentowy, dziewięć publicznych modeli Bielika i wdrożenia, które można kliknąć. Tak wygląda prowadzenie, nie obiecywanie — każde twierdzenie na tej stronie wskazuje swój dowód.
czas importu katalogu 4000+ produktów · openhaft.pl · → wdrożenia
Praca, nie deklaracje. Wybierz rejestr.
miniatury: realne zrzuty z tego projektu · duoton
/badaniaPublikacja z nicią do każdej liczbyBielik-Q2-Sharp: sześć metod 2-bit, 22 benchmarki, zastrzeżenia wprost — twierdzenia wskazują wiersze Table 4.
arXiv 2603.04162↗ w. 01–08
/wdrozenia285 dolarów, co do wierszaNić prowadzi z twierdzenia do wiersza „Total $285” w tabeli kosztów; obok — żywy sklep z importem 4000+ produktów.
Table 3 · openhaft.pl↗ kt-total
/notatkiRejestr przemyśleń z przypisamiTeksty o dziedzinie z tezą i klikalnymi źródłami; trzy tezy czekają w kolejce akceptacji.
0 wpisów · 3 tezy§ 01–03/modeleDziewięć modeli, zero tajemnicWarianty 2-bitowego Bielika z wagami, Hessianami i logami ewaluacji — można policzyć te same liczby.
huggingface.co/Jakubrd43,26 GB · 2,4 bpw/warsztatKod, który wygląda tak samo, gdy nikt nie patrzyml-serve: rejestr modeli, A/B, obserwowalność — MIT, do przeczytania linijka po linijce.
github.com/jakubprejznerregistry.py/kontaktJedno zdanie i adresBez formularza i kalkulatora wyceny. Projekt, pytanie do publikacji, wspólne badania — mail jak do człowieka.
kontakt@bitsharp.pl→Inżynieria AI z górnej półki — na dowodach, nie na sloganach.
BitSharp · studio inżynierii AI · RzeszówObszary pracy
Systemy pytań do wiedzy firmy, które cytują źródło co do akapitu — hybrydowy retrieval, reranking, ewaluacja trafności na złotych zbiorach.
dowód → notatki/retrievalOrkiestracja narzędzi, obsługa awarii, punkt wejścia człowieka — mierzone własnym benchmarkiem 67 zadań agentowych po polsku.
dowód → PolAgentBenchFaktury, umowy, korespondencja: schemat wymuszony na dekodowaniu, walidacja deterministyczna, człowiek zatwierdza wyłącznie odstępstwa.
dowód → wdrożeniaSerwowanie z pełną obserwowalnością, routing modeli, kwantyzacja — od 22 GB do 3,26 GB bez utraty polszczyzny.
dowód → warsztat · badaniaStandard pracy
- Deterministycznie: seed, temperatura 0, wyniki odtwarzalne co do bitu.
- Commit-stamped: każdy wynik nosi hash kodu, który go policzył.
- Testy przed GPU: 204 testy jednostkowe zanim ruszy jakikolwiek run.
- Zastrzeżenia wprost: artefakty metodologiczne opisujemy w tekście, nie w przypisie.
- Otwarte artefakty: modele, dane i logi ewaluacji są publiczne.
- Deterministyczny kod tam, gdzie wygrywa — LLM tylko tam, gdzie reguł nie da się spisać.
Założyciel
Jakub Prejzner — AI Engineer. Buduje systemy RAG, automatyzację procesów i ekstrakcję danych z dokumentów; dziedzinę śledzi i wdraża na bieżąco. Publikacje o kwantyzacji to dowód, że potrafi wejść w temat na poziomie badawczym.