W 2010 ukończyłem studia z tytułem magistra inżyniera na kierunku Elektronika i Telekomunikacja Politechniki Poznańskiej, specjalność multimedia, praca magisterska o syntezie dźwięku instrumentów. W 2025 obroniłem doktorat z informatyki na Wydziale Matematyki i Informatyki Uniwersytetu im. Adama Mickiewicza w Poznaniu (prezentacja z obrony). Moje badania dotyczyły ewaluacji systemów rozpoznawania mowy, których zwieńczeniem była publikacja na konferencji NeurIPS oraz otwarte wyzwanie na konkursie PolEval.
Obecnie współpracuję z Wydziałem Matematyki i Informatyki UAM, prowadząc warsztaty z ewaluacji systemów ASR (sylabus) oraz biorąc udział w projektach badawczo-rozwojowych nad przetwarzaniem audio w Centrum Sztucznej Inteligencji.
Zawodowo specjalizuję się w kierowaniu interdyscyplinarnymi zespołami badawczo-rozwojowymi i zarządzaniu siecią partnerów zewnętrznych. Posiadam doświadczenie w skutecznym i terminowym dostarczaniu produktów oraz usług danych. Obecnie jestem liderem zespołu Data Annotation & QA Services w Allegro, który odpowiada za infrastrukturę i procesy zapewniania jakości rozwiązań AI w Polsce i na rynkach międzynarodowych. Szczegóły w CV.
Po pracy popularyzuję ewaluację systemów AI na ekspertwpetli.pl, piszę o cyfrowym bezpieczeństwie dzieci na tatai.pl, tworzę muzykę elektroniczną jako Me?How? (BC, SC, YT) i spędzam czas z rodziną.
Wystąpienia
- 2026GenAI in Localization 2026
- 2026GenAI in Localization 2026
Prowadzony z zespołem Localization & Data w Allegro.
- 2025Product Cafe #15
- 2025GenAI in Localization 2025
- 2024NeurIPS 2024 (D&B Track)
- 2024PolEval 2024
- 2024YouTube
- 2024Panel discussion (YouTube)
Artefakty
- Kalkulator TCO ASR — Orientacyjny TCO systemów ASR dla języka polskiego — API, korekty, reklamacje. Na bazie danych BIGOS.
- BIGOS v2 (HuggingFace) — Wyselekcjonowany benchmark łączący 24 otwarte korpusy mowy (BIGOS V2 i PELCRA for BIGOS) do reprodukowalnej oceny polskiego ASR. Opublikowany na NeurIPS 2024.
- Polish ASR Leaderboard — 25 systemów ASR ocenianych na żywo na 4000+ polskich nagraniach — dokładność, koszt, prędkość, odporność.
Polecam
- Designing Machine Learning Systems — Chip Huyen
Najlepsze pojedyncze źródło o ML w produkcji jakie znam.
- Speech and Language Processing — Jurafsky & Martin
Klasyk; obecnie 3rd edition draft.
- Niespokojne pokolenie — Jonathan Haidtaktualnie czytam
Empirycznie ugruntowana krytyka smartfonowego dzieciństwa.
Kontakt
Otwarty na współpracę naukową, pytania o BIGOS, kierunki ewaluacji mowy i głosu.
