AdastraSIC Akcelerátor

Data Engineer

  • Hybrid
  • Praha
  • Full-time

Kdo jsme a co děláme?

Molecula je česká health-tech firma patřící do skupiny Channel Lab. Jsme malý tým 7 lidí v regulovaném prostředí zdravotnického softwaru a stavíme aplikaci, která pomáhá lidem bezpečně užívat léky – hlídá interakce, dávkování i vhodnost v těhotenství. 💊

Běží pod ní datová platforma: 86 000 léků ze SÚKL a PDK, desítky milionů řádků otevřených dat, vlastní katalog doplňků stravy, produktová analytika v PostHogu a rodící se AI vrstva nad nestrukturovanými dokumenty.

Data dosud spravoval tech tým vedle samotného vývoje aplikace. Teď ale hledáme někoho, pro koho budou data hlavní prací, ne vedlejšákem.

Hledáme prvního člověka, který tohle všechno převezme a udělá z toho svoji vlastní doménu. Nastoupíš do první čistě datové role u nás a převezmeš fungující, dobře zdokumentovanou platformu od lidí, kteří ji postavili a osobně ti ji předají.


Co budeš dělat?

  • Vlastnit ETL léčiv: měsíční běhy, datová kvalita, drift monitoring, řízené nasazování na produkci.

  • Rozvíjet BI nad BigQuery a Metabase: dashboardy, podle kterých se ve firmě reálně rozhoduje.

  • Vlastnit produktovou analytiku a komunikovat s MKT a Product týmem: event tracking, funnely, feature flagy, podpora business pro správné rozhodování.

  • Rozvíjet náš vlastní katalog doplňků stravy (Python, dlt, LLM enrichment)

  • Stavět AI vrstvu nad lékovými daty: RAG znalostní báze nad dostupnými zdroji. Extrakce strukturovaných faktů lokálními LLM, hybridní retrieval, evaluace kvality (RAGAS).

  • Co dál a v jakém pořadí, si budeš řídit ty, na stole čekají další data projekty.

Core stack (není třeba umět vše): Keboola (Snowflake), Python, SQL, dlt, BigQuery, Metabase, PostHog, lokální LLM (jo máme vlastní NVIDIA Spark). 

Okrajově: PostgreSQL, GCP a DigitalOcean. 

AI vrstvu stavíme na lokálních modelech - citlivá zdravotní data neopouštějí naši infrastrukturu. Miliony až desítky milionů řádků, pořád žádná big data, ale stavíme jednoduchá řešení, která spolehlivě fungují.


Koho hledáme? 🕵🏼‍♂️

Nemusíš umět všechno z našeho stacku. Důležitá je adopce a chuť si zbytek doplnit.

  • Výborné SQL a datové modelování, solidní Python na pipelines a ingest.

  • End-to-end provoz ETL pipeline včetně datové kvality a monitoringu.

  • Dashboardy, kterým věří i nedatoví lidé, a event tracking, který navrhneš a budeš si za ním stát.

  • 2+ roky praxe a samostatnost: roadmapu si z velké části řídíš po svém.

Plus, ne podmínka: zdravotnictví nebo jiné regulované prostředí, BigQuery/dbt, praktická zkušenost s LLM/RAG (embeddings, retrieval, evaluace), zkušenost z role „prvního datového člověka“ ve firmě.


Co nabízíme? 👇🏽

  • Ownership celé datové domény od prvního dne: architektura, prioritizace i výběr nástrojů budou ve tvých rukou. Řešíš je napřímo s CTO a tech leadem Tomášem, žádné mezivrstvy.

  • AI-first prostředí: Claude Code a agentní workflow jsou u nás denní standard. licence a nástroje ti platíme a na lokální modely máme železo.

  • Práci, která dává smysl: tvoje pipeline hlídají lékové interakce skutečným pacientům.

  • Režim máme hybridní - 1 - 2x týdně v kanceláři ve Vodičkově a zbytek klidně remote

  • 25 dní dovolené

  • Odpovídající platové ohodnocení - odměnu dle tvých celkových zkušeností


Jak bude probíhat výběrko?

  1. 30 minut videocall - poznáme se a ukážeme ti platformu.

  2. ~2 hodiny praktický úkol nad reálnými daty + vyhodnocení.

  3. 15 minut - finální videocall s CEO.

Pokud tě zajímají bližší informace o nás a naší práci, určitě se podívej na náš 

web https://www.molecula.cz/

nebo na 

LinkedIn https://www.linkedin.com/company/moleculaapp/



Přihlaste se k newsletteru a posuňte se vpřed!
© 2012 – 2026 StartupJobs.com s.r.o.