Přejít na obsah
Reference live

Aneta: hlasové diktování nálezů s AI přepisem pro nemocniční patologii

Webová aplikace, díky které lékaři a laborantky na patologii diktují nálezy hlasem místo psaní. Nahrávka se automaticky přepíše, vyčistí od přeřeknutí a uloží k žádance vzorku jako verzovaný text s dohledatelným doslovným přepisem. Součástí je AI asistentka Aneta, offline odolná instalovatelná aplikace (PWA) a neměnná auditní stopa odpovídající nárokům na zdravotnická data.

Role
Kompletní dodávka
architektura, vývoj, nasazení, dokumentace
Vývoj
20 vydání
od verze 1.0 v červenci do 2.2 v září 2026
AI
3 modely
přepis řeči, čištění textu, asistentka s potvrzováním akcí
Data
EU
hosting v Amsterdamu, backend na privátní síti, neměnný audit

Výchozí situace

Na oddělení patologie vzniká denně velké množství textu: makroskopický popis vzorku, mikroskopie, závěr. Lékaři tradičně diktují do diktafonu a laborantky nahrávky ručně přepisují. Mezikrok stojí hodiny práce, je zdrojem překlepů a záměn v latinské terminologii a při pochybnostech není jak dohledat, co skutečně zaznělo.

Zadání znělo jednoduše: mluvit a mít text rovnou v systému. Podmínky už tak jednoduché nebyly. Aplikaci musí zvládnout personál bez technických zkušeností, na tabletu i mobilu, v nemocniční síti s výpadky. Žádný diktát se nesmí ztratit. A protože jde o údaje o zdravotním stavu, tedy zvláštní kategorii osobních údajů podle čl. 9 GDPR, musí být zpracování minimalistické, auditovatelné a provozované v EU.

Řešení

Navrhli jsme a vyvinuli Anetu, kompletní diktovací systém postavený kolem jednoduchého toku: štítek s kódem na nádobě se vzorkem, jeden sken kamerou, otevřená žádanka, velké tlačítko mikrofonu. Nález se skládá z okének (například Makroskopie, Mikroskopie, Závěr), každé s vlastním textem, kresbou a historií verzí.

Přepis běží na serveru. Po klepnutí na Hotovo se nahrávka odešle během okamžiku a personál může telefon zamknout nebo pokračovat s dalším vzorkem. Text se v žádance objeví sám, jakmile je hotový.

Co jsme vyvinuli

  • Žádanky a štítky. Generování unikátních kódů bez zaměnitelných znaků, tisk štítků s QR i čárovým kódem (Code 128) na běžné štítkové tiskárně, sken kamerou telefonu i ze souboru. Kódy nikdy neobsahují osobní údaje pacienta.
  • Diktování, které se neztratí. Zvuk se během nahrávání průběžně ukládá do zařízení a dlouhý diktát odchází na server po částech ještě v průběhu nahrávání. Fronta nahrávek přežije pád aplikace, výpadek sítě i zamčený displej. Recorder hlídá, že mikrofon opravdu nahrává, a po tichém výpadku na iOS se sám obnoví. Nahrávka zůstává v zařízení, dokud server nepotvrdí, že text vznikl.
  • Přepis s lékařskou terminologií. Dvoustupňové zpracování: řečový model vytvoří doslovný přepis, jazykový model ho vyčistí. Provede hlasové příkazy (nový odstavec, závorka, dvojtečka), samoopravy mluvčího („pět, oprava, šest milimetrů“), zapíše čísla a jednotky podle českých zvyklostí („5 × 4 mm“). Latinská terminologie, klasifikace a hodnoty se nikdy nepřekládají ani nemění. Nejisté slovo zůstane tak, jak zaznělo, model má zakázáno dosadit klinický termín, který nebyl vysloven. Doslovný přepis se ukládá navždy beze změny.
  • Slovník pracoviště. Správce zapíše vlastní termíny, zkratky a jména a přepis je do minuty začne rozpoznávat u všech uživatelů.
  • Živý přepis. Alternativní režim přes WebSocket a Realtime API: text se zobrazuje během mluvení a dá se opravovat hlasem („oprava, ne hodinky, ale holinky“).
  • Diktování do kurzoru. Uživatel klepne do textu nebo označí část a nadiktuje doplnění. Přepis se vloží přesně na místo, a pokud se text mezitím změnil, bezpečně se připojí na konec, aby se nic nepřepsalo.
  • Import z diktafonů. Pracoviště zvyklá na profesionální diktafony Philips a Olympus nahrají soubory DSS/DS2, MP3 či WAV a systém je převede a přepíše stejnou cestou jako diktát. Nahrávka zůstává u textu a dá se kdykoli přehrát nebo nechat přepsat znovu.
  • Kresby v okénkách. Náčrt řezu nebo orientace vzorku prstem, perem či myší, s vlastní historií verzí.
  • Trojitá pojistka proti ztrátě dat. Každá změna textu je nová verze, historie se nikdy nepřepisuje. Smazané žádanky jdou do koše, odkud je kdokoli obnoví. Vše se zapisuje do auditu, který nejde upravit ani smazat, vynuceno na úrovni databáze, ne jen konvencí.
  • AI asistentka Aneta. Chat zabudovaný v aplikaci najde žádanky i texty jejich okének, vysvětlí libovolnou funkci a navrhne akce (založit žádanku, přejmenovat, přesunout do koše). Každou změnu provede až po potvrzení uživatele a technicky nemůže překročit jeho oprávnění, protože volá systém výhradně s jeho identitou.
  • Správa pro oddělení. Uživatelé a role, slovník diktování, diagnostika přepisu, auditní deník s filtry, stránka O aplikaci s verzí a přehledem změn psaným pro personál.

Architektura a technologie

Monorepo se dvěma službami a databází, nasazené v EU regionu (Amsterdam). Frontend je Nuxt 4 s Nuxt UI 4 jako instalovatelná PWA. Součástí Nuxtu je Nitro BFF vrstva, jediná veřejná brána: ověřuje přihlášení přes httpOnly cookie, proxuje požadavky, streamuje chat a živý přepis. Backend tvoří Strapi 5 na privátní síti s PostgreSQL, kde běží verzování, audit a fronta přepisů na pozadí. Zvuk se zpracovává přes ffmpeg (spojování částí, konverze diktafonových formátů, dělení dlouhých nahrávek v pauzách řeči). Pro přepis a čištění slouží modely OpenAI, pro živý režim Realtime API a pro asistentku Vercel AI SDK se streamovanými nástroji a schvalováním akcí v UI.

Bezpečnost a GDPR

  • Hosting i databáze v EU, backend bez veřejné domény, přístup k aplikaci omezený na síťové vrstvě (privátní síť, VPN nebo IP allowlist).
  • JWT jen v httpOnly cookie, rate limity na přihlášení a chat, účty se nemažou, pouze deaktivují, aby zůstala konzistentní auditní stopa.
  • Žádné osobní údaje pacienta v kódech, na štítcích ani v aplikaci. Přiřazení k pacientovi zůstává záměrně v nemocničním informačním systému.
  • Nahrávky diktátů leží mimo veřejné úložiště, čtou se jen autentizovanou cestou s auditním záznamem, mají vypínač a nastavitelnou retenci. Uchování zvuku je rozhodnutí provozovatele, ne dodavatele, a dokumentace ho tak i popisuje.
  • Připraveno na EU data residency a zero data retention u poskytovatele AI modelů přepnutím konfigurace.

Průběh a výsledek

První produkční verze šla do provozu v červenci 2026. Během následujících sedmi týdnů jsme na základě zpětné vazby z reálného provozu vydali dvacet verzí: zpřesňování přepisu v hlučné laboratoři, odolnost nahrávání na iPhonech, import z diktafonů, kresby, živý přepis a nakonec zjednodušení datového modelu, aby po naskenování štítku šlo diktovat bez jediného kliknutí navíc.

Výsledkem je systém, který personál používá bez školení, ve kterém se žádný diktát neztratil a ve kterém je u každé věty nálezu dohledatelné, kdo ji nadiktoval, jak zněl doslovný přepis a jak zněla samotná nahrávka. Architektura je připravená na rozšíření na další oddělení nemocnice i na napojení na nemocniční informační systém.

Obrázky z projektu

Copyright © 2026 Caroline Technologies s.r.o.