Detekce a vyhýbání
Detekce a vyhýbání (Detect and Avoid, DAA) je klíčová schopnost autonomních bezpilotních letadel (UAS), která umožňuje včas rozpoznat překážky a kooperativní i nekooperativní účastníky vzdušného prostoru a bezpečně upravit trajektorii letu. V posledních letech došlo k zásadnímu posunu od ručně navržených pravidel k datově řízeným přístupům: učení s učitelem (supervised) a bez učitele (unsupervised), případně k jejich hybridům (semi-supervised, self-supervised). Cílem článku je systematicky popsat architektury, senzorické modality, tréninkové a validační procesy, metriky i nasazení DAA na palubních výpočetních platformách s ohledem na bezpečnost, latenci a regulace.
Formulace problému DAA
DAA lze formulovat jako kombinaci úloh počítačového vidění a řízení: (1) percepce (detekce objektů, odhad vzdálenosti a relativní rychlosti, sledování cílů), (2) predikce (odhad budoucích trajektorií), (3) rozhodování (výběr vyhýbacího manévru v souladu s omezeními dynamiky a pravidly vzdušného prostoru). Při učení s učitelem se modely učí přímo z označených dat (detekční rámečky, třídy, vzdálenosti), zatímco při učení bez učitele se využívají latentní reprezentace, anomálie nebo konzistence mezi senzory a časem, aby se vydolovaly signály bez nutnosti rozsáhlého ručního označování.
Senzorické modality a fúze
- RGB/IR kamery: vysoké rozlišovací schopnosti, nízká hmotnost; citlivé na osvětlení a počasí. IR rozšiřuje použitelnost v noci.
- Stereo/šířkové kamery: hustá parallaxová informace, okamžitý odhad hloubky na krátké a střední vzdálenosti.
- Lidar: přesná 3D geometrie, odolný vůči osvětlení; hmotnost, spotřeba energie a cena jsou však kompromisy.
- Radar/FMCW: dlouhý dosah a přímo odhadovaná radiální rychlost, dobrá průchodnost nepříznivým počasím.
- ADS-B/kooperativní zdroje: identifikace a poloha kooperativních letadel; nepostihuje malé/nekooperativní objekty (ptáci, drony).
- IMU/GNSS: vlastní stav nosiče pro relativní odhady a stabilizaci vizuálních metod.
Fúze může být early (spojení surových dat), mid-level (spojení hlavních příznaků) nebo late (spojení rozhodnutí). U učených modelů je efektivní mid-level fúze s prostorově-časovými moduly (3D konvoluce, attention nad sekvencemi, transformerové enkodéry) a s rozšířením o fyzikální omezení (konečná dynamika vlastního UAV).
Učení s učitelem: detekce, segmentace a metriky hloubky
Při učení s učitelem jsou klíčové kvalitní anotace a reprezentativnost scénářů. Typické podproblémy:
- Detekce objektů: modely jednorázového průchodu (anchor-free detektory) poskytují nízkou latenci pro malé objekty v dálce. Důležitá je tréninková strategie s focal loss a těžbou těžkých negativ, protože třídní nerovnováha je extrémní.
- Instance/semantická segmentace: přesné obrysy překážek (kabely, stromy) umožňují jemné vyhýbací manévry. Kombinace encoder-decoder architektur s prostorově-časovou rekurencí snižuje třesení masek.
- Monokulární/stereoskopická hloubka: u monokulární hloubky se učí regrese vzdálenosti; u stereo je k dispozici dozor z disparity. Pro DAA je kritická metricky škálovaná hloubka a spolehlivostní mapy (uncertainty).
- Vícekanálová fúze (kamera+radar/lidar): při tréninku se využívá teacher-student paradigma (lidar jako učitel, kamera jako student) pro přenos geometrie do levnější modality.
Učení bez učitele: anomálie, konzistence a self-supervised
Učení bez učitele zmírňuje závislost na anotacích a zlepšuje generalizaci:
- Detekce anomálií: autoenkodéry a normalizing flows se učí model normálních vizuálních stavů; odchylky (přetečení rekonstrukční chyby) indikují neznámé překážky nebo neočekávané situace.
- Kontrastivní učení: vytváří reprezentace invariantní vůči osvětlení, šumu, perspektivě; snižuje potřebu anotací a zlepšuje přenos do nových podmínek.
- Self-supervised hloubka a ego-motion: ukládá se fotometrická konzistence mezi po sobě jdoucími snímky a maskami pohybu; výstupem je hustá hloubka a odhad pohybu bez ground-truth hloubky.
- Clustering a pseudo-labels: neoznačená data se shlukují v prostoru příznaků a následně se iterativně doplňují pseudo-štítky pro další supervised trénink.
Sledování a odhad relativního stavu
Percepci doplňuje multiobjektové sledování (MOT) a odhad relativní polohy a rychlosti cíle. Kombinují se učený detektor s filtry (Kalman/IMM/UKF) a tracking-by-detection paradigmatem. Pro rychlé cíle jsou vhodné asociační metody s appearance embeddings (reidentifikace) a s konzistencí optického toku. Pro senzory s přímým odhadem rychlosti (radar) se využívá pravděpodobnostní fúze (Bayes, factor graphs) s kamerou.
Predikce trajektorií a interakční modely
Predikce budoucích stavů objektů zohledňuje interakce a omezení manévrovací schopnosti. Učené graph neural networks a transformerové sekvenční modely dokážou extrapolovat kooperativní i nekooperativní chování. V praxi jsou vázány fyzikální limity (max. zrychlení/otáčení) a „sociální“ pravidla (bezpečné odstupy) formou loss penalizací nebo jako hard constraints ve výstupu.
Rozhodování a plánování vyhýbacího manévru
Výstup percepce a predikce vstupuje do plánovače. Pro bezpečnost se typicky volí dvoustupňový přístup: (1) rychlá reaktivní vrstva (velocity obstacles, dynamic window), (2) vyšší optimalizační vrstva (MPC, sampling-based plánovače), která respektuje dynamiku a pravidla. Učené politiky (např. imitace expertů) mohou generovat inicializace nebo prostor kandidátů, zatímco finální volbu validuje bezpečnostní shield s garantovanými invarianty (např. Control Barrier Functions).
Nejistota, kalibrace a runtime assurance
Kritická není pouze přesnost, ale i správná kalibrace pravděpodobností. Používá se Monte Carlo dropout, ensembling, evidenční hluboké učení a temperature scaling pro úroveň důvěry. V provozu runtime assurance (RTA) monitoruje, zda riziko kolize překročilo práh, nebo zda se systém nachází mimo distribuční prostor tréninku (OOD). Při překročení limitů se aktivuje konzervativní politika (zpomalení, stoupání, nouzové zastavení) nebo přechod na pravidlové zálohy.
Data, syntetika a doménová adaptace
Reálné kolizní situace jsou vzácné, proto je nezbytná syntetika a domain randomization (počasí, textury, osvětlení, pohybové profily). Přechod do reality řeší unsupervised domain adaptation (adversariální přizpůsobení příznaků, stylový transfer) a test-time adaptation (jemné dolaďování statistik BN). Klíčové je doplňovat syntetiku reálnými hard case datasetmi: malé drony na pozadí oblohy, ptáci, kabely, zrcadlení, protisvětlo, déšť, mlha.
Metriky a hodnocení výkonu DAA
- Percepce: mAP/mAR pro malé objekty (specifické pro vzdálené pixely), Average Localization Error, přesnost hloubky (RMSE, δ-metriky), MOT (MOTA/MOTP/HOTA).
- Predikce: ADE/FDE (průměrné a koncové chyby trajektorie), pravděpodobnostní metriky (NLL, CRPS) a kalibrace predikčních kuželů.
- Bezpečnost: Minimum Miss Distance (MMD), Time to Closest Point of Approach (TCPA), Probability of Collision (PoC) pod spolehlivostí senzoriky.
- Provozní: latence end-to-end (kamera → manévr), využití energie, dostupnost (>99.9 %), míra plan-abort vs. falešné poplachy (FAR).
Realtime implementace a optimalizace
Palubní platformy (SoC s GPU/NPU) vyžadují optimalizace: kvantizace, prořezávání (pruning), knowledge distillation, fúze operací a pipelining (souběžné získávání snímků, inference a plánování). Kritická je deterministická latence: fixní velikosti dávek, předalokovaná paměť, rozdělení jader pro ROS2 exekutor, práhování FPS podle rychlosti letu a rizika. Pro výpadky senzorů se udržuje minimální funkční profil (např. vizuální tok + IMU) s degradovaným, ale bezpečným chováním.
Bezpečnostní argumenty a verifikace
DAA s učenými modely musí být doplněno formálními a strukturovanými důkazy bezpečnosti: Requirements-to-Evidence trasování, nezávislé testy, oddělené datasetu (train/val/test s časoprostorovou segregací), adversarial testy (oslňování, šum, záměrné maskování), HIL/SIL kampaně se simulací kolizí a blízkých přeletů. Runtime monitory s simplex architekturou nechávají učenému modulu generovat návrhy, které validuje pravidlové bezpečnostní jádro.
Supervised vs. unsupervised: komparativní výhody
- Učení s učitelem: vysoká přesnost pro známé třídy a situace, předvídatelný výkon; náročné na anotace, riziko dataset bias.
- Učení bez učitele: odhaluje neočekávané objekty a stavy, škáluje s velkými neoznačenými datasetmi; vyžaduje opatrnou interpretaci (anomálie ≠ hrozba) a dobrou integraci s rozhodováním.
V praxi vítězí hybrid: supervised percepce pro známé hrozby (letadla, helikoptéry, drony), unsupervised OOD detekce a anomálie jako watchdog, semi-supervised jemné doladění na nových oblastech nasazení.
Integrace s pravidly vzdušného prostoru a autonomií
DAA rozhodování musí respektovat koridory, no-fly zóny, minimální výšky, priority a pravidla right-of-way. Percepčně-plánovací smyčka má rozhraní k vyššímu plánovači mise (trajektorie, body zájmu) a k komunikační vrstvě pro kooperaci v rojových scénářích (sdílení zjištění, distribuovaná fúze, vyhýbání se kolizím mezi členy roje).
Kooperativní DAA v rodech
V rojových operacích DAA získává systémový rozměr: sdílení lokálních map obsazenosti, odhady trajektorií a koordinované manévry. Učené graph-based modely s komunikujícími uzly (message passing) dokážou škálovat, pokud se omezí šířka pásma pomocí komprese příznaků a prioritizace hrozeb. Konflikty řeší arbitráž s globálními pravidly a lokálními safety bubbles.
Okrajové případy, robustnost a fail-operational
Mezi obtížné případy patří malé, rychlé cíle proti přepálenému nebi, drifty kamery při vibracích, déšť/mlha, odrazy na skle, velmi tenké překážky (lana). Robustnost zvyšují datová augmentace (simulované oslňování, kapky, motýlový šum), fyzikální filtry (vibrační izolace), redundantní modality (radar + kamera) a logika eskalace (při vysoké nejistotě snížit rychlost a zvýšit separaci).
Praktický vývojový a validační pipeline
- Požadavky a hazardy: definuj MMD/TCPA limity, latence, třídy cílů; vytvoř hazard log a bezpečnostní cíle.
- Data: shromáždi reálné sekvence a syntetiku; připrav scenario library se standardizovanými skripty.
- Modely: navrhni supervised detekci a self-supervised hloubku; přidej anomální detektory a kalibraci nejistoty.
- Trénink: strategie třídní nerovnováhy, curriculum podle vzdálenosti objektu, mixed precision, validace na OOD setech.
- Integrace: ROS2 graf, časové značky, synchronizace senzorů, hard-real-time pro plánování.
- HIL/SIL: ve smyčce s autopilotem, injekce selhání senzorů a komunikačních výpadků.
- Letové zkoušky:



























