Český software umí rozeznat falešný hlas. Největší zájem je v Asii

Brněnská softwarová firma Phonexia nabízí v tuzemsku unikátní technologii na odhalování hlasových deepfaků.

Deepfaky patří mezi nejdiskutovanější fenomény posledních let. Zatímco veřejnost zná především falešná videa, velkým problémem se stávají i syntetické hlasy. Ty dokážou věrně napodobit politiky, celebrity i rodinné příslušníky a často slouží k podvodům.

V tuzemsku je Phonexia zatím jedinou firmou, která technologii pro detekci hlasových deepfake nabízí. | Phonexia

Brněnská společnost Phonexia proto vyvinula technologii, která dokáže odhalit, zda hlas skutečně patří konkrétnímu člověku, nebo ho vytvořila umělá inteligence. „Umíme určit, jestli je nahrávka autentická, nebo jde o deepfake,“ vysvětluje produktový manažer Phonexie Jiří Nezval. O řešení, které je na trhu zhruba rok, je největší zájem v Asii. 

Phonexia nabízí své nástroje především bezpečnostním složkám a policii, které je využívají při odhalování podvodů. Rychle se ale uplatňují i v komerční sféře, od call center po bankovní sektor. „Zájem je globální, ale největší poptávku vidíme v jihovýchodní a jižní Asii,“ říká Nezval. Důvod je zřejmý – právě tam se masově rozšířil tzv. voice phishing, tedy telefonní podvody, při nichž pachatelé napodobují hlasy známých osob či autorit. Významným trhem je i Latinská Amerika a rostoucí poptávku zaznamenává také Evropa, včetně českých bezpečnostních orgánů.  

Praha otevřela první herní akcelerátor: Deset studentských týmů získá finanční podporu a mentoring

V tuzemsku je Phonexia zatím jedinou firmou, která technologii pro detekci hlasových deepfake nabízí. „Globální konkurence existuje, ale naše výhoda spočívá v téměř dvacetiletém know-how v oblasti řečových technologií. Navíc se soustředíme i na open-source modely, které jsou snadněji zneužitelné, a proto představují větší riziko,“ přibližuje Nezval. Dalším benefitem je možnost kombinovat software s technologiemi pro hlasovou biometrii a řečovou analytiku či nasazovat ho přímo na infrastruktuře zákazníka, bez připojení k internetu, což je pro státní instituce klíčové.  

Používání systému je přitom jednoduché. Uživatel nahraje zvuk a software vrátí číselné vyjádření pravděpodobnosti, že jde o deepfake. Dosahuje přitom přesnosti přes 96 %, a pokud je k dispozici i originální nahrávka hlasu, může být spolehlivost až 99 %. Vývoj takového systému ale není snadný. Phonexia spolupracuje s vědci z brněnského Vysokého učení technického a využívá neuronové sítě trénované na stovkách typů syntetických hlasů. „Je to jedna z nejtěžších výzev v oblasti zpracování řeči. A také hra na kočku a myš. Každý měsíc se může objevit nový model, na který musíme reagovat. Je to podobné jako u antivirových programů,“ popisuje Nezval. 

Mezi trendy, které firma aktuálně sleduje, patří také detekce tzv. watermarkingu – neslyšitelných značek vložených do syntetického audia. „Funguje to podobně jako vodoznak na dokumentu. Běžný posluchač ho nepostřehne, ale technologie ho dokáže rozpoznat,“ přibližuje Nezval. Pokud by tuto metodu začali poskytovatelé syntetických hlasů používat systematicky, mohla by se stát účinnou ochranou proti zneužití. 

Samotná technologie však podvody nezastaví, slouží spíše k jejich odhalování. Klíčovou roli proto hraje také prevence a osvěta. „Rozdíl mezi originálním a syntetickým hlasem dnes nepozná ani zkušený profesionál, natož běžný člověk. Proto je důležité být obezřetný, zejména poud jde o citlivé informace nebo peníze. Doporučujeme vždy ověřit zprávu jiným kanálem, například zavolat na známé číslo zpět,“ uzavírá Nezval. 

Redakčně upravená tisková zpráva
• Témata: Inovace a startupy

Doporučujeme