Kdo je autorem textu? Nová technologie vědců z UP jej pomůže určit

Vědci z Filozofické fakulty Univerzity Palackého v Olomouci vyvinuli technologii, která dokáže pomocí rozboru textu určit jeho autora, jeho psychické rozpoložení či sociální prostředí. Při svém výzkumu analyzovali frekvenci slov v textech spisovatelů, politiků i vrahů a získané poznatky využili při tvorbě postupu pro profilování osob. Technologii lze využít v přizpůsobení internetového obsahu konkrétnímu uživateli, reklamě, personalistice, psychologii, kriminalistice i v oblasti bezpečnosti státu. Novinku už eviduje patentový úřad Spojených států, řekl dnes novinářům Dan Faltýnek z katedry obecné lingvistiky FF UP.

Odborníci z katedry obecné lingvistiky FF UP se frekvenčními analýzami textu zabývají už několik let, metoda se používá například při určení autorství psaného slova. Dosud se vědci zaměřovali na slova s vyšší frekvencí výskytu, autoři nové metody zvolili odlišný postup. "S kolegy jsme zjistili, že podle nízko frekventovaných, ale pravidelně rozmístěných, opakujících se slov lze autora poznat také. A co víc, ještě s vyšší mírou jistoty. Už několik let se tedy zaměřujeme na opačné spektrum, na zvláštní skupinu slov v dané slovní zásobě konkrétního člověka," uvedl Faltýnek.

Metoda je podle lingvistky Martiny Benešové založena na tom, že odborníci v textu hledají jakýsi slovní otisk, který lze použít při analýze a určení autora textu. Například z rozboru mnoha textů Václava Havla vyplynulo, že kladl důraz na slovo "konečně". "Postupem času jsme vyvinuli technologii, která nám umožňuje najít nízkofrekventovaná klíčová slova, která jsou společně s důrazem na postoj řečníka k určitému tématu otiskem autora," podotkl Faltýnek.

Objev je podle něj převratný, neboť dosavadní metody takto vysokou jistotu autorství textu nepřinášely. Olomouckým vědcům nyní díky nové technologii stačí analyzovat pouze 200 až 500 slov, aby mohli s určitou mírou přesnosti dokázat autorství. Pokud mají k dispozici přibližně 1 500 slov, tak jsou schopni autorství zaručit s velmi vysokou mírou pravděpodobnosti. Dříve si byli jisti až po analýze 6000 slov.

Nová technologie podle Benešové dokáže extrahovat profil lidí. Opakování určitých slov může poukázat na psychických stav člověka nebo jeho sociální prostředí. Vědce například šokovaly výsledky analýzy manifestu amerického vraha, ze které vyplynul jeho motiv i místo následného násilného činu.

Novou technologii lze využít v personalistice, on-line psychoterapii, soudnictví nebo při komunikaci s ohroženými skupinami. Své místo najde také v personalizované reklamě i v boji proti extremismu, terorismu či dezinformacím, jelikož umožňuje určit inkriminované osoby. Lze ji využít i na obranu proti personalizaci člověka na internetu. "Nejjednodušší variantou využití naší technologie bude v dohledné době aplikace, která lidem umožní dozvědět se něco o sobě a pomůže jim v seberozvoji," řekla Benešová.

Související

Rychlovky

  • OLOMOUC
    Olomouc se i nadále chystá na dopravní omezení. Několik desítek už běží, další se chystají. Důvody pro uzavírky částečné i úplné jsou různé, najdete mezi nimi festival, opravy i budování nových přechodů. Na která místa si dát pozor? 
  • OLOMOUC
    Začátkem června se otevřela zrekonstruovaná plocha starého autobusáku na olomoucké tržnici. Opravená část okolo zastávek se po dešti ukázala jako vadná, když se na ni vytvořily hrbolky. Město o problému ví a chystá se rychlá náprava. Více.
  • OLOMOUCKO
    Na změny v cestování se budou muset připravit cestující v Uničově. Příští pondělí 22. června bude zahájena celková rekonstrukce tamního autobusového nádraží. Zahájení prací bude znamenat změny v polohách zastávek. Více.

Nejnovější

Nejčtenější

Seriály