Naukowcy wykorzystali sztuczną inteligencję do analizy ponad 1600 świadectw z USC Shoah Foundation i Yale Fortunoff Archive, odkrywając podobieństwa między stylami.

Źródło zdjęcia: arXiv.org
Badacze z USC Shoah Foundation i Yale Fortunoff Video Archive opracowali nowatorską metodę analizy komputerowej świadectw ocalałych z Holokaustu. Wykorzystując sztuczną inteligencję, przeanalizowali ponad 1600 relacji, aby zweryfikować powszechne przekonanie o różnicach stylistycznych między zbiorami. Pełne badanie dostępne jest w serwisie arXiv.
Zespół naukowców pod kierownictwem Itamara Trainina przeprowadził pierwszą tak szeroką analizę porównawczą archiwów historii mówionej, wykorzystując najnowsze techniki sztucznej inteligencji, w tym modelowanie tematyczne i analizę opartą na dużych modelach językowych.
Badacze od lat rozróżniali między dwoma stylami dokumentowania świadectw ocalałych. USC Shoah Foundation słynie z przeprowadzania wywiadów w uporządkowanym, kierowanym przez prowadzącego formacie, podczas gdy Yale Fortunoff Video Archive preferuje bardziej otwartą, swobodną formę rozmowy. To rozróżnienie wpłynęło zarówno na badania naukowe, jak i rozwój późniejszych archiwów.
Zespół wykorzystał segmentację dyskursu, modelowanie tematyczne i analizę opartą na dużych modelach językowych, aby zmierzyć poziom „strukturalności” świadectw. Analizowano spójność tematyczną, dynamikę między prowadzącym a świadkiem oraz rozkład typów pytań zadawanych podczas wywiadów.
Wyniki generalnie potwierdziły różnice strukturalne zidentyfikowane we wcześniejszych badaniach. Jednocześnie ujawniły znaczące podobieństwa między zbiorami, zarówno w obrębie pojedynczych wywiadów, jak i w całych wzorcach narracyjnych. To odkrycie komplikuje prostą dychotomię „strukturalne kontra swobodne”, często stosowaną do tych historii mówionych.
Badanie wykracza poza rewizję fundamentalnego twierdzenia w studiach nad Holokaustem, dostarczając skalowalnych, replikowalnych ram do analizy porównawczej korpusów. Jako dowód koncepcji sugeruje szersze zastosowania dla cyfrowej historii mówionej, analizy narracyjnej i projektowania platform adnotacji obywatelsko-naukowych.
Praca stanowi pierwszy krok w kierunku wykorzystania sztucznej inteligencji do głębszej analizy świadectw historycznych, otwierając nowe możliwości badawcze dla historyków i informatyków.

Twitch pozwala streamerom zablokować trening AI Amazona, ale ponad 16 tys. twórców kwestionuje, jak długo ich treści już były wykorzystywane.

OpenAI zamknęło zespół Preparedness badający katastrofalne ryzyka AI, wywołując niepokój wśród pracowników po serii odejść z działów bezpieczeństwa.

Firmy chwalą się, że AI odkryła lek, ale w patentach wymieniają wyłącznie ludzi – bo prawo w USA nie uznaje maszyn za wynalazców.