Serwis preprintów arXiv, będący jednym z największych elektronicznych archiwów prac naukowych, jest obecnie zalewany dużą liczbą artykułów generowanych przez sztuczną inteligencję. ArXiv umożliwia publikowanie prac naukowych, które nie były jeszcze recenzowane, pod warunkiem, że są one przesyłane przez zarejestrowanych i zaufanych autorów. Zaufanie takie uzyskuje się poprzez potwierdzenie od innego zaufanego autora. Większość prac umieszczanych w arXiv jest później publikowana w renomowanych czasopismach naukowych. Artykuły dostępne są bezpłatnie i dotyczą dziedzin takich jak fizyka, astronomia, matematyka, informatyka, statystyka, biologia oraz matematyka finansowa.
Archiwum powstało w 1991 roku w Los Alamos National Laboratory, a obecnie jest prowadzone przez Cornell University. Dzięki niemu pracownicy naukowi mogą śledzić bieżące wydarzenia w swoich dziedzinach.
Wzrost liczby artykułów i wyzwania dla moderacji
W ostatnich latach liczba zgłaszanych artykułów do arXiv rośnie gwałtownie. We wrześniu 2024 roku do serwisu zgłoszono 20 569 prac, rok później liczba ta wzrosła do 26 646, a we wrześniu 2026 roku osiągnęła 40 363. Wzrost ten jest częściowo związany z rozwojem możliwości matematycznych sztucznej inteligencji, która potrafi automatycznie generować artykuły z dużą szybkością i minimalnym nakładem pracy ludzkiej.
Kevin Buzzard z Imperial College London wskazał, że zgłaszanie autentycznych artykułów stało się trudniejsze, ponieważ moderatorzy arXiv są przeciążeni pracą, a artykuły mogą pozostawać w kolejce recenzji przez wiele tygodni. Buzzard korzysta ze sztucznej inteligencji, aby wskazała mu, na których pracach powinien się skupić, gdyż nie jest w stanie codziennie czytać wszystkich zgłoszeń.
Buzzard zwrócił uwagę, że artykuły o charakterze prowizorycznym często nie wyjaśniają dobrze pewnych kwestii. Problem nie dotyczy jedynie poprawności matematycznej, ale także zrozumienia przez ludzi, co sztuczna inteligencja czasami realizuje słabo.
Artykuły generowane przez AI i nowe regulacje
Dzięki dostępowi do sztucznej inteligencji osoby nieprofesjonalne w matematyce mogą rozwiązywać trudne problemy i automatycznie generować artykuły przedstawiające wyniki, które następnie są publikowane w arXiv. Jednak takie prace bywają krytykowane przez matematyków. Przykładowo, Chaim Goodman-Strauss z Uniwersytetu Arkansas opisał jeden z takich artykułów, zawierający poprawne rozwiązanie długotrwałego problemu, jako "w zasadzie prowizoryczny".
Terence Tao z Uniwersytetu Kalifornijskiego w Los Angeles wyraził w wywiadzie dla „New Scientista” obawy dotyczące sposobu, w jaki dokonuje się odkryć matematycznych i udostępnia je społeczności matematycznej.
Modele sztucznej inteligencji rozwiązują problemy matematyczne coraz szybciej, a technika formalizacji jest istotna dla potwierdzenia poprawności ich rozwiązań. Jednak konieczne jest zaufanie do procesu formalizacji.
W celu ograniczenia liczby prac o niskiej jakości generowanych przez AI, arXiv wprowadził nowe limity dla autorów. Obecnie mogą oni przesyłać maksymalnie dwa artykuły w miesiącu kalendarzowym i mieć jednocześnie trzy aktywne zgłoszenia.
ArXiv zezwala na korzystanie ze sztucznej inteligencji pod warunkiem jej ujawnienia. Jednocześnie odnotowano wzrost liczby artykułów o wąskim zakresie i niskiej wartości naukowej. W odpowiedzi na tę sytuację powstała nowa platforma o nazwie Hexagon, która służy do publikowania "pre-preprintów", czyli artykułów generowanych przez AI, których matematycy mogą jeszcze nie w pełni rozumieć.
Serwis arXiv pozostaje ważnym źródłem dla pracowników naukowych, jednak obecne zmiany i wyzwania związane z rosnącą liczbą artykułów generowanych przez sztuczną inteligencję wpływają na sposób funkcjonowania archiwum i dostępność autentycznych publikacji.

Komentarze
Linki do innych stron WWW w komentarzach są niedozwolone i takie komentarze są automatycznie odrzucane.