OpenAI pochwaliło się, że rozwiązało lub przybliżyło się do rozwiązania ponad 370 problemów matematycznych dzięki jednemu agentowi AI. Jednocześnie korporacja odmawia ekspertom wglądu w proces.
Dla branży AI matematyka stała się benchmarkiem pozwalającym demonstrować możliwości modeli sztucznej inteligencji. Tę dziedzinę nauki szczególnie upodobało sobie OpenAI, które chwali się rozwiązaniem lub poczynieniem postępów w 372 problemach matematycznych za pomocą jednego agenta AI, i to po wpisaniu jednego promptu dla każdego z zadań. OpenAI nie chce jednak dzielić się dokładnymi informacjami, jak AI dochodziło do swoich wniosków.
Mniej niż 10 godzin temu OpenAI udostępniło na GitHubie zbiór wyników dotyczących 372 problemów matematycznych. Część z nich stanowi rozwiązania znanych problemów lub przedstawiają wyniki przybliżające badaczy do ich rozwiązania. Wiele z nich zostało zweryfikowanych przez Lean, system wykorzystywany do formalizacji i mechanicznej weryfikacji dowodów. W teorii oznacza to, że wyniki są niemal na pewno poprawne.
Dla OpenAI to pokaz siły, gdyż firma miała wykorzystać wyłącznie jednego agenta AI, w przeciwieństwie do kontrowersyjnego rozwiązania problemu Naviera-Stokesa, gdzie użyto 10 000 agentów jednego modelu sztucznej inteligencji. Cień na sytuację rzuca sama korporacja, ponieważ działa wbrew zaleceniom grupy doradczej ds. matematyki i sztucznej inteligencji?, którą sama powołała.
Jak donosi serwis Scientific American, rekomendacje grupy naukowców dotyczą między innymi upubliczniania całego procesu wnioskowania modelu AI oraz dokładnych promptów. Tego domaga się między innymi Andrew Sutherland, matematyk z MIT:
Dopóki nie udostępnią modelu, a inni badacze nie będą w stanie odtworzyć ich wyników, uważam, że wszelkie deklaracje o rozwiązywaniu problemów za pierwszym podejściem przez pojedynczego agenta należy traktować jako niepotwierdzone.
Największym problemem jest tempo prac. Specjaliści będą potrzebowali prawdopodobnie wielu miesięcy, zanim uda się dokładnie przeanalizować wyniki sztucznej inteligencji: czy dowody zawierają nowe pomysły, czy są wyłącznie połączeniem znanych wcześniej metod. Rzecznik prasowy OpenAI przyznał, że nawet eksperci firmy nie rozumieją w pełni dowodów wygenerowanych przez model sztucznej inteligencji.
Dla matematyków pojawia się zatem problem: czy uznawać dowody bez wszystkich równań, których korporacja nie planuje ujawniać, czy domagać się wstrzymania ich publikacji do czasu, aż proces wnioskowania AI zostanie w pełni zweryfikowany.

Autor: Zbigniew Woźnicki
Przygodę z publicystyką i pisaniem zaczął w serwisie Allegro, gdzie publikował newsy związane z grami, technologią oraz mediami społecznościowymi. Wkrótce zawitał na GRYOnline.pl i Filmomaniaka, pisząc o nowościach związanych z branżą filmową. Mimo związku z serialami, jego serce należy do gier wszelakiego typu. Żaden gatunek mu nie straszny, a przygoda z Tibią nauczyła go, że niebo i muzyka w grach są całkowicie zbędne. Przed laty dzielił się swoimi doświadczeniami, moderując forum mmorpg.org.pl. Uwielbia ponarzekać, ale oczywiście konstruktywnie i z umiarem. Na forum pisze pod ksywką Canaton.