FOTO: Ilustracija
Oksford otvorio vrata biblioteke za OpenAI: Istorijske knjige postaju dio obuke AI modela
26.09.2026. | 21:05 Dodaj BL Portal kao Google izvorUniverzitet u Oksfordu dozvolio je kompaniji OpenAI, koja stoji iza čet bota ChatGPT, da obučava svoje modele vještačke inteligencije koristeći istorijske tekstove iz svoje čuvene biblioteke Bodleana, prenio je Gardijan.
Prema internim dokumentima, materijal iz biblioteke Bodleana koji je kompanija OpenAI digitalizovala korišćen je za „popunjavanje skupa podataka za obuku OpenAI“.
Oksford je u martu 2025. godine objavio partnerstvo sa tom kompanijom, navodeći da će se softver OpenAI koristiti za digitalizaciju tekstova iz ove svjetski poznate univerzitetske biblioteke, čime će sadržaj postati dostupniji studentima i istraživačima.
U saopštenju, međutim, nije navedeno da će se taj materijal koristiti za obuku modela kompanije OpenAI.
Ti modeli se obučavaju tako što „upijaju“ ogromne količine podataka kako bi prepoznali obrasce u riječima i time „naučili“ da pišu kompletne rečenice i obavljaju druge kognitivne zadatke.
Portparol kompanije OpenAI izjavio je da je kompanija ponosna što može da obezbijedi da „današnji modeli vještačke inteligencije sačuvaju svjetsko istorijsko znanje za budućnost“.
„S obzirom na to da više od milijardu ljudi koristi ovu tehnologiju u svakodnevnom životu, važno je da ona odražava različite kulture, istorije i perspektive“, dodali su iz ove kompanije.
Zapisnici sa sastanaka na Univerzitetu u Oksfordu, pribavljeni putem zahtjeva za slobodan pristup informacijama, bilježe zabrinutost osoblja, uključujući članove upravnog odbora biblioteke Bodleana, povodom rizika usljed saradnje sa kompanijom OpenAI.
Knjižari su takođe prijavili talas porudžbina za manje poznata djela, poput priručnika o poljoprivrednim alatima u Africi 18. vijeka ili biografija vozača automobila iz pedesetih godina prošlog vijeka, navodi list.
Vlasnici antikvarnica pretpostavljaju da, s obzirom na to da je malo vjerovatno da ova djela postoje u digitalizovanom obliku na internetu, ona predstavljaju nove podatke koje može da „upotrijebi“ sljedeća generacija modela vještačke inteligencije.
Veb-sajtovi čiji se sadržaj automatski prikuplja sve su više zasićeni materijalom koji je generisala AI, što ih čini manje korisnim za obuku modela, pa su se programeri okrenuli fizičkim, često istorijskim, zbirkama knjiga.
Kompanija OpenAI je sklopila slične sporazume s američkim istraživačkim bibliotekama, kao što su Javna biblioteka Bostona, Kaltek, MIT i Univerzitet u Mičigenu, u okviru projekta pod nazivom „NextGenAI“.
Oksford je jedini član ovog projekta iz Ujedinjenog Kraljevstva. Do juna 2025. godine, iz zbirke biblioteke Bodleana kompaniji OpenAI ustupljeno je 125.000 slika skeniranih iz istorijskih doktorskih disertacija, uključujući radove sa evropskih i američkih univerziteta nastale u 19. i 20. vijeku.
Ostali skenirani tekstovi obuhvataju rijetku zbirku od 10.000 primjeraka balada iz 16. vijeka.
U okviru ovog sporazuma, zbirke biblioteke Bodleana ostaju netaknute, za razliku od prakse na drugim mjestima gdje se polovne knjige nakon skeniranja šalju na reciklažu.
„Taj projekat će zapravo omogućiti Bodleani da učini materijal dostupnijim većem broju ljudi kojima bi pristup tom sadržaju inače mogao da bude otežan“, kazao je portparol Oksforda.
