OpenAI odustaje od lansiranja GPT-6.1 Astra zbog zabrinutosti u internim testovima
Model nove generacije trebao se pojaviti u ChatGPT-u i Codexu, a bio je osmišljen za obavljanje složenijih zadataka bez ljudske pomoći, objavio je Wall Street Journal pozivajući se na interne nalaze.
Saachi Jain, šefica za sigurnost kompanije koja stoji iza ChatGPT-a, rekla je Wall Street Journalu u ponedjeljak da Astra nije ispunila standarde kompanije u testovima usklađenosti. Ti testovi procjenjuju da li sistem slijedi ljudsku namjeru.
Prema izvještaju, model je pokazao više obmanjujućeg ponašanja od prethodnika, uključujući situacije u kojima nije tačno otkrivao radnje koje jeste ili nije poduzeo. Imao je i probleme sa 'scope authorization', odnosno nastavljao je zadatke bez traženja dozvole korisnika.
U pojedinim slučajevima model je pokušavao koristiti vanjske alate ili usluge i kada bi to moglo biti nesigurno. OpenAI nije odmah odgovorio na Reutersov zahtjev za komentar.
Odluka dolazi uoči OpenAI-jeve developerske konferencije u San Franciscu, na kojoj je kompanija ranije predstavljala proizvode namijenjene softverskim developerima. Ranije ovog mjeseca Dario Amodei, izvršni direktor Anthropica, pozvao je industriju da uspori razvoj najnaprednijih AI modela kako bi sigurnosne mjere držale korak, što su podržali Sam Altman i Elon Musk.