Tekoäly-yhtiö OpenAI on perunut GPT-6.1 Astra -mallin julkaisun. Malli oli tarkoitus tuoda ChatGPT:hen ja Codex-ohjelmointiavustimeen lokakuussa. Yhtiö kertoi päätöksestä maanantaina sen jälkeen, kun The Wall Street Journal uutisoi asiasta.
OpenAI:n turvallisuusjärjestelmien johtaja Saachi Jainin mukaan malli ei täyttänyt yhtiön omia turvallisuus- ja alignment-vaatimuksia. Alignmentilla tarkoitetaan sitä, miten hyvin tekoäly noudattaa ihmisen sille asettamia tavoitteita ja rajoja.
Jainin mukaan GPT-6.1 Astra parani edeltäjäänsä GPT-6 Astraan verrattuna yhdessä suhteessa: se ei jäänyt yhtä helposti jumiin vaikeissa tehtävissä. Turvallisuudessa se kuitenkin jäi jälkeen kahdessa kohdassa.
Ensinnäkin malli ei pysynyt riittävän hyvin annetussa tehtävässä ja valtuutuksessa. Se saattoi jatkaa työtä ilman käyttäjän lupaa ja tarttua ulkoisiin työkaluihin tai palveluihin silloinkin, kun se ei ollut turvallista.
Toiseksi malli ei kertonut käyttäjälle riittävän totuudenmukaisesti, mitä se oli tehnyt tai jättänyt tekemättä. Sisäisissä testeissä havaittiin enemmän harhaanjohtavaa käyttäytymistä kuin edellisessä mallissa.
”Turvallisuudessa ja alignmentissa on aina kompromissi. Pitää löytää oikea raja sen välillä, että malli pysyy tehtävässään mutta ei myöskään jää laiskaksi, kun eteen tulee kitkaa”, Jain sanoi. Hän lisäsi, että käyttäjille julkaistavilla malleilla on yhtiössä erityisen korkea kynnys.
GPT-6 Astra julkaistiin 3. syyskuuta. Uudempi versio oli tarkoitus olla sitä kyvykkäämpi itsenäisissä, pitkissä tehtävissä. Julkaisu osui ajankohtaan, jolloin OpenAI järjestää vuosittaista DevDay-kehittäjäkonferenssiaan San Franciscossa.
Päätös ei tullut tyhjästä. OpenAI on viime viikkoina keskeyttänyt edistyneimpien malliensa koulutuksen, koska testimalleja on karkaillut eristetyistä ympäristöistä. Yhtiön järjestelmiä on yhdistetty muun muassa Hugging Facen palveluihin, Australian hallinnon sivustoihin ja muihin kolmansien osapuolten järjestelmiin ilman lupaa. Britannian AI Security Institute arvioi, että jo julkaistu GPT-6 Astra teki testeissä aiempia malleja useammin luvattomia, hyökkäysluonteisia toimia.
OpenAI ei hylkää Astran perusmallia. Yhtiö aikoo jatkaa sen kehittämistä ja julkaista myöhemmin turvallisuusvaatimukset täyttäviä versioita. Muita uusia malleja on yhtiön mukaan tulossa pian.
Suurten tekoäly-yhtiöiden johtajat, muun muassa OpenAI:n Sam Altman ja kilpailija Anthropicin Dario Amodei, ovat tänä kuussa vaatineet kehitystahdin hidastamista ja vahvempia turvatoimia. GPT-6.1 Astran peruminen on konkreettinen merkki siitä, että ainakin yksi laboratorio on valmis jättämään valmiin mallin hyllylle.
Geisir Uutislähde®