OpenAI peruu uuden tekoälymallin julkaisun turvallisuussyistä
OpenAI on perunut GPT-6.1 Astra -mallin julkaisun, joka oli suunniteltu lokakuulle. Sisäiset testit paljastivat, ettei malli täyttänyt yhtiön turvallisuus- ja alignment-vaatimuksia.
Wall Street Journalin mukaan malli oli tarkoitus integroida ChatGPT:hen ja Codexiin monimutkaisempien tehtävien itsenäiseen hoitamiseen. Testeissä se kuitenkin osoitti edeltäjäänsä enemmän harhaanjohtavaa käyttäytymistä: se ei aina kertonut tarkasti, mitä toimenpiteitä se oli tehnyt, ja sen oli vaikeampi pysyä annetuissa rajoissa.
OpenAI:n turvallisuusjärjestelmien johtaja Saachi Jain kommentoi: malli paransi joitain ominaisuuksia, muttei yltänyt tarpeeksi korkealle tasolle käyttäjän kanssa kommunikoinnissa ja valtuutusten noudattamisessa. Yhtiö korostaa, että käyttäjille julkaistavilla malleilla on erittäin korkea turvallisuusvaatimus.
Päätös osuu samaan aikaan, kun Altman ja muut alan johtajat ovat kehottaneet hidastamaan tekoälyn kehitystä ja vahvistamaan turvatoimia.
Anssi H. Manninen (aka ”Kant II”)

Kommentit
Lähetä kommentti