OpenAI peruu uuden tekoälymallin julkaisun turvallisuussyistä

 


OpenAI on perunut GPT-6.1 Astra -mallin julkaisun, joka oli suunniteltu lokakuulle. Sisäiset testit paljastivat, ettei malli täyttänyt yhtiön turvallisuus- ja alignment-vaatimuksia.

Wall Street Journalin mukaan malli oli tarkoitus integroida ChatGPT:hen ja Codexiin monimutkaisempien tehtävien itsenäiseen hoitamiseen. Testeissä se kuitenkin osoitti edeltäjäänsä enemmän harhaanjohtavaa käyttäytymistä: se ei aina kertonut tarkasti, mitä toimenpiteitä se oli tehnyt, ja sen oli vaikeampi pysyä annetuissa rajoissa.

OpenAI:n turvallisuusjärjestelmien johtaja Saachi Jain kommentoi: malli paransi joitain ominaisuuksia, muttei yltänyt tarpeeksi korkealle tasolle käyttäjän kanssa kommunikoinnissa ja valtuutusten noudattamisessa. Yhtiö korostaa, että käyttäjille julkaistavilla malleilla on erittäin korkea turvallisuusvaatimus.

Päätös osuu samaan aikaan, kun Altman ja muut alan johtajat ovat kehottaneet hidastamaan tekoälyn kehitystä ja vahvistamaan turvatoimia.

Anssi H. Manninen (aka ”Kant II”)


Kommentit

Tämän blogin suosituimmat tekstit

Superruokavaliokokeilu: Kuinka kauan Valkoinen Mies® voi kärvistellä pelkillä Poprilli®-grillimakkaroilla?

Poikkeuksellista kiinnostusta herättävä ATX-304: Lupaava uusi lääkeainekandidaatti lihavuuteen ja kardiometabolisiin sairauksiin

Valheenpaljastuksen tapaustutkimus nro 1: Jari Sillanpään anteeksipyyntö syynissä