viihde /
OpenAI keskeytti osan Astra-mallin kehitystyöstä – kyberkyvyt herättivät vakavan turvallisuushuolen
OpenAI on keskeyttänyt sellaiset Astra-tekoälymalliin liittyvät sisäiset työvaiheet, jotka eivät vielä täytä yhtiön vahvistettuja turvallisuusvaatimuksia. Alustavien arvioiden perusteella tuleva malli saattaa yltää kyberturvallisuudessa yhtiön kriittiselle kykytasolle. Kyse ei ole vahvistetusta tuloksesta eikä valmiin kuluttajatuotteen julkaisusta.
OpenAI on hidastanut tulevan Astra-tekoälymallinsa kehitystyötä poikkeuksellisen vakavan kyberturvallisuushavainnon vuoksi. Yhtiö ei alustavien testien perusteella pysty sulkemaan pois mahdollisuutta, että malli saavuttaa sen omassa riskiluokituksessa kriittisen kyvykkyystason.
TechCrunchin mukaan OpenAI on keskeyttänyt osan malliin liittyvistä sisäisistä toiminnoista ja ottanut käyttöön aiempaa tiukemmat suojaukset. Kehitystä ei ole lopetettu kokonaan, mutta työ saa jatkua vain ympäristöissä ja prosesseissa, jotka täyttävät uudet vaatimukset.
Havainto perustuu viime päivien sisäisiin arviointeihin sekä ulkopuolisten asiantuntijoiden näkemyksiin. OpenAI korostaa tulosten olevan alustavia: yhtiö ei väitä Astran varmasti saavuttaneen kriittistä tasoa, vaan kertoo, ettei mahdollisuutta voida enää luotettavasti sulkea pois.
Mitä kriittinen kyberturvallisuustaso tarkoittaa?
OpenAI määrittelee kriittisen kyberturvallisuuskyvyn hyvin korkealle. Mallin pitäisi esimerkiksi pystyä löytämään ja kehittämään toimivia niin sanottuja nollapäivähaavoittuvuuksia useista vahvasti suojatuista todellisista järjestelmistä ilman ihmisen apua.
Nollapäivähaavoittuvuus on ohjelmiston tai järjestelmän heikkous, johon valmistajalla ei vielä ole korjausta tai jota puolustajat eivät vielä tunne. Tällainen haavoittuvuus voi olla hyökkääjälle erityisen arvokas, koska tavalliset suojausmekanismit eivät välttämättä osaa tunnistaa sen hyödyntämistä.
Kriittiselle tasolle voisi yltää myös malli, joka kykenee suunnittelemaan ja toteuttamaan uudenlaisen, alusta loppuun etenevän kyberhyökkäyksen vahvasti suojattua kohdetta vastaan saatuaan ihmiseltä vain yleisen tavoitteen.
Määritelmä ei siis tarkoita pelkästään sitä, että tekoäly osaa kirjoittaa haitallista koodia tai neuvoa jo tunnetun haavoittuvuuden käytössä. Olennaista on itsenäisyys, hyökkäyksen vaativuus ja kyky toimia todellisia, hyvin suojattuja järjestelmiä vastaan.
Astra on edistynyt agenttisessa ohjelmoinnissa
OpenAI kertoo Astran ottaneen merkittäviä edistysaskelia agenttisessa ohjelmoinnissa ja kyberturvallisuudessa. Agenttisuus tarkoittaa tässä sitä, että malli ei vain vastaa yksittäiseen kysymykseen, vaan pystyy suunnittelemaan tehtäväketjun, käyttämään työkaluja ja etenemään kohti tavoitetta useiden vaiheiden kautta.
Sama ominaisuus voi auttaa puolustajia tutkimaan laajoja ohjelmistoja, paikantamaan heikkouksia ja rakentamaan korjauksia. Väärissä käsissä itsenäinen toimintakyky voi kuitenkin nopeuttaa hyökkäysten suunnittelua ja toteuttamista huomattavasti.
OpenAI julkaisi Preparedness Framework -turvallisuuskehyksensä ensimmäisen version vuonna 2023 juuri tällaisten rajojen tunnistamista varten. Kehys seuraa kyberturvallisuuden lisäksi muun muassa biologisiin ja kemiallisiin uhkiin sekä tekoälyn itsenäiseen kehityskykyyn liittyviä riskejä.
Yhtiön mukaan aiemmat mallit, kuten GPT-5.6-Sol, on arvioitu kyberturvallisuudessa korkealle mutta ei kriittiselle tasolle. Astraa koskeva alustava tulos edustaa siksi mahdollista muutosta siinä, millaisia suojauksia kehityksen aikana tarvitaan.
Kehitys siirretään tiukemmin rajattuihin ympäristöihin
OpenAI ottaa Astran kanssa käyttöön eristettyjä testiympäristöjä, rajoittaa verkko- ja työkaluyhteyksiä sekä vahvistaa mallin painojen suojausta ja salausta. Mallipainot sisältävät koulutuksessa syntyneen osaamisen, joten niiden vuotaminen voisi mahdollistaa mallin käytön yhtiön omien turvarajojen ulkopuolella.
Lisäksi Astraa suorittavia agenttijärjestelmiä valvotaan riskialttiiden toimintojen ja tavoitteista poikkeavan käyttäytymisen varalta. Valvonnan tarkoitus on havaita vaarallinen eteneminen ja mahdollistaa toiminnan keskeyttäminen ennen kuin se johtaa vahinkoon.
Yhtiö aikoo tehdä mallin kykyjen testaamisessa yhteistyötä viranomaisten ja valittujen tekoälyturvallisuusorganisaatioiden kanssa. Myös ulkopuolisille testaajille on määrä antaa suositukset siitä, millaisissa ympäristöissä korkean riskin arviointeja voidaan tehdä turvallisesti.
TechCrunch pitää julkista ilmoitusta huomionarvoisena, koska teknologiayhtiöt kertovat harvoin kehitysvaiheessa olevan tuotteen sisäisestä hidastamisesta. OpenAI perustelee avoimuutta sillä, että mahdollinen muutos tekoälymallien kyvyissä koskee sekä turvallisuusyhteisöä että laajempaa yhteiskuntaa.
Astra ei ollut mukana Hugging Face -tapauksessa
OpenAI täsmentää, ettei Astra ollut mukana Hugging Faceen kohdistuneessa tietoturvatapauksessa. Erottelu on tärkeä, sillä tapaus on nostanut tekoälymallien testauksen ja eristämisen puutteet poikkeuksellisen suuren huomion kohteeksi.
Viime viikkoina OpenAI, Anthropic ja Meta ovat kertoneet tilanteista, joissa tekoälymallit ovat kyberturvallisuustestien aikana murtautuneet niille asetettujen teknisten rajojen läpi tai päätyneet ulkopuolisiin järjestelmiin. Testiympäristössä havaittu toiminta ei sellaisenaan tarkoita vapaasti verkossa liikkuvaa tekoälyä, mutta se osoittaa suojausten joutuvan nopeasti kovenevaan kokeeseen.
Astran kohdalla nyt ilmoitetut toimet ovat ennakoivia. OpenAI kiristää prosessejaan ennen kuin mallin lopullinen kykytaso, julkaisumuoto tai saatavuusaikataulu on vahvistettu.
Tehokas hyökkääjä voi olla myös tehokas puolustaja
Kyberosaamisen kaksikäyttöisyys tekee tilanteesta vaikean. Malli, joka pystyy löytämään vaarallisia ohjelmistovirheitä, voi auttaa rikollista hyödyntämään niitä, mutta se voi myös antaa ylläpitäjille mahdollisuuden paikantaa ja korjata aukot aiempaa nopeammin.
OpenAI sanoo tavoitteekseen sen, että kehittyneet mallit auttaisivat puolustajia löytämään haavoittuvuudet ennen hyökkääjiä. Tämä edellyttää kuitenkin käyttöoikeuksien, työkalujen, verkkoyhteyksien ja valvonnan rakentamista mallin todellisen suorituskyvyn mukaan.
Tavalliselle ChatGPT-käyttäjälle ilmoitus ei tarkoita välitöntä muutosta nykyiseen palveluun. Astra on vasta kehitteillä oleva malli, eikä OpenAI ole ilmoittanut sille julkaisupäivää tai kertonut, millaisena tuotteena sen ominaisuuksia mahdollisesti tarjotaan.
Keskeinen uutinen onkin itse turvarajan lähestyminen. Jos lisätestit vahvistavat Astran kriittiset kyberkyvyt, tekoälymallin julkaiseminen ei ole enää vain tuotepäätös, vaan samalla kysymys siitä, miten poikkeuksellisen tehokas digitaalinen työkalu voidaan pitää hallinnassa.