Kannettava tietokone näyttää abstrakteja tekoälyn työtiloja, koodia ja kaavioita modernilla työpöydällä.
Findance.com


viihde /

Anthropic julkaisi Claude Opus 5:n: lähes huippumallin tehot puolta halvemmalla

Anthropic on julkaissut Claude Opus 5 -tekoälymallin, joka lähestyy yhtiön tehokkaimman Fable 5 -mallin suorituskykyä mutta maksaa vain puolet siitä. Uutuus on suunniteltu etenkin vaativaan ohjelmointiin, monivaiheisiin tehtäviin ja ammattikäyttöön. Samalla se on tuotu tavallisten Claude-tilaajien ulottuville.

Anthropic julkaisi Claude Opus 5:n 24. heinäkuuta 2026 vain vajaat kaksi kuukautta Opus 4.8:n jälkeen. Tiheä julkaisutahti kertoo siitä, kuinka nopeasti suurten tekoälymallien kilpailu etenee: vielä toukokuun lopussa Opus 4.8 oli malliperheen tuore raskaan sarjan vaihtoehto.

TechCrunchin mukaan Opus 5 on pienempi ja kokonaisuutena hieman vähemmän kyvykäs kuin Anthropicin Fable 5 -huippumalli. Se päihittää Fable 5:n kuitenkin osassa yhtiön julkaisemia vertailutestejä, minkä lisäksi sen hinta ja kevyemmät käyttörajoitukset voivat tehdä siitä useimmille käyttäjille käytännöllisemmän valinnan.

Puolta halvempi kuin Fable 5

Claude Opus 5 maksaa rajapinnassa 5 dollaria miljoonalta syötetokenilta ja 25 dollaria miljoonalta tuotetulta tokenilta. Hinnat ovat samat kuin Opus 4.8:lla ja puolet Fable 5:n vastaavista hinnoista.

Token on tekstin käsittelyssä käytettävä yksikkö, joka voi olla sana, sanan osa tai välimerkki. Rajapintaa hyödyntäville yrityksille hinnan merkitys kasvaa nopeasti, jos tekoäly käsittelee suuria asiakirjamääriä tai työskentelee pitkään itsenäisenä agenttina.

Opus 5 on saatavilla Anthropicin omassa Claude-palvelussa sekä Claude API:ssa, Amazon Bedrockissa, Google Cloudissa ja Microsoft Foundryssa. Se on uusi oletusmalli Claude Max -tilauksessa ja Claude Pro -tilauksen vahvin malli.

Tarjolla on myös tutkimusvaiheessa oleva Fast-tila, jossa mallin kerrotaan tuottavan vastauksia noin 2,5-kertaisella nopeudella. Nopeudesta veloitetaan kaksinkertainen perushinta, joten vaihtoehto on tarkoitettu tilanteisiin, joissa vastausajalla on kustannuksia suurempi merkitys.

Malli ei vain vastaa, vaan yrittää varmistaa tuloksen

Anthropic korostaa Opus 5:n kykyä tarkistaa omaa työtään ja jatkaa ratkaisun hiomista, kunnes tehtävä on valmis. Tämä erottaa pitkäkestoiseen työskentelyyn tarkoitetut tekoälyagentit tavallisesta chatbotista, joka tuottaa vastauksen yhden kehotteen perusteella ja jää odottamaan seuraavaa kysymystä.

Yhtiön testissä malli sai tehtäväkseen rakentaa koneenosasta kolmiulotteisen FreeCAD-mallin, mutta sillä ei ollut suoraa tapaa tarkastella alkuperäistä piirrosta. Opus 5 rakensi itse konenäköön perustuvan työvaiheen, poimi geometrian kuvan pikseleistä ja viimeisteli sen avulla 3D-mallin.

Toisessa esimerkissä Opus 5 etsi avoimen lähdekoodin pakettienhallintaohjelmasta todellisen virheen. Anthropicin mukaan malli ei tyytynyt korjaamaan näkyvää oiretta, vaan löysi ongelman varsinaisen syyn ja huomasi myös reunatapauksen, joka oli jäänyt ohjelmistoyhteisön omasta korjauksesta puuttumaan.

Kolmannessa kokeessa malli rakensi kaupankäyntiyritykselle markkinatietosyötteen uutta pörssiä varten. Koska käytettävissä ei ollut toimivaa tietovirtaa ratkaisun testaamiseen, malli loi lisäksi oman testiympäristönsä ja tarkisti sen avulla, että ohjelma tulkitsi tiedot oikein.

Nämä esimerkit havainnollistavat Opus 5:n tavoiteltua työskentelytapaa, mutta ne eivät yksin todista mallin onnistuvan yhtä luotettavasti kaikenlaisissa todellisissa tehtävissä. Suuri osa julkaisuhetken suorituskykytiedoista perustuu Anthropicin omiin testeihin ja ennakkokäyttäjien kokemuksiin.

Miljoonan tokenin muisti pitkille tehtäville

Opus 5:n konteksti-ikkuna on miljoona tokenia ja vastauksen enimmäispituus 128 000 tokenia. Suuri konteksti antaa mallille mahdollisuuden käsitellä samalla kertaa esimerkiksi laajoja ohjelmistokokonaisuuksia, pitkiä asiakirjoja ja useiden tiedostojen työprosesseja.

Konteksti-ikkunaa voi ajatella mallin työmuistina yhden tehtävän aikana. Pelkkä suuri tokenmäärä ei silti takaa oikeaa vastausta, sillä olennaista on myös se, pystyykö malli löytämään laajasta aineistosta tärkeät yksityiskohdat, noudattamaan ohjeita ja käyttämään työkaluja johdonmukaisesti.

Anthropicin mukaan suurimmat parannukset Opus 4.8:aan verrattuna näkyvät syvällisessä päättelyssä, pitkäkestoisissa agenttitehtävissä, ohjelmoinnissa, virheiden etsimisessä, kuvan ymmärtämisessä sekä taulukkolaskenta- ja esitystehtävissä. Malli on suunniteltu jatkamaan monivaiheista työtä ilman, että tehtävän tavoite katoaa matkan aikana.

Mallin mukautuva päättely on oletusarvoisesti käytössä. Käyttäjä tai kehittäjä voi valita työmäärää ohjaavan effort-tason matalasta enimmäistasoon, jolloin aikaa ja laskentaa voidaan säästää helpoissa tehtävissä tai lisätä vaativissa ongelmissa.

Tällä on myös käytännön kääntöpuoli. Syvempi päättely kuluttaa enemmän tokeneita ja voi pidentää vastausaikaa, joten suurin asetus ei automaattisesti ole järkevin valinta jokaiseen sähköpostiin, tiivistelmään tai yksinkertaiseen koodimuutokseen.

Fable 5:tä kevyemmät turvarajat

TechCrunch nostaa mallin tärkeäksi eduksi sen, että Opus 5 kohtaa selvästi vähemmän turvallisuusluokittimien rajoituksia kuin Fable 5. Anthropic arvioi suojausten puuttuvan Opus 5:n pyyntöihin noin 85 prosenttia harvemmin.

Opus 5 saa etsiä haavoittuvuuksia lähdekoodista, mikä mahdollistaa monenlaisen puolustavan tietoturvatyön. Mallilta on kuitenkin estetty muun muassa ohjelmistojen binaaritiedostoihin kohdistuva haavoittuvuusskannaus, tunkeutumistestaus ja hyväksikäyttökoodien tuottaminen.

Rajoituksen taustalla on käyttötarkoitusten erilainen riskitaso. Lähdekoodin tarkastaminen voi auttaa ohjelmistokehittäjää löytämään ja korjaamaan virheen, kun taas valmiin ohjelman tutkiminen ja toimivan hyökkäyksen rakentaminen voi helpommin palvella vahingollista käyttöä.

Anthropic tuo rajapintaan samalla automaattiset varamallit. Jos Opus 5:n turvallisuusluokitin pysäyttää pyynnön, järjestelmä voi ohjata sen toiseen sallittuun malliin sen sijaan, että koko tehtävä päättyisi virheilmoitukseen. Ominaisuus julkaistaan aluksi beetaversiona.

Claude-palvelussa, Claude Codessa ja Claude Coworkissa estetty pyyntö voidaan ohjata oletuksena Opus 4.8:lle. Rajapinnan käyttäjät voivat puolestaan ottaa vastaavan varamallitoiminnon käyttöön omissa sovelluksissaan.

Tietojen säilytys erottaa mallin Fablesta

Opus 5:n yleiseen käyttöön ei liity Fable 5:n ja Mythos 5:n kaltaista 30 päivän tietojen säilytysvaatimusta. Ero voi olla ratkaiseva yrityksille ja yksityisyyttä painottaville käyttäjille, jotka käsittelevät luottamuksellista aineistoa ja joutuvat arvioimaan palvelun tietosuojavaatimuksia tarkasti.

Tämä ei tarkoita, että kaiken arkaluonteisen aineiston voisi siirtää tekoälypalveluun ilman harkintaa. Käyttäjän on edelleen tarkistettava oman tilauksensa, organisaationsa ja käyttämänsä pilvialustan ehdot sekä varmistettava, millaista tietoa palveluun saa syöttää.

Opus 5 voi olla useimmille järkevämpi huippumalli

Anthropicin omissa testeissä Opus 5 nousi kärkeen muun muassa ohjelmointia, toimistoautomaatiota ja tietokoneen käyttöä mittaavissa tehtävissä. Yhtiö kertoo mallin saaneen ARC-AGI 3 -testissä kolminkertaisen tuloksen seuraavaksi parhaaseen malliin verrattuna ja ohittaneen Fable 5:n OSWorld 2.0 -testissä hieman yli kolmasosalla sen kustannuksista.

Vertailutuloksia kannattaa silti lukea tehtäväkohtaisina mittareina, ei yhtenä lopullisena älykkyysjärjestyksenä. Malli voi olla yhdessä testissä ylivoimainen ja toisessa heikompi, minkä lisäksi todellisen työn onnistumiseen vaikuttavat annetut ohjeet, työkalut, aineisto ja tehtävän arviointitapa.

Opus 5 ei myöskään korvaa Anthropicin kaikkein kyvykkäimpiä malleja kaikissa käyttötarkoituksissa. Fable 5 tarjoaa edelleen korkeamman suorituskyvyn osassa vaativimmista tehtävistä, ja rajatusti saatavilla oleva Mythos 5 on Opus 5:tä vahvempi esimerkiksi hyökkäävän kyberturvallisuuden arvioinneissa.

Uutuuden merkitys onkin ennen kaikkea tasapainossa. Opus 5 yhdistää vahvan päättelyn, pitkät työtehtävät, laajan kontekstin, Fablea kevyemmät rajoitukset ja puolet alemman hinnan. Jos malli osoittautuu todellisessa käytössä yhtä vakaaksi kuin julkaisutestit lupaavat, siitä voi tulla Anthropicin tärkein yleiskäyttöinen huippumalli sekä ohjelmistokehittäjille että vaativaa tietotyötä tekeville.

Jaa artikkeli
WhatsApp
Myös Snapchatissa