Mies käyttää tekoälyä.
Findance.com


viihde /

OpenAI kiihdyttää GPT-5.6 Solin jopa 14-kertaiseen nopeuteen – Ultrafast ei vielä tule kaikille

OpenAI on esitellyt Ultrafast-tilan, joka voi tuottaa GPT-5.6 Sol -mallilla jopa 750 tulostokenia sekunnissa. Kyse ei ole uudesta tekoälymallista tai kaikkien ChatGPT-käyttäjien asetuksesta, vaan rajattuna esikatseluna käynnistyvästä OpenAI APIn palvelutasosta.

OpenAI yrittää poistaa yhden kehittyneiden tekoälymallien näkyvimmistä pullonkauloista: odottamisen. Uusi Ultrafast-palvelutaso ajaa yhtiön GPT-5.6 Sol -mallia parhaimmillaan 14 kertaa tavallista käsittelyä nopeammin.

TechCrunchin mukaan järjestelmä voi tuottaa jopa 750 tulostokenia sekunnissa. OpenAI käynnistää Ultrafastin ensin rajatulle joukolle API-asiakkaita ja aikoo laajentaa saatavuutta kapasiteetin kasvaessa.

Kyse ei ole kokonaan uudesta mallista, vaan nopeammasta tavasta suorittaa samaa GPT-5.6 Solia. OpenAI kutsuu Ultrafastia palvelutasoksi, joka on tarkoitettu tilanteisiin, joissa vastauksen viiveellä on poikkeuksellisen suuri merkitys.

Mitä 750 tokenia sekunnissa tarkoittaa?

Kielimalli ei tuota tekstiä suoraan sanoina tai kirjaimina, vaan tokeneina. Token voi olla kokonainen lyhyt sana, sanan osa, välimerkki tai muu tekstin pala, joten 750 tokenia ei vastaa täsmälleen 750 sanaa.

Ilmoitettu nopeus tarkoittaa enimmillään noin 750 uuden tulostokenin muodostamista sekunnissa. Todellinen käyttökokemus riippuu kuitenkin myös pyynnön käsittelystä, verkkoviiveestä, käytetyistä työkaluista ja tehtävän rakenteesta.

Myös 14-kertainen nopeus on enimmäisluku suhteessa OpenAI:n tavalliseen käsittelyyn. Kaikki tehtävät eivät nopeudu samassa suhteessa, eikä nopeampi tekstin muodostus automaattisesti lyhennä jokaista monivaiheista työprosessia neljästoistaosaan.

Tekstin virtaamisnopeus on silti huomattava. Kun malli pystyy vastaamaan lähes reaaliajassa, samaa teknologiaa voidaan käyttää vuorovaikutteisissa tilanteissa, joissa pitkä odotus katkaisisi keskustelun tai hidastaisi päätöksentekoa.

Nopeus ilman pienempään malliin vaihtamista

OpenAI:n mukaan reaaliaikainen nopeus on aiemmin usein vaatinut pienemmän tai johonkin tehtävään erikoistuneen mallin valitsemista. Ultrafastin tavoitteena on yhdistää GPT-5.6 Solin vahva suorituskyky erittäin nopeaan tulostukseen.

Yhtiö tiivistää tavoitteen ajatukseen suuremmasta määrästä hyödyllistä työtä sekunnissa. Käytännössä nopeus ei siis ole vain mukavuusominaisuus, vaan se voi muuttaa sitä, millaisiin tehtäviin kehittynyttä mallia kannattaa käyttää.

Ultrafast toimii tekoälypiireihin erikoistuneen Cerebrasin laitteistolla. Cerebras on rakentanut erittäin suuria piirejä ja järjestelmiä, joiden vahvuutena on juuri kielimallien suorittaminen pienellä viiveellä.

TechCrunch muistuttaa, että myös kilpailija Anthropic tarjoaa Claude-malleille nopeutettua käsittelyä. OpenAI:n ilmoittama jopa 750 tokenin sekuntinopeus nostaa kilpailun kuitenkin uudelle tasolle kaikkein kyvykkäimpien mallien suorittamisessa.

Ensimmäiset käyttökohteet löytyvät yrityksistä

OpenAI testaa Ultrafastia aluksi yritysten kanssa ohjelmoinnissa, verkkokaupassa, finanssialan tutkimuksessa, asiakastuessa ja muissa vuorovaikutteisissa sovelluksissa. Tavoitteena on selvittää, missä nopeuden kymmenkertainen muutos tuottaa eniten todellista hyötyä.

Yksi esimerkki on häiriötilanteisiin reagoiminen. Malli voi lukea lokitietoja, jäljittää järjestelmän tapahtumia, yhdistää insinöörien viestejä ja auttaa mahdollisen korjauksen valmistelussa samalla, kun vika on vielä käynnissä.

OpenAI korostaa, että vastuu arvioinnista ja korjauksen käyttöönotosta pysyy ihmisillä. Nopeus voi lyhentää havaintojen ja seuraavan tarkistuksen välistä aikaa, mutta se ei poista asiantuntijan tarvetta kriittisissä järjestelmissä.

Asiakaspalvelussa ja puhesovelluksissa lyhyt viive voi tehdä monivaiheisesta selvityksestä luonnollisen osan keskustelua. Malli voi esimerkiksi etsiä tietoja useasta järjestelmästä ilman, että asiakkaan täytyy odottaa pitkää hiljaista jaksoa.

Verkkokaupassa Ultrafast voi tarkistaa saatavuuden, vastata tuotekysymykseen, muodostaa suosituksen tai selvittää kassalla syntyneen ongelman vielä silloin, kun asiakas on tekemässä ostopäätöstä.

Finanssi- ja turvallisuustehtävissä nopeutta voidaan käyttää muuttuvien markkinasignaalien, maksutapahtumien tai epäilyttävän toiminnan analysointiin. Näissä käyttökohteissa myös vastausten tarkistaminen ja järjestelmien käyttöoikeuksien rajaaminen korostuvat.

Yön yli kestävästä tutkimuksesta vuorovaikutteiseen työhön

OpenAI kertoo käyttävänsä Ultrafastia myös omassa tutkimustyössään. Tiedonhaku, datakyselyt sekä useista lähteistä kerätyn aineiston jäsentäminen voidaan tehdä aiempaa tiiviimmässä palautesilmukassa.

Yhtiön kuvaamassa perinteisessä työvaiheessa tutkija käynnistää kokeet illalla ja tarkastelee tuloksia aamulla. Ultrafast voi mahdollistaa useita kokeilu-, arviointi- ja muutoskierroksia saman työpäivän aikana.

Nopeudesta on eniten hyötyä silloin, kun käyttäjä tekee mallin kanssa jatkuvasti pieniä päätöksiä. Jos tehtävä vaatii joka tapauksessa pitkää ulkoista laskentaa, verkkohakuja tai ihmisen hyväksyntää, pelkkä tokenien tuottamisen nopeus ei ratkaise koko viivettä.

Ultrafast ei ole vielä tavallinen ChatGPT-asetus

OpenAI julkaisee Ultrafastin ensin OpenAI APIssa, jonka kautta yritykset ja kehittäjät rakentavat tekoälyä omiin palveluihinsa. Rajattu esikatselu on saatavilla vain valitulle asiakasjoukolle.

Yhtiö ei ole ilmoittanut Ultrafastille julkista hintaa tai täsmällistä aikataulua laajemmalle käyttöönotolle. Se lupaa kasvattaa saatavuutta kapasiteetin lisääntyessä ja kerätä ensin kokemuksia todellisista yrityssovelluksista.

Tämän vuoksi uutinen ei tarkoita, että jokainen ChatGPT-käyttäjä voisi nyt kytkeä vastauksiin 14-kertaisen nopeuden. Teknisesti kiinnostavin muutos on se, että kaikkein kyvykkäimpiä malleja pyritään tuomaan tehtäviin, joissa aikaisemmin vain pienempi malli pystyi vastaamaan riittävän nopeasti.

Jaa artikkeli
WhatsApp
Myös Snapchatissa