xAI julkisti 16. heinäkuuta 2026 uuden Grok 4.5 -kielimallin, joka on asemoitu suoraan ohjelmistokehityksen, tekoälyagenttien vaatimien tehtävien ja vaativan insinöörityön ytimeen. xAI kertoo kouluttaneensa mallia yhteistyössä Cursorin kanssa, mikä tuo sen suoraan tunnettuun koodieditoriin.
Suorituskyky ja nopeus koodauksessa
Grok 4.5:n arkkitehtuurin suunnittelussa on painotettu erityisesti käytännön ohjelmointitehtäviä ja koodikantojen ymmärtämistä. Yhtiö raportoi mallin saavuttaneen 29,0 prosentin tuloksen vaativassa SWE Marathon -testissä. SWE Bench Pro -vertailussa tulos on 64,7 prosentin tulos SWE Bench Pro -vertailussa, joka mittaa tekoälymallin kykyä ratkaista ohjelmistokehitystehtävien ratkaisemista. Terminal Bench 2.1 -mittauksessa, joka arvioi mallin kykyä toimia komentoriviympäristöissä, tulos oli 83,3 prosenttia. Vaikka esitetyt luvut ovat vahvoja ja osoittavat xAI:n teknologista kehitystä, Grok 4.5 ei johda jokaista alan vertailutaulukkoa; tietyt kilpailevat mallit pitävät edelleen kärkipaikkaa useissa synteettisissä ja käytännön testeissä.
Raakaan suorituskyvyn lisäksi mallin keskeisiin ominaisuuksiin kuuluu palvelunopeus. xAI kertoo mallin pystyvän tuottamaan jopa 80 tokenia sekunnissa. Pieni viive helpottaa interaktiivista koodausta ja useita vaiheita sisältäviä agenttitehtäviä.
Hinnoittelu ja saatavuus
Grok 4.5:n API-hinta on: 2 dollaria miljoonaa syötetokenia (input) ja 6 dollaria miljoonaa tulostetokenia (output) kohden. Kokonaiskustannukseen vaikuttaa kuitenkin se, kuinka monta tokenia ja työkalukutsua tehtävä vaatii.
Malli on välittömästi saatavilla Grok Build -ympäristössä, osana Cursor-editorin maksullisia tilauksia sekä suoraan xAI:n oman ohjelmointirajapinnan (API) ja kehittäjäkonsolin kautta. Houkutellakseen uusia käyttäjiä yhtiö tarjoaa myös rajoitetun ajan ilmaista käyttöä sekä Grok Buildissa että Cursor-integraation kautta.
Rajoitteet ja todellinen käyttö
Cursor-integraatio antaa kehittäjille mahdollisuuden arvioida mallia omassa editorityössään.
On kuitenkin huomioitava, että esitetyt vertailutulokset perustuvat täysin toimittajan omaan raportointiin. Todelliset tulokset oikeissa, usein kaoottisissa ohjelmistoprojekteissa voivat vaihdella merkittävästi. Mallin todellinen kyky ymmärtää laajoja, monimutkaisia, historiallista painolastia sisältäviä ja huonosti dokumentoituja koodikantoja selviää vasta laajemman tuotantokäytön myötä.
Lisäksi ilmoitettu API-hinta kattaa vain itse kielimallin käytön. Autonomisten tekoälyagenttien rakentaminen vaatii usein taustainfrastruktuuria, tietokantoja ja muiden työkalujen jatkuvaa käyttöä, mikä nostaa järjestelmän kokonaiskustannuksia. Myös tarjotun ilmaisen kokeilujakson tarkkaa päättymispäivää ei ole virallisessa tiedotteessa määritelty, mikä vaikeuttaa pitkäjänteistä suunnittelua.



