Mallin nimi ei riitä ostopäätökseen.
Artificial Analysisin uusi mittaus vertasi API-palveluntarjoajia keskenään: samalla avoimella mallilla työkalukutsujen tarkkuus vaihteli tarjoajasta riippuen 22 ja 37 prosentin välillä. Samalla viikolla Anthropic jäädytti Sonnet 5:n käynnistyshinnan pysyväksi ja GitHub antoi yrityksille asetuksen, jolla MCP-palvelimet sallitaan tai estetään keskitetysti.
Viikon kärjet
- Testaa oma käyttötapauksesi sillä API-toimittajalla, jonka aiot ostaa. Yksi mittaus ei ratkaise valintaa puolestasi, mutta se osoittaa, että saman mallin tulos riippuu myös tarjoajasta.
- Claude Sonnet 5 maksaa pysyvästi 2 dollaria miljoonalta syötetokenilta ja 10 dollaria tuotostokenilta. Jos kustannusarviosi sisälsi syyskuulle kaavaillun korotuksen, poista se laskelmasta.
- Jos tiimisi ottaa MCP-palvelimia käyttöön, päätä sallittujen lista ennen käyttöönottoa. GitHubin uusi asetus estää hallitsemattoman palvelimen vain, jos se on otettu käyttöön.
Viikon nostot
- Sama malli, eri toimittaja, eri tarkkuus Artificial Analysis julkaisi 4.8.2026 Endpoint Accuracy Indexin, joka mittaa kuinka suuren osan avoimen mallin tarkkuudesta kukin API-palveluntarjoaja säilyttää itse ajettuun vertailuversioon nähden. Mallilla gpt-oss-120b työkalukutsujen tarkkuus vaihteli tarjoajittain 22 prosentista 37 prosenttiin. Joillakin tarjoajilla vastausten pituus jäi noin puoleen vertailuversiosta; mittaus ei kerro, mistä ero johtui. Testissä oli 500 työkalukutsukysymystä, 250 päättelykysymystä ja 25 pitkän kontekstin kysymystä.
- Claude Sonnet 5:n käynnistyshinta jäi pysyväksi Anthropic päivitti 10.8.2026 Claude Sonnet 5:n julkaisu-uutisen: käynnistyshinta 2 dollaria miljoonalta syötetokenilta ja 10 dollaria miljoonalta tuotostokenilta on nyt pysyvä. Aiemmin 1.9.2026 kaavailtu korotus tasolle 3 ja 15 dollaria ei toteudu.
- MCP-palvelimet voi nyt sallia tai estää koko organisaatiolle GitHub toi 6.8.2026 yleiseen saatavuuteen asetukset, joilla GitHub Enterprise -ympäristön pääkäyttäjä sallii tai estää MCP-palvelimet keskitetysti asetustiedostossa. Sama lista pätee Copilot-sovelluksessa, komentorivillä ja VS Codessa. Palvelin tunnistetaan etäosoitteen, paikallisen komennon tai nimen perusteella, ja virheellinen määritys estää palvelimen käytön.
- Mistralilta avoin sisällönsuodatin yhdelle näytönohjaimelle Mistral julkaisi 4.8.2026 Shieldstralin: 3 miljardin parametrin sisällönsuodatinmallin Apache 2.0 -lisenssillä. Malli arvioi sekä tekstiä että kuvia, ja moderointisäännöt annetaan sille luonnollisella kielellä ajon aikana ilman uudelleenkoulutusta. Se ajaa yhdellä 16 gigatavun näytönohjaimella. Mistralin mukaan malli vastaa tai päihittää jopa 7 kertaa suurempia avoimia suodatinmalleja, mutta yhtiö julkaisi vertailukaaviot ilman pistelukuja.
- Sentry seurasi agenttityönkulkunsa tunnuslukuja Sentry kertoi 6.8.2026 työnkulusta, jota se on ajanut heinäkuun puolivälistä: Seer-agentti avaa korjausehdotukset muutospyyntöinä, ja tunnin välein ajettava toiminto etsii sopivan katselmoijan muutoshistoriasta ja merkitsee hänet Slackissa. Yhtiön mukaan muutospyyntöjen käsittelyaste nousi 21 prosenttia, vastausaste 48 tunnin sisällä 13 prosenttia ja ilman yhdistämistä suljettujen osuus 12,5 prosenttia. Viimeistä Sentry pitää onnistumisena, koska päällekkäiset korjaukset karsiutuvat.