Muse Spark 1.3 keskittyy koodaukseen ja tekoälyagentteihin. Metan mukaan se käyttää noin 25 prosenttia vähemmän tokeneita kuin edeltäjänsä.
Research answer

Create a landscape editorial hero image for this Studio Global article: What AI products did Meta release this week, what capabilities, pricing, availability, and performance claims distinguish Muse Spark 1.3 and. Article summary: Meta released two AI products this week: Muse Spark 1.3, an update to its general reasoning model focused on coding and agents, and Muse Voice Transcribe, a hosted real-time speech-recognition model. Together they show M. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Metan syyskuun 2026 uutuudet osuvat tekoälyn kahteen eri kerrokseen. Muse Spark 1.3 on päivitys koodaukseen ja monivaiheisiin agenttitehtäviin, kun taas Muse Voice Transcribe on kehittäjille suunnattu reaaliaikainen äänimalli.
Yhdessä ne muodostavat kiinnostavamman kokonaisuuden kuin kumpikaan julkaisu yksinään: Meta tavoittelee järjestelmiä, jotka eivät vain vastaa yksittäiseen keskustelupyyntöön, vaan pystyvät työskentelemään jatkuvasti tekstin, koodin ja puheen parissa.
Metan mukaan Muse Spark 1.3:n tärkeimmät parannukset liittyvät koodaukseen ja niin sanottuun agenttimaiseen työskentelyyn. Yhtiö kertoo mallin suoriutuvan näistä tehtävistä aiempaa paremmin ja käyttävän samalla noin 25 prosenttia vähemmän tokeneita kuin edeltäjänsä. 11
Tokeneiden pienempi kulutus on merkittävä etu erityisesti tehtävissä, joissa malli joutuu päättelyketjussa tarkistamaan tiedostoja, kutsumaan työkaluja tai korjaamaan omaa tuotostaan useita kertoja. Pienempi tokenimäärä voi laskea pitkään jatkuvien tehtävien kustannuksia, mutta toimitetut lähteet eivät vahvista Metan omia koodaus- tai agenttivertailuja riippumattomasti.
Spark 1.3:n käyttöönotto etenee Muse Codessa ja Meta Model API:ssa, kertoo julkaisuja koskeva raportointi. 12 Mallin kerrotaan säilyttävän edellisen version hinnoittelun ja olevan saatavilla contributor-tason käyttäjille. Toimitettu aineisto ei kuitenkaan kerro tarkkaa hintaa tai yksityiskohtaista aikataulua eri käyttäjäryhmille.
Metan laajempi tavoite on tehdä Sparkista perusta henkilökohtaisille agenteille, jotka voivat työskennellä jatkuvasti eivätkä vain vastata irrallisiin kehotteisiin. Tämä vie Metan samaan kilpailukenttään Googlen, Anthropicin ja OpenAI:n koodausagenttien sekä yritysten työnkulkujärjestelmien kanssa. Saatavilla oleva näyttö tukee kuitenkin selvemmin Metan ilmoittamaa suuntaa kuin väitettä siitä, että Spark 1.3 olisi jo päihittänyt kilpailijansa.
Muse Voice Transcribe on Meta Superintelligence Labsin ensimmäinen reaaliaikainen äänen havainnointiin tarkoitettu malli. Se niputtaa yhteen kolme toimintoa, jotka on usein toteutettu erillisinä käsittelyvaiheina:
Meta kuvaa mallia monikieliseksi ja kertoo sen tukevan myös kielen vaihtumista kesken keskustelun. Raportoinnin mukaan mallia on koulutettu yli 70 kielellä, joista 25 on validoitu alkuvaiheen julkaisua varten. 1
2
Voice Transcribe on saatavilla Meta Model API:n kautta, ja sitä käytetään myös Metan työpöytäohjelmiston äänitoiminnoissa sekä Muse Codessa. 3
7
10 Malli ei ole avoimilla painoilla julkaistu ratkaisu, vaan Metan isännöimä API-palvelu: yhtiö ei luovuta mallin painoja.
9
Raportoitu API-hinta on 3 dollaria tuhatta ääniminuuttia kohden, mikä vastaa 0,18 dollaria tunnilta. 6
9 Hinta voi tehdä Voice Transcribesta houkuttelevan esimerkiksi saneluun, kokousten litterointiin, puhekäyttöliittymiin ja monikieliseen äänidatan käsittelyyn.
Toimitetussa raportoinnissa viitatulla Artificial Analysisin englanninkielisellä suoratoistopuheen testillä Voice Transcriben sanavirheprosentiksi ilmoitettiin noin 3,1 prosenttia. Vertailussa Cartesia Ink-2:n tulos oli 3,4 prosenttia, ElevenLabs Scribe v2 Real-timen 3,6 prosenttia, OpenAI GPT Live Transcriben 3,9 prosenttia ja Gemini 3.5 Transcribe Liven 4,0 prosenttia. 9
Tuloksia on syytä tulkita yhden tietyn arvioinnin tuloksina, ei yleispätevänä paremmuusjärjestyksenä. Aksentti, kieli, mikrofoni ja käyttöympäristö voivat muuttaa lopputulosta merkittävästi. Lähteiden mukaan puhujien erottelun virhemäärät ovat edelleen koko alalla haastavia, vaikka malli pärjäisi hyvin yksittäisissä testeissä. 9
Teknisesti merkittävin ero on arkkitehtuurissa: Meta tarjoaa litteroinnin, puhujien erottelun ja puheenvuoron tunnistamisen yhtenä reaaliaikaisena mallikutsuna. Tämä voi yksinkertaistaa sovellusten rakentamista verrattuna erillisten puhepalveluiden yhdistämiseen. Kehittäjien on silti arvioitava käytännössä viive, toimintavarmuus, yksityisyydensuoja ja tuotantokäytön rajoitukset.
Julkaisut tulevat aikaan, jolloin suuret tekoäly-yhtiöt kilpailevat sekä agenttien kyvykkyydellä että niiden käyttöönottoa tukevalla infrastruktuurilla.
Metan erottava tekijä ei siis ole se, että yhtiö olisi keksinyt agentit tai puhe-API:t. Sen omaleimaisempi veto on yhdistää useita jakelukanavia: Muse Code kehittäjille, Meta Model API sovelluksille, työpöytä- ja kuluttajatuotteet käyttöön sekä myöhemmin mahdollisesti laitteet jatkuvaan äänivuorovaikutukseen.
Meta on sopinut maksavansa seuraavan vuosikymmenen aikana enintään 18 miljardia dollaria ja ottavansa käyttöön tiukempia rajoituksia ja turvallisuustoimia teini-ikäisille Facebookissa ja Instagramissa. Sovinto koskee 48 osavaltiota ja Yhdysvaltojen territoriota, jotka esittivät yhtiötä vastaan lasten turvallisuuteen liittyviä vaatimuksia. Kokonaissumma sisältää maksuja, jotka riippuvat osittain kilpailevien alustojen vastaavista sitoumuksista. 17
18
19
20
22
25
Sovinto ei sellaisenaan tarkoita, että Meta lopettaisi tekoälytuotteiden julkaisemisen. Maksut jakautuvat pitkälle ajalle, mutta sopimus tuo yhtiölle uusia taloudellisia, vaatimustenmukaisuuteen liittyviä ja tuotehallinnollisia velvoitteita. Reutersin mukaan Meta suunnittelee lisäksi jopa noin 145 miljardin dollarin pääomainvestointeja vuodelle 2026, suurelta osin tekoälyinfrastruktuuriin liittyen. 27
29
Tuotteiden kannalta selkein vaikutus voi näkyä kuluttajille suunnatuissa järjestelmissä – etenkin jatkuvasti toimivissa, ääneen perustuvissa tai nuorten käytettävissä olevissa agenteissa. Ikävarmennus, vanhempien hallintatyökalut, käyttörajat, lokitus ja turvallisuustestaus voivat saada aiempaa suuremman roolin julkaisuissa.
API-pohjainen transkriptiomalli on teini-ikäisiä koskevien rajoitusten kannalta vähemmän suoraan altis, mutta sekin kuuluu Metan laajempaan luottamuksen, yksityisyyden ja hallinnon kokonaisuuteen.
Muse Spark 1.3 ja Muse Voice Transcribe muodostavat strategisesti johdonmukaisen parin. Ensimmäinen vahvistaa päättely- ja koodauskerrosta, toinen tarjoaa reaaliaikaisen äänisyötteen, jota puhesovellukset ja jatkuvasti toimivat agentit tarvitsevat.
Vahvat julkaisulupaukset eivät kuitenkaan vielä tarkoita pysyvää käyttöä. Metan on osoitettava, että kehittäjät luottavat Sparkiin pitkään jatkuvissa työtehtävissä, että Voice Transcribe toimii otsikkotulosten ulkopuolella ja että tuotteet tuottavat riittävästi käyttöä tai strategista arvoa perustellakseen yhtiön mittavat infrastruktuuri- ja turvallisuussitoumukset.
Sovinto poistaa yhden oikeudellisen epävarmuuden, mutta samalla se nostaa heikon priorisoinnin hintaa. Toistaiseksi julkaisut kertovat Metan laajentavan tekoälyalustaansa kahteen suuntaan: kohti agentteja, jotka pystyvät toimimaan, ja käyttöliittymiä, jotka pystyvät kuuntelemaan jatkuvasti.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Muse Spark 1.3 keskittyy koodaukseen ja tekoälyagentteihin. Metan mukaan se käyttää noin 25 prosenttia vähemmän tokeneita kuin edeltäjänsä.
Muse Spark 1.3 keskittyy koodaukseen ja tekoälyagentteihin. Metan mukaan se käyttää noin 25 prosenttia vähemmän tokeneita kuin edeltäjänsä. Muse Voice Transcribe litteroi puhetta suoratoistona, erottaa yli 20 puhujaa ja tunnistaa, milloin puheenvuoro päättyy – kaikki yhdessä reaaliaikaisessa mallikutsussa.
Voice Transcribe maksaa Meta Model API:ssa 3 dollaria tuhatta ääniminuuttia kohden eli 0,18 dollaria tunnilta.