iFLYTEKs datterselskap Ciyuan Xinghuo åpnet 1. september 2026 Spark X2.5 4B og X2.5 1.7B, to kompakte modeller for lokal kjøring med påstått kontekstvindu på opptil én million token.
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did iFLYTEK’s wholly owned subsidiary launch and open-source on September 1, 2026 with Spark X2.5-4B and Spark X2.5-1.7B—including thei. Article summary: On September 1, 2026, iFLYTEK’s wholly owned subsidiary Ciyuan Xinghuo launched and open-sourced the edge-deployable Spark/Xinghuo X2.5-4B and X2.5-1.7B models. The company claims they are the first edge models with a na. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
iFLYTEKs heleide datterselskap Ciyuan Xinghuo lanserte og åpnet 1. september 2026 to språkmodeller for lokal og såkalt «edge»-kjøring: Spark (Xinghuo) X2.5-4B og Spark X2.5-1.7B. Den mest oppsiktsvekkende spesifikasjonen er et naturlig kontekstvindu på opptil én million token på lokale enheter. iFLYTEK omtaler dem som de første edge-modellene i denne kategorien med slik støtte, men dette er selskapets egen påstand og ikke et uavhengig verifisert resultat. 2
Modellene har henholdsvis 4 og 1,7 milliarder parametere og bruker en hybrid oppmerksomhetsarkitektur. iFLYTEK oppgir at de er optimalisert for KI-agenter og verktøybruk, programmering, matematisk resonnering og instruksjonsfølging. Selskapet hevder også sterk ytelse mot åpne modeller i tilsvarende størrelse, uten å legge frem uavhengige sammenligninger i lanseringsmaterialet. 2
Målgruppen er lokale miljøer som smarte enheter, biler, roboter og tingenes internett (IoT) – situasjoner der skytilkobling, forsinkelse eller håndtering av data kan være begrensninger. 3
Det sentrale løftet er å redusere behovet for å dele opp store dokumenter i små biter, ofte kalt chunking. Det er en vanlig tilnærming ved søk i dokumentarkiver, men kan føre til at en regel, et unntak eller en teknisk avhengighet i en annen del av materialet faller utenfor modellens arbeidskontekst.
iFLYTEK bruker en kundeservice- eller ettermarkedsmanual som eksempel. Dersom hele manualen ligger i konteksten, kan modellen i teorien vurdere regler om retur, feilbehandling, unntak, logistikk, sletting av data og kostnadsansvar på tvers av kapitler. Selskapet presenterer dette som et alternativ til å miste sammenhengen når dokumentet behandles som isolerte tekstutdrag. 2
Et stort kontekstvindu er imidlertid ikke i seg selv dokumentasjon på at modellen resonerer korrekt eller gir faktamessig riktige svar. Virksomheter som vurderer modellene, må fortsatt teste kvaliteten på gjenfinning og svar, responstid, minnebehov og om modellen faktisk anvender de riktige reglene i et helt dokument.
iFLYTEK posisjonerer Spark X2.5 som en lokal produktivitetsassistent, men lanseringsmaterialet beskriver ikke en konkret funksjonsliste for kontorarbeid eller en egen benchmark for kontorautomatisering. 2
For andre bruksområder oppgir selskapet følgende:
Ifølge iFLYTEK ble begge modellene trent utelukkende på innenlandske dataplattformer. Treningsgrunnlaget skal ha omfattet rundt 20 billioner token med variert forhåndstreningsdata, etterfulgt av supervisert finjustering og forsterkningslæring. 2
Den oppgitte kompatibilitetslisten omfatter maskinvare fra NVIDIA, Huawei, Hygon og Hemo. På programvaresiden nevnes inferensrammeverkene vLLM, SGLang og llama.cpp, samt utrulling via Ollama og LM Studio. LLaMA-Factory er oppgitt for inkrementell finjustering. 2
Reell hastighet og minnebruk vil likevel avhenge av hvilken modell som velges, kvantisering, faktisk kontekstlengde og maskinvaren den kjøres på.
iFLYTEK opplyste at modellvekter, kildekodelagre og dokumentasjon for utrulling ble frigitt, med tilgjengelighet via Hugging Face og GitHub. Selskapet varslet også tilknyttede API-er på Starry MaaS-plattformen med gratis tilgang i en begrenset periode. Verken sluttdato eller kvote ble oppgitt, så utviklere bør kontrollere gjeldende vilkår før de planlegger rundt tilbudet. 2
6
Det som skiller Spark X2.5 fra mange andre små, åpne modeller, er kombinasjonen av 1,7B- og 4B-størrelse med et leverandørpåstått, naturlig kontekstvindu på én million token. Dersom egenskapen holder i reelle utrullinger, kan den være interessant for privat, lokal analyse av komplette manualer, tekniske arkiver og kodebaser der sammenheng på tvers av dokumenter er viktig.
Neste steg er praktisk evaluering på egne arbeidsoppgaver og den konkrete maskinvaren modellen skal kjøre på – særlig for lange kontekster, der ytelse, minnebruk og svarpresisjon må veies opp mot hverandre.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
iFLYTEKs datterselskap Ciyuan Xinghuo åpnet 1. september 2026 Spark X2.5 4B og X2.5 1.7B, to kompakte modeller for lokal kjøring med påstått kontekstvindu på opptil én million token.
iFLYTEKs datterselskap Ciyuan Xinghuo åpnet 1. september 2026 Spark X2.5 4B og X2.5 1.7B, to kompakte modeller for lokal kjøring med påstått kontekstvindu på opptil én million token. Modellene er bygget med hybrid oppmerksomhetsarkitektur og er rettet mot agentoppgaver, programmering, matematikk, instruksjonsfølging og resonnering over lange dokumenter.
Vekter, kode og utrullingsdokumentasjon skal være publisert på Hugging Face og GitHub.