1 вересня 2026 року дочірня компанія iFLYTEK Ciyuan Xinghuo відкрила моделі Spark X2.5 4B та Spark X2.5 1.7B для крайових і локальних пристроїв. Компанія заявляє про нативне контекстне вікно до 1 млн токенів — це може дозволити аналізувати цілі посібники чи кодові бази без поділу на багато фрагментів.
ОпублікувавВідредаговано за допомогою GPT-5.6 TerraЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did iFLYTEK’s wholly owned subsidiary launch and open-source on September 1, 2026 with Spark X2.5-4B and Spark X2.5-1.7B—including thei. Article summary: On September 1, 2026, iFLYTEK’s wholly owned subsidiary Ciyuan Xinghuo launched and open-sourced the edge-deployable Spark/Xinghuo X2.5-4B and X2.5-1.7B models. The company claims they are the first edge models with a na. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
1 вересня 2026 року дочірня компанія iFLYTEK — Ciyuan Xinghuo — представила та відкрила дві мовні моделі для крайових пристроїв: Spark (Xinghuo) X2.5-4B і Spark X2.5-1.7B. Їхня головна заявлена характеристика — нативне контекстне вікно до 1 млн токенів для локального запуску. iFLYTEK називає їх першими edge-моделями у своєму класі з такою можливістю, однак це твердження компанії, а не незалежно підтверджений результат. 2
Моделі з 4 млрд і 1,7 млрд параметрів побудовані на архітектурі гібридної уваги. Їх оптимізували для роботи з агентами та інструментами, програмування, математичних міркувань і виконання інструкцій. iFLYTEK також заявляє про сильні результати порівняно з відкритими моделями подібного розміру, але в анонсі не наведено незалежного порівняльного тестування. 2
Цільові сценарії — локальні та крайові системи: розумне обладнання, автомобільні системи, роботи та пристрої інтернету речей. У таких випадках підключення до хмари може бути небажаним через затримки, вимоги до конфіденційності або нестабільний зв’язок. 3
Під час роботи з великими документами зазвичай застосовують поділ на фрагменти: інструкцію, архів політик або кодову базу розбивають на невеликі частини й дістають потрібні уривки за запитом. Це практичний підхід, але він може пропустити важливий виняток, правило чи залежність з іншого розділу.
Як приклад iFLYTEK наводить інструкцію з післяпродажного обслуговування. Якщо весь документ доступний моделі одночасно, вона може зіставляти правила повернення, обробки несправностей, винятки, логістику, стирання даних і розподіл витрат. Компанія подає це як спосіб не втрачати зв’язки між розділами, які можуть зникати під час ізольованої роботи з фрагментами. 2
Водночас велике контекстне вікно саме по собі не гарантує ані коректних міркувань, ані фактичної точності. Перед практичним впровадженням варто перевірити якість пошуку й відповідей на довгих матеріалах, затримки, потреби в пам’яті та здатність моделі правильно застосовувати правила по всьому документу.
iFLYTEK позиціонує Spark X2.5 як інструмент для локальної продуктивності, але не опублікувала докладного списку офісних функцій чи окремого бенчмарку для офісної автоматизації. 2
Для інших сценаріїв компанія наводить такі заяви:
За даними iFLYTEK, обидві моделі повністю навчалися на вітчизняних обчислювальних платформах. Для переднавчання використали приблизно 20 трлн токенів різнорідних даних, після чого застосували навчання з учителем і навчання з підкріпленням. 2
У заявленому переліку сумісності є апаратні платформи NVIDIA, Huawei, Hygon і Hemo; рушії інференсу vLLM, SGLang та llama.cpp; варіанти розгортання через Ollama й LM Studio; а також LLaMA-Factory для донавчання. Реальна швидкість і вимоги до пам’яті залежатимуть від обраної моделі, квантизації, довжини контексту та конкретного обладнання. 2
iFLYTEK повідомила про публікацію ваг моделей, вихідних репозиторіїв і документації для розгортання. Вказано доступність через Hugging Face та GitHub. Також анонсовано API на платформі Starry MaaS з безкоштовним доступом протягом обмеженого часу. Дату завершення пропозиції та ліміти компанія не уточнила, тому розробникам варто перевіряти актуальні умови перед плануванням інтеграції. 2
6
Ключова відмінність Spark X2.5 — не лише відкритість чи відносно компактний розмір, а поєднання моделей на 1,7 млрд і 4 млрд параметрів із заявленим нативним контекстом до мільйона токенів. Якщо ця можливість підтвердиться у реальних розгортаннях, моделі можуть бути корисними для приватного локального аналізу великих інструкцій, технічних архівів і кодових баз, де важливі зв’язки між віддаленими частинами матеріалу.
Наступний крок для потенційних користувачів — практичне тестування на власних довгих документах і саме на тому обладнанні, де моделі планується запускати.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
1 вересня 2026 року дочірня компанія iFLYTEK Ciyuan Xinghuo відкрила моделі Spark X2.5 4B та Spark X2.5 1.7B для крайових і локальних пристроїв.
1 вересня 2026 року дочірня компанія iFLYTEK Ciyuan Xinghuo відкрила моделі Spark X2.5 4B та Spark X2.5 1.7B для крайових і локальних пристроїв. Компанія заявляє про нативне контекстне вікно до 1 млн токенів — це може дозволити аналізувати цілі посібники чи кодові бази без поділу на багато фрагментів.
Ваги моделей, репозиторії та документацію оприлюднено; заявлено підтримку vLLM, SGLang, llama.cpp, Ollama і LM Studio, а також тимчасово безкоштовний доступ до API.