1 сентября 2026 года дочерняя компания iFLYTEK Ciyuan Xinghuo открыла модели Spark X2.5 4B и X2.5 1.7B — компактные модели для периферийных устройств с заявленным нативным контекстом до 1 млн токенов. Модели используют гибридную архитектуру внимания и ориентированы на агентов, код, математику, выполнение инструкций...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did iFLYTEK’s wholly owned subsidiary launch and open-source on September 1, 2026 with Spark X2.5-4B and Spark X2.5-1.7B—including thei. Article summary: On September 1, 2026, iFLYTEK’s wholly owned subsidiary Ciyuan Xinghuo launched and open-sourced the edge-deployable Spark/Xinghuo X2.5-4B and X2.5-1.7B models. The company claims they are the first edge models with a na. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
1 сентября 2026 года полностью принадлежащая iFLYTEK дочерняя компания Ciyuan Xinghuo выпустила в открытый доступ две модели для периферийных устройств: Spark (Xinghuo) X2.5-4B и Spark X2.5-1.7B. Их ключевая заявленная особенность — нативное контекстное окно до 1 млн токенов при локальном запуске. Компания называет их первыми edge-моделями такого класса с этой возможностью, однако это утверждение производителя, а не независимо подтверждённый результат. 2
Модели содержат соответственно 4 млрд и 1,7 млрд параметров. Они построены на гибридной архитектуре внимания и оптимизированы для агентных сценариев и вызова инструментов, программирования, математических задач и следования инструкциям. iFLYTEK также заявляет высокие результаты относительно открытых моделей сопоставимого размера, но независимых сравнительных тестов в анонсе не приводится. 2
Целевые сценарии — локальные и периферийные системы: умные устройства, автомобильная электроника, роботы и устройства интернета вещей. В таких случаях облачное подключение может быть нежелательным из-за задержек, ограничений сети или требований к обработке данных. 3
При работе с большим руководством, архивом нормативных документов или репозиторием кода обычно применяют чанкинг: материал разбивают на небольшие фрагменты, а затем по запросу подбирают нужные. Это практичный подход, но он может не учесть правило, исключение или зависимость, которые находятся в другом разделе.
iFLYTEK иллюстрирует задачу руководством по послепродажному обслуживанию. Если весь документ доступен модели одновременно, она теоретически может сопоставить условия возврата, порядок обработки неисправностей, исключения, логистику, удаление данных и распределение расходов. Компания противопоставляет такой подход ситуации, когда при изолированной обработке фрагментов теряется связь между главами. 2
При этом большое окно контекста само по себе не означает, что модель безошибочно рассуждает или выдаёт фактически верные ответы. Перед внедрением стоит проверить качество поиска и интерпретации правил, задержку, требования к памяти и способность модели последовательно применять условия по всему документу.
iFLYTEK позиционирует Spark X2.5 как основу для локальных ассистентов производительности, хотя отдельного перечня функций офисной автоматизации и профильных бенчмарков в материалах релиза не опубликовано. 2
Для других сценариев компания приводит следующие заявления:
По данным iFLYTEK, обе модели полностью обучались на отечественных вычислительных платформах. На предобучение было использовано около 20 трлн разнообразных токенов; затем применялись контролируемая донастройка и обучение с подкреплением. 2
В анонсе перечислены аппаратные платформы NVIDIA, Huawei, Hygon и Hemo; движки инференса vLLM, SGLang и llama.cpp; варианты развёртывания через Ollama и LM Studio; а также LLaMA-Factory для инкрементальной донастройки. Реальная скорость и расход памяти будут зависеть от выбранной модели, квантизации, длины контекста и конкретного оборудования. 2
iFLYTEK сообщила о публикации весов моделей, исходных репозиториев и документации по развёртыванию. Указана доступность через Hugging Face и GitHub. Кроме того, для моделей были анонсированы API на платформе Starry MaaS с бесплатным доступом на ограниченный срок. Точная дата окончания акции и размер квоты не раскрыты, поэтому условия стоит проверить перед использованием в проекте. 2
6
Особенность Spark X2.5 не только в открытом распространении или небольшом размере моделей. Главное сочетание — 1,7- и 4-миллиардные модели для периферийного запуска с заявленным нативным контекстом до миллиона токенов. Если эта характеристика подтвердится на практике, модели могут быть полезны для приватного локального анализа полных руководств, технических архивов и кодовых баз, где важны связи между разными частями материала.
Практический следующий шаг для разработчиков — испытать Spark X2.5 на собственных длинноконтекстных задачах и именно на том устройстве, где модель будет работать.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
1 сентября 2026 года дочерняя компания iFLYTEK Ciyuan Xinghuo открыла модели Spark X2.5 4B и X2.5 1.7B — компактные модели для периферийных устройств с заявленным нативным контекстом до 1 млн токенов.
1 сентября 2026 года дочерняя компания iFLYTEK Ciyuan Xinghuo открыла модели Spark X2.5 4B и X2.5 1.7B — компактные модели для периферийных устройств с заявленным нативным контекстом до 1 млн токенов. Модели используют гибридную архитектуру внимания и ориентированы на агентов, код, математику, выполнение инструкций и анализ длинных локальных документов без обязательной нарезки на фрагменты.
Опубликованы веса, исходные репозитории и документация; заявлена совместимость с vLLM, SGLang, llama.cpp, Ollama и LM Studio, а также ограниченный по времени бесплатный доступ к API.