新模型
2026-09-01
讯飞开源星火 X2.5:端侧模型首次支持百万字上下文
来源:科技日报 / 中国经营报
讯飞开源星火 X2.5:端侧模型首次支持百万字上下文
一句话说清:科大讯飞开源了两款"装进手机电脑就能跑"的小模型,最大亮点是本地就能一口气读完百万字的超长文档,不用联网、不用把资料传上云。
发生了什么
2026 年 9 月 1 日,科大讯飞全资子公司词元星火正式推出并开源 星火 X2.5-4B 和 星火 X2.5-1.7B 两款端侧(本地)通用大模型。
- 它们是端侧模型里首个原生支持最长 100 万 Token 上下文的产品——简单说,一次能"看全"规模很大的信息(约等于一本很厚的书或几十页的产品手册)。
- 两款模型用国产算力平台全流程训练,约 20 万亿 Token 数据预训练,采用混合注意力架构,重点优化智能体、代码、数学和指令遵循。
- 实测能力:办公场景里能自己写脚本做销售分析、生成中英文报告;智能家居指令执行正确率 90.3%、响应仅 0.85 秒;也能部署到机器人做导航决策。
- 权重已在 Hugging Face、GitHub 开放,API 也上了讯飞星辰 MaaS 平台;支持英伟达、华为、海光等硬件,可用 Ollama、LM Studio 等工具一键部署。
- 讯飞还预告:9 月 7 日将正式发布更大的星火 X2.5-293B 通用大模型。
来源:科技日报(2026-09-01)、中国经营报(2026-09-01)。
对我有什么用
- 隐私更好:端侧模型跑在你自己设备上,资料不用上传云端,适合处理公司文档、个人资料。
- 长文档不截断:以前小模型读长文要切成几段,容易忘前情;现在一次读完,跨章节问题也能连贯回答(比如"买 10 天后故障且用过第三方耗材,符合换货吗")。
- 断网也能用:本地部署后没网也能跑基础问答和文档处理。
我可以怎么做
- 最省事(小白):直接用讯飞星火 App / 网页版,体验它已有的长文档总结、AI 写作、解题功能(云端版,不用自己部署)。
- 想本地跑(进阶):电脑装 Ollama 或 LM Studio,搜索 "Spark X2.5" 下载 1.7B 小模型(对电脑要求低),导入后就能离线聊天、读文档。
- 开发者:去 Hugging Face / GitHub 拉取权重,按官方文档接入本地脚本。
温馨提醒
- 4B / 1.7B 是"小模型",能力强在 locally 跑长文本和特定任务,通用闲聊、创作不如云端大模型,别期待它什么都会。
- 本地部署对电脑内存/显卡有一定要求,老旧笔记本跑 4B 可能卡;先从 1.7B 试。
- 9 月 7 日的 293B 是大模型、要联网/高性能设备,和这两款端侧小模型不是一回事。
- 涉及合同、医疗、财务的内容,AI 给的结论务必自己核对。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法