🧪 模型发布AI 热点解读#端侧#星火#上下文

端侧模型新战局:星火 X2.5 让 1M 上下文首次上「手机」

星火 X2.5-4B/1.7B:端侧唯一原生 1M token 上下文,且基于全国产算力训练——端侧大模型的锚点被改写。

AIAI评测 编辑部

一句话结论

星火 X2.5-4B 与 1.7B 是「端侧唯一原生支持 1M token 上下文」的模型(基于全国产算力平台全流程训练、约 20T token 预训练)——端侧大模型的容量叙事被改写,此前「1M 上下文」基本是云端旗舰的专利。

三个关键点

1. 端侧 1M 的现实意义

端侧能塞 1M 上下文意味着隐私敏感的长文档/长对话可以本地完成——对金融、医疗、政务等「数据不出设备」的场景是结构性利好。

2. 全国产算力

从训练到推理都在国产算力平台完成——供应链自主叙事 + 合规卖点双加分,也会影响政府与国企采购。

3. 与同尺寸开源模型的竞争

4B/1.7B 档打「智能体/代码/指令遵循」优化——端侧小模型的竞争从「参数」转向「同尺寸下的能力密度」。

对你的判断

  • 开发者:端侧 1M 上下文适合离线长文档分析、隐私 Agent;先确认你的目标设备能装下模型体积。
  • 决策者:国产算力 + 端侧能力,对信创场景是加分项。
分享:🐦 X📣 微博

💡 常见问题

4B 模型也支持 1M 上下文吗?

X2.5-4B 与 1.7B 均原生支持最高 1M token 上下文——如官方所称,是目前端侧唯一。

模型在哪下载?

Hugging Face / GitHub 已开放权重,API 上线讯飞星辰 MaaS 平台(限时免费)。

📌 更多热点解读