尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

讯飞星火 X2.5 解读:MoE 293B 全国产算力,端侧 4B/1.7B 免费开源

发布时间:2026/9/9 1:30:31

资讯中心
01
ARTICLE

讯飞星火 X2.5 解读:MoE 293B 全国产算力,端侧 4B/1.7B 免费开源

讯飞星火 X2.5 解读:MoE 293B 全国产算力,端侧 4B/1.7B 免费开源
讯飞星火 X2.5 解读MoE 293B 全国产算力端侧 4B/1.7B 免费开源TL;DR 速览MoE 架构星火 X2.5 采用 293B-A30B 混合专家重点提升代码与智能体能力全国产算力从训练到推理全流程基于国产算力平台攻克超长序列训推难题端侧开源X2.5-4B / 1.7B 两款开源支持 100 万 Token 上下文可本地部署用起来转向国产模型主线从训模型转向真在跑开放平台已上线一个里程碑星火 X2.5 正式发布9 月 7 日科大讯飞正式发布星火 X2.5 大模型。作为讯飞技术演进的重要节点这次发布在架构、能力、算力适配三个维度都做了升级。最值得技术从业者关注的有三点MoE 架构落地、代码与智能体能力专项强化、全国产算力全流程闭环。这三点叠加在一起指向一个信号——国产大模型正在从追参数进入真落地阶段。架构和参数MoE 293B-A30B 意味着什么星火 X2.5 采用了MoE混合专家架构参数规模为293B-A30B。拆开理解这个数字293B 是总参数量约 2930 亿A30B 是激活参数量每次推理实际被调用的约 300 亿。MoE 的精髓就是总参数大、激活参数小——模型肚量大、知识面广但每次干活只调动一小部分专家成本和速度都能控制住。对比一下非 MoE 模型一个 2900 亿参数的稠密模型每次推理都要跑全部 2900 亿成本高、响应慢。而 MoE 用 10 倍的总参数换取更强的能力却只付出激活参数对应的算力。这也是近两年大模型的通用趋势——同样的算力预算MoE 能换来更高的能力上限。讯飞把 MoE 落地到星火 X2.5意味着它在模型强和算力省之间找到了平衡点这在算力受约束的国产环境下尤其关键。能力重点代码 智能体双专项这次 X2.5 的提升方向非常明确两个词代码、智能体Agent。代码能力是当下大模型最硬的竞争力——无论是 AI 编程助手还是 Agent 自动写码都建立在代码能力上。讯飞把代码作为重点强化方向说明它瞄准的是开发者市场而不是单纯的对话场景。智能体能力则是 X2.5 的另一半重心。智能体Agent是近两年从只会聊天到能干活的关键跃迁——它能调用工具、记住上下文、执行多步任务。星火 X2.5 针对 Agent 应用的专项优化意味着它不只是回答问题而是能支撑完成任务的场景。这在国产模型里是一个明确的差异化定位。此外X2.5 还持续增强了数学、语义理解等通用能力。全国产算力真正的硬门槛这是技术上最值得说的一点也是国产模型真正的分水岭之一。讯飞公开表示星火 X2.5基于全国产算力完成全流程训练及推理并持续优化国产超长序列训推难题。这个表述的分量在于这是从训练到推理的全流程而不是推理阶段跑在国产卡上。很多国产模型训练阶段仍依赖英伟达算力只在部署时用国产卡。讯飞这条路走得更彻底——训练在国产算力平台完成推理也在国产算力平台完成。背后的难点是超长序列训推。国产算力平台在长序列场景下的显存、数据传输、并行策略都和高性能 GPU 不同需要专门优化。讯飞声称已攻克并在持续优化这些难题。这不仅是技术能力更是算力自主可控的战略选择——在先进制程受限的环境下能够全流程训推国产大模型的厂商才有真正的自主性。端侧开源4B 和 1.7B免费可本地部署除了大模型主体讯飞还同步开源了星火 X2.5-4B 和 1.7B 两款端侧模型。这一层的信号对开发者尤其重要。两款端侧模型的能力亮点支持最长达 100 万 Token 的上下文——这是一个非常大的数字意味着它能处理整本厚书、成百上千页的文档、超长代码库支持本地部署——不依赖云端 API可以跑在本地机器上适用场景也很明确长文档深度处理整本书、整个知识库的问答与总结代码辅助开发本地代码补全、分析数据不出本机复杂数据分析本地跑数据问答兼顾隐私与成本对开发者来说开源 端侧 超长上下文这个组合很实用。很多场景比如企业内部知识库、隐私敏感的数据分析、需要低延迟的代码辅助不适合把数据发到云端 API端侧开源模型正好补上这块。而且它免费可以作为起步方案跑通之后再决定要不要升级到更大的云端模型。一个更大的信号国产模型从训转向用星火 X2.5 不是孤例。把时间线拉远看近期国产模型的主线正在发生方向性转变。之前更长时间国产模型的叙事是参数追平“榜单冲分”——强调模型本身多强。但近期的动向越来越多是真在跑讯飞星火 X2.5 上线开放平台面向开发者和企业全面开放腾讯混元 Hy4 周调用 14.7 万亿 Token、环比暴涨 379%登顶全球周调用量第一中国大模型调用量连续 19 周领跑全球56.72 万亿 vs 美国 16.54 万亿训模型是技术强调用量是用起来。这两个信号放在一起说明国产模型产业正从把模型做出来走向把模型真跑起来。代码 智能体 端侧 开源星火 X2.5 恰好踩在这个产业转向的节点上。我的判断国产模型进入可用性竞争窗口对开发者来说星火 X2.5 值得关注的点不是参数多少而是它的定位和生态打法。第一代码 智能体是正确方向。大模型商业化最确定的两个方向就是开发者工具代码和自动化Agent。讯飞很清醒地往这两个方向加码说明它看准了价值区而不是在通用对话的红海里拼参数。第二端侧开源是差异化抓手。在云端大模型同质化竞争的当下开源 端侧 超长上下文 本地部署是一个能被开发者快速验证的价值点。免费、隐私友好、低延迟对很多场景是刚需。第三全国产算力是长期护城河。在供应链不确定的环境下能全流程训推的厂商拥有战略主动权。这不是一朝一夕能追上的能力而是长期投入的结果。一句话星火 X2.5 用一串数字MoE 293B-A30B、100 万 Token、4B/1.7B 开源讲清楚了一件事——国产大模型已经准备好让你真的用起来了。
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。