← 資訊首页 | 货源大厅

中科曙光推理存储FN Neo升级:首Token延迟降73%

2026-09-21 · 来源:{'name': '36氪快讯·中继', 'url': 'https://www.36kr.com/newsflashes/3992663678909190'}

中科曙光推理存储FN Neo升级:首Token延迟降73%

实测首Token响应时间缩减73%、吞吐提升150%,瞄准7×24生产推理

中科曙光近日推出完成迭代升级的AI推理原生存储FN Neo。曙光方面公布的实测数据显示,新版本将模型首Token响应时间缩减73%,整体Token吞吐能力提升150%。在大模型推理服务中,首Token时延直接决定终端用户的等待体感,吞吐水平则关系到系统可承载的并发请求规模,两项指标的改善意味着用户交互等待时长被压缩,系统并发服务能力同步增强。

可靠性是此次升级的另一重点。针对生产级AI业务7×24小时不间断运行的需求,FN Neo具备99.999%的可靠性,并以多重故障防护机制保障推理业务连续不中断。推理服务直接面向线上用户,存储层的故障往往意味着服务中断风险,持续可用能力因此成为此类产品进入生产环境的基本门槛。

部署侧,FN Neo兼容主流推理框架与多元组网环境,企业无需对现有系统进行大规模改造即可完成部署,在复用既有推理生态的前提下实现提质增效,降低了升级切换的门槛。

从产品定位看,曙光将FN Neo明确指向大模型与智能体的规模化生产落地。随着推理业务从测试验证走向线上服务,存储系统在低时延、高并发与持续可用性上的表现愈发关键,推理原生存储正成为算力基础设施厂商竞争的着力点。需要指出的是,上述性能数据来自厂商实测,实际生产环境中的表现仍待更多部署案例验证。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅