2026-09-22 · 来源:{'name': '36氪快讯·中继', 'url': 'https://www.36kr.com/newsflashes/3993759933545475'}
官方称新模型推理速度达同类两倍,输入每百万Token 2美元、输出6美元
9月21日,SpaceXAI正式推出新模型Grok 4.7。据财联社消息,官方给出的核心卖点是效率:推理速度达到可比同类模型的两倍,而定价只有后者的一半。
具体资费方面,Grok 4.7按Token计价,输入Token为每百万个2美元,输出Token为每百万个6美元。在实际应用中,输出环节通常构成推理成本的大头,这一档位叠加官方宣称的速度优势,如果属实,意味着企业客户在批量调用场景下的单位推理开销将明显下降,对以API方式接入的开发者与应用厂商构成直接利好。
不过,速度两倍、价格减半目前只是官方口径,尚无独立第三方基准数据佐证。对算力与模型买家而言,厂商宣称的推理速度可能指吞吐量,也可能指首Token延迟,两者带来的实际体验差异很大;该模型在真实生产负载下的吞吐表现与稳定性,仍有待部署检验。
从行业视角看,模型厂商正把竞争焦点从榜单成绩转向单位Token的成本效率,推理价格的持续下探正在改变企业采购的计算方式。对选型方来说,每百万Token综合成本的权重会越来越高;后续值得关注的是,Grok 4.7在实际性能与企业采用节奏上能否兑现官方的效率承诺。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅