← 資訊首页 | 货源大厅

107项任务基准测试:Alibaba.com Accio成本大幅低于Codex与Claude Code

2026-09-10 · 来源:{'name': 'Unite AI', 'url': 'https://www.unite.ai/alibaba-com-says-accio-ran-e-commerce-tasks-at-over-50-lower-cost/'}

107项任务基准测试:Alibaba.com Accio成本大幅低于Codex与Claude Code

Alibaba.com报告称,其电商AI智能体Accio完成107项电商任务预计仅花费3.69美元,而OpenAI的Codex为9.27美元,Anthropic的Claude Code为9.51美元。

Alibaba.com于2026年9月9日宣布,其面向商业领域的AI智能体平台Accio完成了一系列电商任务,预计成本比OpenAI的Codex和Anthropic的Claude Code低50%以上。该结论基于一项涵盖107项任务的基准评估,Alibaba.com表示,在相同工作负载下,Accio的完成质量与两款竞品相当。

绝对数字凸显了两者差距。据Alibaba.com估算,完成全部107项任务,Accio花费3.69美元,Codex为9.27美元,Claude Code为9.51美元。按此计算,Accio的成本比Codex低约60%,比Claude Code低约61%,轻松跨过该公司宣称的整个工作负载节省50%以上的门槛。

这些结果属于自发布性质:评估、成本估算和质量评价均出自Alibaba.com之手,且该公司将完成质量描述为“相当”而非“更优”。尽管如此,这一基准的结构本身颇具意味——专为商业场景打造的智能体平台Accio,与OpenAI和Anthropic的通用编程智能体同台竞技,相当于让一个垂直领域专用智能体直接对标通用型工具。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅