2026-09-21 · 来源:{'name': '华尔街见闻全球·中继', 'url': 'https://wallstreetcn.com/articles/3782243'}

SpaceXAI推出Grok 4.7,称速度达可比模型两倍、价格仅一半,七项基准全面超越上代。
SpaceXAI正式推出Grok 4.7,称其为迄今最强的编程与知识工作模型:速度达到可比模型的两倍、价格仅为一半,同时保持与Grok 4.6相同的基础价格和速度。马斯克在社交媒体转发官方公告并表示,“Grok 4.7是智能、速度与低成本的强大组合”。新模型已上线Cursor、Grok Build及Grok API,其核心策略是以更强的编程与专业工作能力叠加较低的使用成本,争夺开发者与企业用户。
技术上,Grok 4.7采用规模更大的新基础模型,针对更困难、耗时更长的任务强化训练,重点提升复杂任务持续执行、自我验证与长上下文处理能力,并经专门训练原生理解Grok Bot运行框架,文档与演示文稿创建亦有改善。SpaceXAI公布的七项测试成绩全部超过Grok 4.6:CursorBench 4.0从40.4%升至46.3%,DeepSWE v1.1从65.2%升至71.0%,终端编程测试Terminal-Bench 4.0从20.3%升至38.0%、接近翻倍;专业知识工作测试AA Briefcase v1.1得分1657,高于上代的1546。
专业工作方面,GDPval和AA Briefcase涉及律师、护士、金融分析师等岗位的实际工作任务,Grok 4.7在两项中均较上代改善,整体表现可与其他前沿模型相比:Harvey Legal Benchmark得分19.6%(上代15.8%),HealthBench Professional为56.7%(上代48.5%),电气工程基准EEBench从53.0%升至64.0%。不过它并非全面领先——HealthBench Professional低于GPT-5.6 Sol的60.5%和Fable 5.1的62.1%,EEBench则高于这两款模型。
安全被列为本轮升级重点。Grok 4.7在拒绝危险请求和抵御越狱攻击方面表现更强,LatchBio生物安全基准得分为62.4%;在HackerBench网络安全测试中仅放行3.3%的高风险请求,同时较少拦截合法网络安全工作。SpaceXAI还向部分网络安全合作伙伴开放邀请制红队访问权限,以支持防御性安全研究。来源同时提示,上述安全数据出自SpaceXAI公布的测试结果,实际防护效果仍有待验证。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅