← 資訊首页 | 货源大厅
AI Inference 主题文章
共 20 篇 · 由萬安算交所资讯持续追踪
- 苹果 Mac Studio 搭 M5 Ultra 发售,19999 元起
2026-09-21 · 苹果 2026 款 Mac Studio 9 月 22 日发售,最高 512GB 统一内存 - 华为发布OceanStor M900:单集群64 PB KV缓存,主攻AI推理
2026-09-17 · 该存储系统在2026华为全联接大会(上海)上亮相,为SuperPoD提供面向AI推理的完全共享PB级内存空间,单集群KV缓存达64 PB。 - Axelera AI正式出货Europa AIPU:45W功耗下算力最高达629 TOPS
2026-09-16 · Axelera的Europa AIPU以芯片、边缘和服务器三种形态登场,公司同时亮出15亿美元销售管线、600多家客户的成绩单,并公布首款面向机架级系统的Tit - NVIDIA Vera Rubin NVL72首战MLPerf Inference v6.1即领跑全场:推理经济性成为AI算力采购新标尺
2026-09-16 · 首次亮相便登顶基准测试,NVIDIA把MLPerf分数与数据中心收入直接挂钩,为AI基础设施买家树立了新的采购参照系。 - Fujitsu官宣:日本国产MONAKA CPU与主权AI服务器定档2026年11月全球发售
2026-09-14 · AI推理吞吐量翻倍、功耗减半的叙事背后,是日本对主权AI算力供应链的一次系统性押注 - 存储、网络与供电重塑Token经济学,AI推理演变为全栈问题
2026-09-11 · 随着生成式与智能体应用进入生产环境,产出Token的成本与速度日益取决于存储延迟、带宽、数据搬运与电力供应——而不再仅仅取决于GPU性能。 - 距Nvidia参投轮仅数周,推理芯片初创Etched再融7亿美元、估值飙至210亿美元
2026-09-11 · 推理专用芯片赛道再现资本狂潮:Etched在数周内连续完成两笔大额融资,合计约10亿美元,投资方横跨交易公司与顶级风投,折射出AI推理算力从"训练优先"向"推理 - 推理重塑AI基础设施经济账,Supermicro峰会力推多层存储架构
2026-09-11 · 当推理成为AI基础设施的主导工作负载,存储正从配角跃升为GPU投资回报的直接决定因素——Supermicro开放存储峰会释放的信号,值得每一位AI算力买家重新审 - 上下文窗口越撑越大,智能体AI把存储推向推理新层级——Open Storage Summit观察
2026-09-10 · 当企业AI的重心从训练转向智能体,"推理—行动—再评估"的循环正在把存储从附属配角推上推理架构的核心位置,一个全新的存储层级由此浮出水面。 - 8.75亿美元豪赌“无HBM”路线:Positron AI用消费级内存打造AI推理一体机
2026-09-10 · NEA、Atreides、Valor、Andra、SemiAnalysis Capital与Netscape联合创始人Jim Clark领投Positron A - Serverless AI:托管API改写云端推理规则
2026-09-10 · Amazon Bedrock、Azure OpenAI Service 与 Google Cloud Vertex AI 将 GPU 供给和模型部署化为按 to - DDN携手Super Micro、Solidigm发布Enterprise AI HyperPOD,发力企业级AI推理
2026-09-10 · 在存储优先级从训练转向推理的拐点上,DDN联合Super Micro与Solidigm、基于Nvidia AI Data Platform打造一体化推理存储平台 - NVIDIA宣布Groq 3 LPX全面量产,Vera Rubin NVL72扩展发力智能体推理
2026-09-10 · NVIDIA为Vera Rubin NVL72注入面向智能体系统的高速token生成能力,并称下一个推理时代的胜负,取决于AI工厂每一层的协同运作。 - d-Matrix 携手 NVIDIA NVLink Fusion,Raptor XPU 将组机架级 AI 系统——推理芯片新势力接入英伟达生
2026-09-10 · 这家 AI 推理芯片制造商将把下一代 Raptor XPU 接入 NVIDIA 的 NVLink 纵向扩展网络、Spectrum-X 横向扩展网络以及 MGX - 高通携手亚马逊签下多代际大单,共研定制AI推理芯片——云巨头自研潮下的能效突围战
2026-09-10 · 高通迄今最大规模的云数据中心布局落地:将高能效架构、定制推理芯片与光互连技术打包注入AWS,这场多代际合作或将改写超大规模AI推理的经济账。 - 借道NVLink Fusion,d-Matrix将Raptor推理XPU接入NVIDIA MGX机架生态
2026-09-10 · 推理芯片厂商d-Matrix与NVIDIA达成多年期产品路线图合作,将通过NVLink Fusion把下一代Raptor推理XPU纳入MGX机架级架构,首批机架 - Equinix Horizon首秀:企业AI推理时代,网络才是"控制平面"
2026-09-10 · 在首届Horizon大会上,Equinix提出企业AI的核心问题已不再是算力供给,而是推理究竟应该在哪里运行——而给出答案的正是网络。 - Gimlet Labs斩获3亿美元B轮融资,估值达30亿美元
2026-09-10 · Andreessen Horowitz领投,Arm、Samsung Ventures和Microsoft旗下M12基金参投,押注这家初创公司的解耦式推理平台。 - 把KV缓存搬出GPU显存:Lightbits Labs的Inferra引擎正式商用
2026-09-10 · 这家NVMe over TCP协议先驱推出的新软件引擎,将键值缓存数据从GPU高带宽内存中迁移出去,以改善AI推理的经济性与性能。 - 48小时从裸金属到生产级推理集群:Aranya携1100万美元融资切入AI基础设施部署痛点
2026-09-10 · 这家成立仅一年的初创公司不卖芯片、不做云,专攻服务器到货与上线之间的"空白时间",其能否兑现48小时交付承诺,正成为推理算力供应链的新观察点。
萬安算交所 AIXX · 进入货源大厅