← 資訊首页 | 货源大厅
Inference 主题文章
共 8 篇 · 由萬安算交所资讯持续追踪
- 只做判断的模型Jev爆火:DCVC领投4000万美元种子轮
2026-09-21 · 前OpenAI研究员造出不聊天的AI:只输出判断,比GPT-4o快近200倍 - 超10万颗国产芯片撑起GLM-5.3-Flash推理栈,Z.ai披露:大部分搭建工作由智能体完成
2026-09-17 · Z.ai表示,一个由GLM-5.3驱动的Infra Agent(基础设施智能体)承担了大部分搭建工作,在超过10万颗中国产AI加速器组成的集群上,为GLM-5. - AI 基础设施圈地大战:新云分化为四大阵营,GPU 租赁不再是全部故事
2026-09-16 · InfoWorld 分析指出,决定 AI 产业格局的战争不在模型与聊天机器人,而在数据中心、电力合同与网络架构;新云正演化为四个截然不同的类别,企业与投资者需逐 - 新云重塑企业基础设施:AI优先服务商与硬件、数据平台缔结新联盟
2026-09-11 · 以AI为核心的新一代云服务商'新云'(Neocloud)正推动企业基础设施深度重构,硬件厂商、数据平台与新云之间的三方合作浪潮兴起,行业重心正从训练转向推理。 - 从“买GPU”到“跑起来”:Cisco与Nvidia加速AI工厂投产
2026-09-10 · AI工厂正从蓝图走向量产,新兴云厂商、企业与主权买家竞相把GPU采购转化为可运行的系统,Cisco与Nvidia则力图占据这场市场转型的中心。 - 零成本调用大模型:2026年五大免费LLM API服务商盘点,覆盖推理、多模态与智能体AI
2026-09-10 · KDNuggets最新盘点梳理了2026年五家提供大语言模型免费调用的API服务商,覆盖高速推理、多模态能力与智能体应用开发,全程无需支付API使用费用。 - Qwen 3.8 27B实测:显存再大,也救不了RTX 5090的推理瓶颈
2026-09-10 · Tom's Hardware对刚发布的开源权重模型Qwen 3.8 27B进行实测,发现即便RTX 5090等显卡显存充足,也无法弥补软件栈与推理引擎的严重瓶颈 - 推理负载规模化,智能体AI驱动企业IT向私有云回流
2026-09-10 · 随着推理负载规模化,企业IT的核心问题正从“选用哪款模型”转向“负载运行于何处”,数据、成本与控制权在私有环境中汇合。
萬安算交所 AIXX · 进入货源大厅