GMI Cloud 在 WAIC 2026 展示全栈智算方案,主打 Agentbox 与推理引擎

2026/07/20 12:34阅读量 6

GMI Cloud 在 WAIC 2026 上展出 AI Cloud、MaaS、Agentbox 等全栈智算解决方案。作为 NVIDIA Cloud Partner,其展示基于 GB300/GB200 等芯片的 GPU 云服务,已在中国台北建设万卡集群。同时推出 Inference Engine 平台(可调用 200+ 大模型 API)和面向生产级 AI Agent 的端到端平台 Agentbox,并与 DDN 联合展示高性能 AI 基础设施方案。

事件概述

GMI Cloud 作为 NVIDIA Reference Platform Cloud Partner,在 2026 年世界人工智能大会(WAIC)上集中展示了四大核心产品:AI Cloud、MaaS(模型即服务)、Agentbox 以及自研算力调度平台 Cluster Engine。

核心信息

  • AI Cloud 服务:基于 GB300、GB200、B200、H200 等高性能 GPU,提供全球布局的 GPU 云服务。已在中国台北构建基于 GB300 的万卡集群“AI Factory”。
  • Compute Engine(Cluster Engine):自研云原生算力管理调度平台,支持裸金属与容器算力服务。
  • Inference Engine:高性能推理引擎平台,集成全球超 200 种主流大模型 API,支持极速调用。
  • Agentbox:面向生产级 AI Agent 的全栈托管与商业化平台,提供独享 CPU/GPU 资源、多租户安全隔离沙盒环境,支持一键部署、全栈模型集成(170+ 大模型)以及双维度计费(算力 + Token)。
  • 联合方案:与 DDN(DataDirect Networks)展示高性能 AI 存储与基础设施联合方案,针对高并发数据吞吐和大规模存储需求。
  • 专家观点:GMI Cloud 中国区总裁蒋剑彪与工程 VP 钱宇靖在演讲中指出,全球 AI 竞争已从单一模型比拼转向推理优化、智能体落地与底层算力的综合角逐。钱宇靖还分享了 AI Agent 生产级落地指南,强调稳定、规模化运行是当前工程挑战。

值得关注

GMI Cloud 的重点不仅在底层算力,更在于推理引擎和 Agent 部署平台的商业化闭环。其 Inference Engine 已开放调用 200+ 模型,Agentbox 则试图打通从 Demo 到商业产品的全链路,反映 AI 基础设施从“提供算力”向“提供端到端解决方案”的演进趋势。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。