2026年7月18日至20日,上海——在 2026 世界人工智能大会(WAIC)期间,AI Native Cloud 服务商 GMI Cloud 集中展示了其全栈智算产品矩阵,并联合十余家产业链企业发布了《中国 AI 产业核心要素出海发展白皮书》(下称"白皮书")。
从挖矿转型而来的算力服务商
GMI Cloud 由叶威延(Alex Yeh)创立于约 2022 年,前身为加密货币挖矿业务,后转型为 AI 云计算服务商。叶威延出身台湾半导体世家,其父亲叶佳纹为瑞昱半导体(Realtek)共同创办人、上市公司弘忆国际董事长。2024 年底,GMI Cloud 完成由 Headline Asia 领投、泰国能源商 Banpu NEXT 与纬创共同投资的 8200 万美元 A 轮融资。2026 年 6 月,该公司在台北 GTC 大会上被英伟达 CEO 黄仁勋点名,列入全球 NVIDIA Cloud Partner 生态体系。
据公开资料,GMI Cloud 采取"GPU 界的 Airbnb"模式——除自购 GPU 外,还将云端管理软件授权给其他握有闲置算力的业者,由 GMI Cloud 代为出租。目前该公司已在台北建设基于 GB300 的万卡集群,并与纬创共同进军日本鹿儿岛建设主权 AI Factory。
四大核心产品亮相 WAIC
在本届 WAIC 上,GMI Cloud 展示了四大核心产品:
AI Cloud:基于 GB300、GB200、B200 及 H200 等芯片的 GPU 云服务,目前已在台北构建万卡集群。
Cluster Engine(Compute Engine):云原生算力管理调度平台,提供裸金属与容器两种算力服务形态。裸金属服务支持一键创建与全球可访问网络;容器服务则提供更细粒度配置与秒级启动能力。
Inference Engine:集成全球近百个大模型(包括 Gemini、OpenAI、DeepSeek、Qwen、Kimi 等)的推理引擎平台,开发者可通过单一 API 密钥调用。
Agentbox:面向生产级 AI Agent 的全栈托管平台,提供多租户安全隔离沙盒、实时指标监控,以及"按虚拟机算力 + 按 Token"的双维度计费模式。
据 GMI Cloud 提供的案例数据,实时生成式视频企业 Higgsfield 将其重度视频流负载迁移至该平台后,p95 推理延迟降低 65%,计算成本降低 45%,峰值请求成功率保持在 99.9%。大模型开发商 Mirelo AI 则借此降低了 40% 的模型训练成本,迭代时间提速 20%。
白皮书:聚焦"算力、Token、出海"三大要素
7 月 18 日, GMI Cloud 作为核心出品方,联合火山引擎、小米 MiMo、快手、出门问问、商汤科技、像素绽放 PixelBloom、Moka 等企业发布了上述白皮书。
白皮书提出,当前中国 AI 产业面临三重出海瓶颈:一是高端智算硬件被顶尖供应链锁定带来的"算力溢价";二是非英语语种在底层编码时面临的"Token 通胀"与语义丢失;三是欧美市场对数据主权、隐私保护(如 GDPR)及"零留存"的高合规门槛。
白皮书引用数据称,中国日均 Token 调用量已突破 140 万亿,两年内增长超过 1000 倍;企业在模型推理上的资金消耗已占 AI 总预算的约 85%,占全球 AI 总算力开支的约三分之二。Gartner 预测 2026 年全球 AI 总支出将达 2.59 万亿美元,生成式 AI 市场支出同比增速为 59%。
GMI Cloud 中国区总裁蒋剑彪在 WAIC 演讲中表示:"全球 AI 产业已经进入算力、Token、应用三位一体的竞争阶段,单一企业很难独自承担全球算力布局、合规体系搭建的高额投入。"
7 月 18 日中午,蒋剑彪与 GMI Cloud 工程 VP 钱宇靖在 WAIC 领航舞台发表了题为《全球 AI 产业范式革新:跳出模型竞争,构筑全球化核心竞争力》的演讲。钱宇靖还在 WAIC 技术开放麦环节分享了《AI Agent 生产级落地指南》,探讨了 Agent 从实验室走向真实业务场景面临的工程鸿沟。