Skip to content

AGIOne 平台能力 ​

整体方案 ​

问:贵公司在AI资源管理调度领域的整体解决方案是怎样的? ​

答:AGIOne 是面向企业级大模型生产化运营的一站式智能算力与模型管理平台,围绕“算力 → 模型 → 服务 → 运营”的端到端闭环建设能力。平台核心能力包括:异构算力纳管、模型模板、快速部署、模型发布、模型聚合、计量计费,以及贯穿全链路的调用可观测。整体方案先将分布在不同机房、不同厂商、不同代际的 GPU / NPU 统一纳管为逻辑资源池,再通过模型模板沉淀部署经验,通过快速部署和模型发布形成标准 Endpoint,并通过模型聚合、限流、计量和监控支撑生产化运营。

架构与容器化 ​

问:调度架构采用集中式还是分布式?容器化方案的具体实现是怎样的? ​

答:AGIOne 采用“中心管控 + 边缘执行”的架构,可跨机房、跨网络域纳入同一管控视图。AGIOne 管控平面部署在客户内网,至少 3 个核心服务及中间件节点;纳管 GPU / NPU 工作节点按异构算力池接入。容器化方案基于 Kubernetes:节点初始化会自动安装容器运行时、K8s 组件和 AGIOne plugin;部署过程中会进行 K8s Pod 创建、调度策略匹配、资源 quota 校验、镜像拉取、模型加载和健康检查。纳管节点不直接对外暴露端口,调用经管控网关代理。网络架构如下

AGIOne network architecture

平台兼容 ​

问:是否使用 ServingRuntime(KServe)等对象? ​

答:不使用。

问:OpenShift AI 支持 RAY 框架。HCS 上是否有类似能力? ​

答:客户可以通过 RAY 框架创建多节点集群。该场景需要 RDMA 网络。

区域支持 ​

问:在亚太区域是否有端到端解决方案和落地案例?本地化技术支持情况如何? ​

答:有。