DeepSeek
应用实践
软硬协同
研究报告
AI Infra 报告
客户案例
AI Infra 案例
深入理解 DeepSeek 与企业实践(五):知识库、Manus、代码生成三大场景的原理、评测与部署
本文针对模型与场景匹配,推理和通用模型选择,投入产出与性能平衡等问题,就知识库、代码辅助和智能体(Manus)场景与企业而当前硬件环境进行分析,提供系统的分析和建议。
东方明珠
东方明珠生成式人工智能媒体融合创新平台采用 ZStack AIOS 平台“智塔”,在算力层、模型层、运营层三方面满足 AI 算力需求。
绛溪实验室
新一代多模态泛在智能基础平台基于 AI Infra 平台能力,构建异构算力一体机与多模态智能体系。
新一代AI基础设施-ZStack AIOS平台“智塔”产品介绍
ZStack 智塔 AIOS 一款自主研发、产品化、标准化的新一代AI基础设施操作系统,以“AI”为核心,通过算力层、模型层、运营层三大层面助力 AI 创新落地,支持从云平台无缝升级,以及适配全部的云基础设施模块服务、产品文档和售后服务。
ZStack AIOS 智塔产品介绍架构图
新一代AI基础设施-ZStack AIOS平台“智塔”产品解决方案
算力层 算力精分调度平台
模型层 AI MaaS平台一站式AI训推
运营层 全域感知自服务平台
算力层——算力精分调度平台
ZStack AIOS平台“智塔”具备裸金属、虚机与容器多引擎能力,通过GPU切割精分量化,对异构AI算力实现可达1%的量化管理,大幅降低算力成本。算力层的另一大核心在于,在AI算力精分量化基础之上,通过分布式协同调度能力,实现异构算力的统一管理和动态调度,达到算力的精细化资源复用,进一步降低算力成本。
算力精分调度平台
企业痛点
多架构多品牌GPU需要管理,AI算力分配情况不透明、利用率低,维护成本高
AI 算力稀缺,价格昂贵
异构AI算力无法互通形成算力竖井,资源利用率低
方案亮点
支持裸金属、虚机和容器多引擎部署AI 模型,降低AI应用门槛
异构AI算力统一管理和动态调度,实现精细化资源复用
对AI算力实现可达1%的量化管理,降低AI算力成本
GPU透传可达95%物理性能,vGPU切割无需GPU厂商授权,提升AI 算力利用率
异构算力协同,广泛兼容主流AI芯片
实时监控资源利用率,服务故障自愈,降低运维成本
模型层——AI MaaS平台一站式AI训推
ZStack AIOS平台“智塔”一方面通过动态模型自适应平台,提供从模型训练、评估、推理到更新的全生命周期管理,高效实现模型服务优化;另一方面通过将AI任务智能解构,动态优化路由、分布式并行训推,自适应负载均衡等能力,结合算力层的算力精分协同调度平台,显著提升模型训推性能和模型服务体验。
AI MaaS平台
企业痛点
模型训推难以快速部署
多个模型易形成烟囱式架构,运维管理复杂
多个模型不能高效协同工作,资源利用率低
方案亮点
一体化 AI 训推、应用开发和运维运营体验
实现模型压缩与性能优化,训推高效部署与自适应调度
支持生成式AI、自然语言处理 、计算机视觉、机器学习、深度学习以及多模态AI,并支持数百种大模型。
运营层——全域感知自服务平台
ZStack AIOS平台“智塔”以AI为核心提供更全面更直观的可视化统一视图,实现精细化管理;在动态调度资源方面,跨多智算中心、多集群全域调度自适应模块,可以根据需要实现跨平台的自动扩缩和调度功能;在训推服务高可用方面,弹性容错自愈模块具备快速故障定位与故障自愈能力,可以实现跨平台的容错与灾备;在安全与隐私方面,融合敏感数据检测能力,实现端到端的数据安全保障作为运营基础;在系统运营方面,可实现多租户隔离和资源配额管理,训推计量计费服务。
全域感知自服务平台
企业痛点
缺乏跨平台的计量计费,企业AI普及率低。
发生故障灾难需要较长时间来恢复,导致业务停滞
企业集私有部署需要高等级数据安全
方案亮点
提供多智算中心、多集群、多租户的按量计费运营,实现AI自服务化。
具备可视化统一门户,弹性跨域容错,实现精细化的自服务运营体系。
融合敏感数据检测能力,实现端到端的数据安全保障作为运营基础
新一代AI基础设施-ZStack AIOS平台“智塔”优势
低门槛上手快
建设快
最低2节点轻量部署
上手快
预置模型和开发工具
全链路服务
一站式体验
AI数据管理
AI训练推理
应用开发和运营
算力运维和运营
高性价比
省成本
GPU动态任意切分
高的硬件利用率
性能强
高性能存储网络
安全可信
私密性
数据本地化管理
文件粒度数据隔离
安全性
高可用和灾备服务
新一代AI基础设施-ZStack AIOS平台“智塔”应用场景
模型训练调优
可为影视传媒、医疗、教育、泛政府、运营商、智算中心等不同领域的模型微调,提供从算力到行业训练数据集存储的全套服务。
模型推理
服务于各种 AI 应用的推理使用,通过云上 AI 算力服务提高推理效率。
AI 模型应用落地
可本地实现RAG 知识库应用搭建,支持多推理服务编排策略和插件集成,快速落地 AI 应用。

让每一家企业,都拥有自己的云与 AI 基础设施

无论您正在规划私有云、AIOS、超融合还是虚拟化平台,都可以提交需求。ZStack 专家将结合您的业务场景,提供合适的方案建议。

提交后,ZStack 专家将根据您的需求尽快与您联系。

联系我们