华为在 2026 年 9 月的全联接大会期间发布围绕 AI DC 的方案与成果,涉及企业 AI 算力建设和运营。企业关注这类基础设施热点时,应先把自己的业务负载写清楚,再决定购买算力、使用托管服务或采用混合方式。华为官方发布
业务负载的清单
列出正在使用或准备投入使用的任务,包括知识问答、文件识别、经营分析、图像处理和业务操作。每类任务记录输入大小、预计并发、持续时间以及需要保存的结果。
| 任务 | 容量关注点 | 验证样本 |
|---|---|---|
| 文档问答 | 检索、模型响应 | 长文档和多资料提问 |
| 图片识别 | 图像处理、显存或接口额度 | 扫描件与批量标签 |
| 经营分析 | 数据查询、内存 | 多期间、多组织汇总 |
| 文件生成 | CPU、内存、磁盘 | 大表格和复杂报告 |
| 多轮业务任务 | 持续运行、工具调用 | 补资料后继续执行 |
对外部模型 API 的调用与本地模型推理分别估算。调用 API 的应用不一定需要本地 GPU,但仍需要稳定的任务执行、文件处理和存储能力。
峰值与日常使用
月平均任务量会掩盖集中访问。例如晨会前多人同时生成报告,月末集中核对业务数据,负载都可能明显高于平时。应记录高峰持续多久、哪些任务可以排队、哪些必须交互响应。
不要只依据一次演示购买整套配置。用接近实际资料量的任务组合测试,观察排队、完成时间与失败情况;资源增加后也应确认瓶颈是否转移到数据库、网络或模型接口额度。
存储与网络的配套
原始文档、检索索引、生成文件、日志和备份有不同的增长方式。容量规划应分别计算,并明确保留周期。可重新生成的缓存与唯一业务产物不应采用同一保存策略。
网络需要支持员工访问、业务系统连接和外部模型调用。跨地域访问、内网隔离以及大文件传输都会影响体验。算力规格提升之后,链路延迟和系统接口限流仍可能成为主要等待来源。
自建与托管的责任
自建环境需要有人负责升级、监控、故障恢复和备份验证。使用托管服务也应明确平台故障与业务配置问题分别由谁处理,不能把全部维护事项都写成一句“由服务商负责”。
选型材料应列出当前可用能力、部署条件、交付范围和退出方式。未来计划可以作为跟踪项,但验收应以实际交付的版本与资源为准,避免把路线图中的功能当作已经买到的能力。
容量验收的结果
在固定任务集合下,记录成功率、典型等待、高峰等待、费用和资源利用率。对于失败任务,区分模型结果错误、接口问题、资源不足及人为取消,避免一个总体成功率掩盖业务风险。
扩容条件可以绑定到持续排队、内存不足或资源限额,但应同时确认是否存在重复执行和异常循环。先核清工作量来源,再决定增加资源。每次调整保留前后数据,使采购和维护都有可复核依据。
涉及自有机房时,将供电、散热、机柜空间和维护窗口纳入清单,并由相应专业人员确认承载条件。采购验收同时记录设备配置与应用版本,后续扩容或更换部件后,能够复现原来的业务样本并比较实际变化。
应用部署见云栖大会 Agent 计算选型,网络侧检查见多门店 Agent 连通性。业务范围可在企业 Agent 落地中确定。







