帮你快速理解、总结文档立即下载
文档中心>产业互联网学堂

腾讯私有云交付运维工程师 - 云智媒体AI中台认证

最近更新时间:2026-07-22 12:08:30

我的收藏

认证概述

适用于从事媒体 AI 中台产品交付、运维、售前咨询及相关项目的工程师和技术人员。通过该认证,您将掌握媒体 AI 中台的整体架构、核心能力、部署交付流程、平台工具使用与日常运维方法,具备媒体 AI 中台项目端到端交付与运维能力。
建议报名该认证的考生具备以下知识或经验:
3年以上 Linux 系统安装、配置、调优经验或者具有1年以上 RHCE 等级。
2年以上 Kubernetes / Docker 容器化平台的实际使用经验,熟悉 kubectl 等常用命令。
熟悉 MySQL 关系型数据库的配置与管理,了解 Prometheus + Grafana 监控体系,具备 Ansible、SaltStack 等自动化运维工具及 Shell 脚本编写能力。
了解媒体处理、AI 推理与模型服务化的基本概念(如视频编解码、ASR、OCR、人脸识别等)。
了解腾讯云 TI 平台或类似企业级 AI 平台的基本使用。

基本信息

考试类型:理论考试。
考试形式:线下。
题型与题量:单选题40道、多选题20道。
通过/满分分数:70/100分。
考试时长:90分钟。
考试语言:简体中文。
其他注意事项:
1. 多选题错选、漏选不得分。
2. 考试报名和考试预约指引:报名和考试指引
3. 成绩查询:考试结束后可通过腾讯云培训认证的 个人中心-认证考试 页面查看成绩,理论考试成绩3天内公布。
4. 该认证仅面向腾讯云合作伙伴开放报名和考试。

建议的学习资源

知识点占比与详细描述

知识点
比例
详细描述
产品部署准备
22%
部署条件确认:硬件配置(CPU/内存/磁盘/网卡≥10G)、操作系统(TencentOS 3.1 / TencentOS 2.4 / CentOS 7.9 / 银河麒麟 V10)、共享存储选型(CSP / NAS / CFS)。
部署方案设计与配置规划:ti-one-deploy 工具的使用、基础/主机/参数/服务/部署拓扑配置、镜像仓库与 License 准备。
命名空间与项目资源:ti-base、tione、timatrix、ti-inf、ns-1、ai-media、cpaas-system 等命名空间含义,业务、项目与资源分配。
GPU 资源:物理 GPU 选型、驱动要求(如 P40 卡 CUDA 11.2 / 驱动 460)、Nouveau 驱动禁用。
国产化与高可用:国产化芯片服务器 CPU/内存加倍、TCS 高可用版最少3节点、TCS VIP 规划。
产品交付流程
12%
部署前评审:第三方数据对接、告警对接、https 配置、Logo 与欢迎语变更、数据备份/清理周期等 5 项确认。
部署方案设计:硬件与容量调研、网络与存储调研、风险点识别。
交付实施 SOW:部署方案设计、测试与验收、定制化需求(第三方数据库对接、数据备份、大模型精调等)评估。
实施阶段工具:Helm、Ansible、巡检工具、QTA 自动化测试。
测试验收:依据《验收测试指南》和配套测试工具。
部署实施
37%
平台底座部署:底座平台高可用安装、参数填写(VIP、镜像仓库、平台访问地址、pod 上限 255、不勾选 devops/service mesh)。
ti-one-deploy 工具链:规划配置页面(index.html)、物料上传、初始化前检查、初始化、install 安装、QTA 验证。
CSP 分布式存储:控制台安装(HA / 非 HA)、集群创建、License 导入、存储池创建、元数据节点配置、白名单与配额。
应用部署:物料包组成(server.tar.gz / ems_image.tar.gz / helm_image.tar.gz)、解压、安装 helm 应用、安装 ppl/ems、应用启动。
License 申请:平台 License(.lic)、优图算法 License(/data/youtu/license/)、ASR 模型 License(mac 地址 / systeminfo / 机器码)。
模拟视频流:将视频上传到 /data/ti-platform/fake-camera/custom_videos/。
关键验证:巡检 + QTA(先巡检后 QTA)、kubectl get nodes 检查、QTA 生命周期1天过期后需重新部署。
平台工具
8%
ti-one-deploy 工具:使用步骤(解压 → 规划配置 → 生成配置 → 上传物料 → 初始化 → install)、配置文件(middleware.yaml 中间件、dfs.yaml 共享存储类型)、host 规划(部署节点1台 / 管理节点3台)。
巡检工具:通过 Ansible 自动检查每台机器状态并生成报告;支持单独检查 MySQL(--skip 跳过 CSP/GPU);包含 Python 与 Bash 脚本;需配置 hosts。
QTA 健康检查:自动获取 now.yaml 匹配用例 TAG;正常部署后已包含 QTA,生命周期1天;修改配置后需重新部署;测试报告路径 /data/ti-platform-fs/ti-qta/qta_log/。
TDSQL 对接:注意字符集设置(utf8mb4),创建 admin/tibase/tione/grafana 数据库用户。
平台运维
21%
命名空间与组件:算法服务一般部署在 ns-1;应用服务在 ai-media;监控组件为 Prometheus + Grafana;Elasticsearch 健康度 yellow/red 需排查分片;Etcd 至少3节点保证高可用。
常用 K8s 命令:kubectl get pod/node/deploy、kubectl describe pod、kubectl logs、kubectl exec、kubectl edit deploy。
平台架构导航:六大能力模块(应用中心、应用编排、模型服务、数据中心、训练工坊除外 → 实际为应用中心、应用编排、模型服务、媒体资产管理、视频处理、智能标签 / 视频结构化 等);一级菜单(应用中心、边缘中心、管理中心,不含自动学习);应用访问路径 → 应用中心 → 应用工作台。
数据备份与恢复:ES / MySQL / ETCD 备份恢复四步法;MySQL 备份周期调整使用 kubectl edit sop -n velero ti-mysql-backup;日志默认保存7天。
常见故障:OOMKilled(检查内存)、ImagePullBackOff(检查镜像仓库)、CrashLoopBackOff(查看日志)、节点时间不同步(检查 NTP)、SSH 超时(检查防火墙)、服务异常(kubectl describe / logs 定位)。
端口与日志:业务日志落盘到 /var/log/containers/;53端口 DNS、6443端口 K8s API、53端口 DNS;查看 DNS 配置 /etc/resolv.conf;查看实时负载 uptime。