认证概述
适用于从事媒体 AI 中台产品交付、运维、售前咨询及相关项目的工程师和技术人员。通过该认证,您将掌握媒体 AI 中台的整体架构、核心能力、部署交付流程、平台工具使用与日常运维方法,具备媒体 AI 中台项目端到端交付与运维能力。
建议报名该认证的考生具备以下知识或经验:
3年以上 Linux 系统安装、配置、调优经验或者具有1年以上 RHCE 等级。
2年以上 Kubernetes / Docker 容器化平台的实际使用经验,熟悉 kubectl 等常用命令。
熟悉 MySQL 关系型数据库的配置与管理,了解 Prometheus + Grafana 监控体系,具备 Ansible、SaltStack 等自动化运维工具及 Shell 脚本编写能力。
了解媒体处理、AI 推理与模型服务化的基本概念(如视频编解码、ASR、OCR、人脸识别等)。
了解腾讯云 TI 平台或类似企业级 AI 平台的基本使用。
基本信息
考试类型:理论考试。
考试形式:线下。
题型与题量:单选题40道、多选题20道。
通过/满分分数:70/100分。
考试时长:90分钟。
考试语言:简体中文。
其他注意事项:
1. 多选题错选、漏选不得分。
2. 考试报名和考试预约指引:报名和考试指引。
3. 成绩查询:考试结束后可通过腾讯云培训认证的 个人中心-认证考试 页面查看成绩,理论考试成绩3天内公布。
4. 该认证仅面向腾讯云合作伙伴开放报名和考试。
建议的学习资源
资源类型 | 资源地址 |
视频讲解 |
知识点占比与详细描述
知识点 | 比例 | 详细描述 |
产品部署准备 | 22% | 部署条件确认:硬件配置(CPU/内存/磁盘/网卡≥10G)、操作系统(TencentOS 3.1 / TencentOS 2.4 / CentOS 7.9 / 银河麒麟 V10)、共享存储选型(CSP / NAS / CFS)。 部署方案设计与配置规划:ti-one-deploy 工具的使用、基础/主机/参数/服务/部署拓扑配置、镜像仓库与 License 准备。 命名空间与项目资源:ti-base、tione、timatrix、ti-inf、ns-1、ai-media、cpaas-system 等命名空间含义,业务、项目与资源分配。 GPU 资源:物理 GPU 选型、驱动要求(如 P40 卡 CUDA 11.2 / 驱动 460)、Nouveau 驱动禁用。 国产化与高可用:国产化芯片服务器 CPU/内存加倍、TCS 高可用版最少3节点、TCS VIP 规划。 |
产品交付流程 | 12% | 部署前评审:第三方数据对接、告警对接、https 配置、Logo 与欢迎语变更、数据备份/清理周期等 5 项确认。 部署方案设计:硬件与容量调研、网络与存储调研、风险点识别。 交付实施 SOW:部署方案设计、测试与验收、定制化需求(第三方数据库对接、数据备份、大模型精调等)评估。 实施阶段工具:Helm、Ansible、巡检工具、QTA 自动化测试。 测试验收:依据《验收测试指南》和配套测试工具。 |
部署实施 | 37% | 平台底座部署:底座平台高可用安装、参数填写(VIP、镜像仓库、平台访问地址、pod 上限 255、不勾选 devops/service mesh)。 ti-one-deploy 工具链:规划配置页面(index.html)、物料上传、初始化前检查、初始化、install 安装、QTA 验证。 CSP 分布式存储:控制台安装(HA / 非 HA)、集群创建、License 导入、存储池创建、元数据节点配置、白名单与配额。 应用部署:物料包组成(server.tar.gz / ems_image.tar.gz / helm_image.tar.gz)、解压、安装 helm 应用、安装 ppl/ems、应用启动。 License 申请:平台 License(.lic)、优图算法 License(/data/youtu/license/)、ASR 模型 License(mac 地址 / systeminfo / 机器码)。 模拟视频流:将视频上传到 /data/ti-platform/fake-camera/custom_videos/。 关键验证:巡检 + QTA(先巡检后 QTA)、kubectl get nodes 检查、QTA 生命周期1天过期后需重新部署。 |
平台工具 | 8% | ti-one-deploy 工具:使用步骤(解压 → 规划配置 → 生成配置 → 上传物料 → 初始化 → install)、配置文件(middleware.yaml 中间件、dfs.yaml 共享存储类型)、host 规划(部署节点1台 / 管理节点3台)。 巡检工具:通过 Ansible 自动检查每台机器状态并生成报告;支持单独检查 MySQL(--skip 跳过 CSP/GPU);包含 Python 与 Bash 脚本;需配置 hosts。 QTA 健康检查:自动获取 now.yaml 匹配用例 TAG;正常部署后已包含 QTA,生命周期1天;修改配置后需重新部署;测试报告路径 /data/ti-platform-fs/ti-qta/qta_log/。 TDSQL 对接:注意字符集设置(utf8mb4),创建 admin/tibase/tione/grafana 数据库用户。 |
平台运维 | 21% | 命名空间与组件:算法服务一般部署在 ns-1;应用服务在 ai-media;监控组件为 Prometheus + Grafana;Elasticsearch 健康度 yellow/red 需排查分片;Etcd 至少3节点保证高可用。 常用 K8s 命令:kubectl get pod/node/deploy、kubectl describe pod、kubectl logs、kubectl exec、kubectl edit deploy。 平台架构导航:六大能力模块(应用中心、应用编排、模型服务、数据中心、训练工坊除外 → 实际为应用中心、应用编排、模型服务、媒体资产管理、视频处理、智能标签 / 视频结构化 等);一级菜单(应用中心、边缘中心、管理中心,不含自动学习);应用访问路径 → 应用中心 → 应用工作台。 数据备份与恢复:ES / MySQL / ETCD 备份恢复四步法;MySQL 备份周期调整使用 kubectl edit sop -n velero ti-mysql-backup;日志默认保存7天。 常见故障:OOMKilled(检查内存)、ImagePullBackOff(检查镜像仓库)、CrashLoopBackOff(查看日志)、节点时间不同步(检查 NTP)、SSH 超时(检查防火墙)、服务异常(kubectl describe / logs 定位)。 端口与日志:业务日志落盘到 /var/log/containers/;53端口 DNS、6443端口 K8s API、53端口 DNS;查看 DNS 配置 /etc/resolv.conf;查看实时负载 uptime。 |