认证概述
适用于从事腾讯云智能视频分析平台(SVAP)交付、运维、售前咨询及相关项目的工程师和技术人员。通过该认证,您将掌握 SVAP 平台的核心架构、部署交付流程、平台工具使用与日常运维方法,具备 SVAP 项目端到端交付与运维能力。
建议报名该认证的考生具备以下知识或经验:
3年以上 Linux 系统安装、配置、调优经验或者具有1年以上 RHCE 等级。
2年以上 Kubernetes / Docker 容器化平台的实际使用经验,熟悉 kubectl 等常用命令。
熟悉 MySQL 关系型数据库的配置与管理,了解 Prometheus + Grafana 监控体系,具备 Ansible、SaltStack 等自动化运维工具及 Shell 脚本编写能力。
基本信息
考试类型:理论考试。
考试形式:线下。
题型与题量:单选题40道、多选题20道。
通过/满分分数:70/100分。
考试时长:90分钟。
考试语言:简体中文。
其他注意事项:
1. 多选题错选、漏选不得分。
2. 考试报名和考试预约指引:报名和考试指引。
3. 成绩查询:考试结束后可通过腾讯云培训认证的 个人中心-认证考试 页面查看成绩,理论考试成绩3天内公布。
4. 该认证仅面向腾讯云合作伙伴开放报名和考试。
建议的学习资源
资源类型 | 资源地址 |
视频讲解 |
知识点占比与详细描述
知识点 | 比例 | 详细描述 |
产品部署准备 | 22% | 部署条件确认:硬件配置(CPU/内存/磁盘)、操作系统(CentOS 7.x 等)、共享存储选型(NAS / CSP)、TCS 底座 VIP 规划(高可用需4个 VIP:apiserver、7 层入口、2 个 4 层入口)。 部署方案设计与配置规划:ti-one-deploy 工具使用、主机配置/参数配置/服务配置/部署拓扑、TCS 底座安装(scaffold → install_config.yaml → tcs-core install)。 命名空间与项目资源:ns-1、timatrix、ti-base、ti-inf 等命名空间含义与业务/项目/资源分配。 GPU 资源:物理 GPU 选型、驱动要求、Nouveau 驱动禁用(dracut -f + reboot)、国产化芯片 ARM 架构需 ARM 安装包。 共享存储与高可用:高可用推荐 NAS、单机可本机搭建 NFS;TCS 单机版最低 1 节点,高可用最低 3 节点。 |
产品交付流程 | 12% | 部署前评审:第三方数据/告警对接、https 配置、Logo 与欢迎语变更、数据备份/清理周期等关键确认。 部署方案设计:硬件与容量调研、网络与存储调研、风险点识别。 交付实施 SOW:部署方案设计、测试与验收、定制化需求(第三方数据库对接、数据备份、大模型精调等)评估。 实施阶段工具:Helm、Ansible、巡检工具、QTA 自动化测试。 测试验收:依据《验收测试指南》和配套测试工具。 |
部署实施 | 37% | 平台底座部署:TCS 部署流程、磁盘要求、nokmem 内核参数、tcs-installer 启动。 ti-one-deploy 工具链:解压 → 规划配置(index.html)→ 生成配置 → 上传物料到 /data/ti-one-deploy/conf → 初始化前检查 → CSP 安装(可选)→ 初始化 → install 安装 → QTA 验证。 CSP 分布式存储:install-csp.sh + csp-install.py、License 导入、存储池创建、控制台 http://ip:8089(admin / Admin@TI123)。 应用部署:物料包组成(svap-helm-all + svap-image-all + ti-devops-tools)、ti-docker-run.sh、tcs.yaml 配置(svapApps 选择性安装)、svap-prepare.sh → helmfile apply。 License 申请:中心授权(TI 平台 + 应用授权)+ 绑定设备(SVAP 应用算法授权),放置目录 /data/youtu/license/。 ES 独占配置:节点打 label/taint(svapes=true:NoSchedule),timatrix.yaml 设置 svapes.exclusive: enable。 关键验证:先巡检后 QTA(顺序不能反);QTA 24h 过期后需重新部署;查看 ns-1 空间下 pod 状态。 |
平台工具 | 8% | ti-one-deploy 工具:使用步骤、配置文件(middleware.yaml / dfs.yaml / dockerhub.yaml / hadoop.yaml)。 巡检工具:通过 Ansible 自动检查每台机器状态并生成报告;部署完成后执行巡检。 QTA 健康检查:ti-qta 通过 helm-chart 部署 24h 后自动销毁的 pod;执行全量用例 python3 /data/TI20/qta/TiAutoTest/mul_ti_qta_manager.py;报告路径 csp 存储为 /mnt/unifiedcsi/.../ti-qta/qta_log。 高可用与单机版命令差异:-e tcs(高可用)vs -e tcs-single(单机)。 EMS 补丁包:修复 TI 3.7.1.1 + SVAP1.3 部署时 ems 数据库大小写敏感异常,通过 docker load + kubectl edit deploy 应用。 |
平台运维 | 21% | K8s 基础:Pod 默认重启策略 Always;kubectl get/describe/logs/exec/edit/scale 常用命令。 命名空间与组件:算法服务部署在 ns-1;监控组件 Prometheus + Grafana;ES 健康度 yellow/red 需排查分片;Etcd 至少 3 节点保证高可用。 平台架构:管理中心-平台运维页面使用的监控图表展示组件是 Grafana;查看 mysql 中所有数据库 show databases。 TDSQL 对接:字符集 utf8mb4、表名大小写敏感、用户创建及授权。 资源评估:使用应用资源评估工具;评估 GPU 卡数量时不需关注计算节点 CPU 数量。 常见故障:OOMKilled(检查内存)、ImagePullBackOff(检查镜像仓库)、CrashLoopBackOff(查看日志)、SSH 超时(检查防火墙)、节点时间不同步(检查 NTP)。 |