尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

云计算 10 大岗位全景地图

云计算 10 大岗位全景地图 文章目录一、云计算 10 大岗位全景地图二、五级成长路径年限 × 能力 × 薪资三、四大热门岗位技能雷达对比四、岗位选择指南如何挑方向五、面试题分档基础 / 进阶 / 高级▌基础篇0-2 年—— 考概念、原理认知、操作熟练度▌进阶篇3-5 年—— 考设计能力、问题排查、原理深度▌高级篇5 年—— 考系统设计、技术战略、跨域权衡六、给求职者的 3 条建议我来给你梳理一份系统化的云计算职业全景画像与成长路径指南同时配上可视化图表和分级面试题。先加载可视化模块。下面分三步呈现① 云计算岗位全景图10 大方向分四大类② 五级成长路径图③ 各岗位核心技能雷达对比之后给出基础 / 进阶 / 高级三档面试题。一、云计算 10 大岗位全景地图二、五级成长路径年限 × 能力 × 薪资三、四大热门岗位技能雷达对比四、岗位选择指南如何挑方向你适合的方向性格 / 偏好信号典型画像研发架构云原生架构师 / 平台 SDE / AI MLOps爱写代码、追求技术深度、对系统如何运转着迷计算机科班、Go/Java/Python 熟练、K8s 源码阅读者运维可靠性云运维 / SRE / DBA SRE喜欢稳定运行、对故障零容忍、能 7×24 On-call强 Linux / 网络基础、冷静、流程化思维安全 / 成本云安全 / FinOps偏谨慎、对数字敏感、爱抠细节合规背景 / 财务背景跨界者越来越多业务售前SA / 云产品经理沟通强、爱讲故事、能 hold 住客户工程师转管理 / 管理转技术者居多一句话“你是更想造系统还是更想保系统还是更想让客户用好系统”想清楚这个选方向就不纠结了。五、面试题分档基础 / 进阶 / 高级每档列出核心题、答题要点用 标注适合 0-2 年 / 3-5 年 / 5 年 三档候选人。▌基础篇0-2 年—— 考概念、原理认知、操作熟练度1. 公有云、私有云、混合云的区别企业怎么选 三层回答定义 → 优缺点对比 → 选型维度合规、成本、弹性、运维能力。结论金融/政府偏私有云混合云互联网创业直接公有云。2. IaaS / PaaS / SaaS 的区别再举 5 个你没提到的云服务模型。 IaaSEC2、阿里云 ECS 你管操作系统以上PaaSK8s、RDS、函数计算 你管应用和数据SaaS钉钉、Salesforce 拿来就用。补充 FaaSServerless 函数、CaaS容器即服务、DaaS数据即服务、DBaaS、SECaaS。3. 虚拟化的三种主要技术容器和虚拟机的本质区别 裸金属虚拟化、寄居虚拟化Type 1 / Type 2、操作系统级虚拟化容器。VM 隔离强但重GB 级、分钟级启动容器共享内核MB 级、秒级启动。4. 简述 Kubernetes 核心组件。 控制面API Server、etcd、Scheduler、Controller Manager。数据面kubelet、kube-proxy、容器运行时containerd/CRI-O。一张图kubectl → API Server → etccd → Scheduler → kubelet。5. Pod、Deployment、StatefulSet 的关系 Pod 是最小调度单位Deployment 管无状态副本集ReplicaSet 的封装StatefulSet 给有状态服务稳定网络标识 PVC 有序启停。6. Service 有几种类型ClusterIP / NodePort / LoadBalancer / ExternalName 的差异 ClusterIP 集群内NodePort 每节点开端口30000-32767LoadBalancer 由云厂商提供ExternalName 用 CNAME 别名。7. 简述 VPC、子网、安全组、NAT 的层次关系。 VPC租户级网络→ 子网可用区级网段→ 路由表 → 安全组实例级有状态防火墙→ NAT公网出口。8. 块存储、文件存储、对象存储的典型场景 块云盘、EBS 数据库 / OS文件NAS、EFS 共享目录 / CMS对象OSS、S3 图片、日志、备份、海量非结构化。9. SLB / ELB 的工作原理L4 和 L7 的区别 L4 基于 IP端口做 NAT/负载均衡L7 基于 URL/Header/内容ALB。L4 性能高L7 灵活可做灰度。10. 什么是 CDN回源、缓存、命中率怎么理解 边缘节点缓存静态资源未命中时回源拉取命中率越高用户体验越好、成本越低。11. IAM 的最小权限原则怎么落地 用户 → 角色 → 策略Policy策略用 JSON 描述 Allow/Deny Resource Condition按业务/项目/环境拆分角色定期 IAM Access Analyzer 巡检。12. 蓝绿部署、金丝雀发布、滚动更新的区别 蓝绿两套环境瞬间切换金丝雀1%→5%→20% 渐进放量滚动批次替换。三者权衡风险、回滚速度、资源利用率。13. 简述 GitOps 的核心思想。 Git 是唯一事实源任何环境变更都通过 PR 触发ArgoCD / Flux 持续同步。优势可审计、可回滚、自愈。14. 解释 CAP 定理在云上怎么选 一致性 / 可用性 / 分区容错必三选二云上多数系统是 AP最终一致少数强一致场景选 CP如分布式锁、Zookeeper。15. CPU 密集型和 IO 密集型 Pod 在 K8s 上调度要注意什么 用 nodeSelector / taints-tolerations / affinity 区分CPU 密集型要独占核独占 CPU Manager policyIO 密集型要选 NVMe / 本地盘。▌进阶篇3-5 年—— 考设计能力、问题排查、原理深度1. kube-scheduler 的两阶段调度流程 1Predicates过滤节点能否满足资源/亲和性/污点2Priorities打分资源均衡/亲和性权重/镜像本地化等。加分点能讲清楚 Scheduling Framework 的扩展点PreFilter、PostFilter、Reserve、Permit 等。2. K8s 三种 Service 代理模式iptables / IPVS / userspace的性能差异 iptables 是 O(n) 链式匹配规则上千性能下降IPVS 是 O(1) 哈希 内核负载均衡userspace 已废弃。生产 1000 Service 用 IPVS。3. CNI 插件 Flannel 和 Calico 的差异何时选哪个 Flannel 简单 VXLAN零网络策略Calico 支持 NetworkPolicy、BGP 模式性能更强。需细粒度网络安全选 Calico纯 overlay 简化选 Flannel。4. StatefulSet 如何实现稳定的网络身份 Pod 名 序号组成 hostnameHeadless Service 把 DNS 解析到 Pod IPPVC 模板保证存储稳定绑定。常见误区PVC 不会自动删除要看 retentionPolicy。5. HPA、VPA、Cluster Autoscaler 的关系 HPA 水平扩 Pod 副本VPA 垂直扩 Pod 资源CA 扩节点。三者配合才能端到端弹性。加分点能讲出 KEDA事件驱动、HPA 自定义 metricsPrometheus Adapter。6. Helm Chart 的核心概念模板渲染时常见坑 Chart 包Release 实例Values 配置Repository 仓库。坑值覆盖优先级命令 values 默认、资源引用 {{ .Values.x | default … }}、命名空间漂移。7. Service MeshIstio的控制面和数据面Sidecar 注入原理 数据面 Envoy拦截进出流量控制面 Pilot配置下发、Citadel证书、Galley配置校验、Istiod合并组件。注入方式istioctl/inject webhook mutating。8. 设计一个 4 个 999.99%可用性的云上架构关键点 多 AZ 部署 数据库主从 健康检查 自动 failover 限流降级。每月允许停机 4 分钟要按故障域思考而不是实例。9. RDS 主从复制原理读写分离的实现方式 MySQL binlog 主从读写分离用 ProxySQL / MaxScale / Atlas / 云厂商读写分离地址。注意复制延迟下读后写一致性问题。10. Kafka 的 ISR、HW、LEO 是什么怎么保证不丢消息 ISR 与 Leader 同步的副本集HW 已复制偏移LEO 日志末端偏移。acksall min.insync.replicas 幂等生产者 事务保证。11. Terraform state 如何管理为什么不能用本地 state State 记录资源与代码映射。本地 state 团队协作会冲突、丢失。推荐 S3 / OSS DynamoDB / 阿里云 OTS 做 lock用 terraform cloud 或 Atlantis 做 CI 化。12. 排查 Pod 一直 CrashLoopBackOff 的步骤 kubectl describe pod 看 Events → kubectl logs --previous 看上次容器日志 → 检查 liveness/readiness 探针 → 资源 limit/OOM → 启动命令/配置错误 → 镜像拉取失败。加分用 kubectl debug / ephemeral containers 进入 Pod 排查。13. 客户端到 K8s Service 的全链路网络路径 客户端 → 公网/专线 → SLB → NodePort/NodeIP → iptables/IPVS DNAT → kube-proxy → Pod IP。性能瓶颈常在 SLB 与 iptables。14. CI/CD 流水线的关键阶段灰度发布如何在流水线中落地 代码 → 静态扫描 → 单元测试 → 构建镜像 → 安全扫描 → 推送镜像 → 部署 dev → 自动化测试 → 部署 staging → 灰度金丝雀 1% → 50% → 100%→ 生产。加分Argo Rollouts / Flagger 做自动化灰度。15. 微服务拆分的边界判断什么时候不该拆 业务域边界DDD 限界上下文 团队规模“两个披萨团队” 独立部署 独立伸缩。单体先行10 人以下、初创期、领域未稳定。不要为拆而拆。16. 分布式追踪Jaeger / SkyWalking的原理 traceId 串联spanId 父子关系context propagationHTTP header W3C traceparent。采样策略尾部采样降低存储成本。17. 配置中心Nacos / Apollo的核心能力 配置管理KV 灰度 版本 服务发现健康检查 推送长连接/Polling。生产经验配置变更走审批流 灰度推送 回滚。18. 云上成本优化的十大手段 1资源利用率提升2RI/SP 预留实例3Spot 抢占式4存储分层5快照生命周期6闲置资源回收7架构 serverless 化8多云比价9架构合理选型10建立 FinOps 治理机制。19. Kubernetes 的 Pod 安全标准Pod Security Standards Privileged无限制/ Baseline防提权/ Restricted最严格。生产推荐从 Baseline 起步关键 namespace 用 Restricted。20. 一次 OOM 故障排查全流程 dmesg 看 cgroup OOM → kubelet 日志 → container_memory.limit → jvm heap / Go runtime / native memory → 应用代码 → 上下游资源放大效应。▌高级篇5 年—— 考系统设计、技术战略、跨域权衡1. 设计一个支撑千万 QPS 的云原生系统从 DNS 到 DB 全链路。 答题框架流量入口Anycast DNS CDN WAF→ 边缘七层 LB→ 接入Envoy/Istio 限流→ 业务分库分表 多级缓存→ 数据读写分离 分布式 DB→ 异步MQ 削峰→ 可观测Metrics/Logs/Traces。重点不是堆组件而是讲清楚为什么、瓶颈在哪、怎么演进。2. 大规模 K8s 集群5000 节点的运维挑战 etcd 拆分、Federation/Karmada 多集群、CNI 性能eBPF/Cilium、调度器扩展、镜像分发Dragonfly/P2P、节点自动化巡检、可观测性降采样。3. 多集群管理方案对比Karmada / Cluster API / Rancher / Open Cluster Management Karmada 国产开源国内大厂应用多Cluster API 声明式管理集群生命周期Rancher 易用但侵入性强OCM 多云中立。选型看团队规模、跨云需求、GitOps 倾向。4. Serverless 平台架构设计冷启动怎么解 预留实例 镜像预热 容器池 进程级缓存 语言运行时优化V8 snapshot / JVM CDS。冷启动 vs 热启动的 SLA 分级。5. 云上数据一致性方案 强一致分布式事务Seata/TCC/Saga、Paxos/RaftTiDB/PolarDB。最终一致消息队列异步、CDC 同步、读写 WAL。讲清场景再选方案。6. 异地多活架构设计的关键决策 流量分配DNS/GSLB 数据同步双向 CDC / 单元化 冲突解决时间戳 / 版本向量 / CRDT 业务容忍度分级。先双活后多活先只读后读写。7. 云原生数据库TiDB / PolarDB的设计哲学 计算存储分离 水平扩展 Raft 多副本 HTAPTiDB/ 共享存储PolarDB。权衡延迟 vs 弹性 vs 一致性。8. 可观测性体系如何统一设计 MetricsPrometheus / VictoriaMetrics LogsLoki / ELK TracesJaeger / Tempo eBPFTetragon / Pixie。统一用 OpenTelemetry 收数据Grafana 做面板。SLO 驱动告警优于阈值告警。9. 混沌工程的实施方法论 原则从小爆炸半径开始、自动化、可停止。工具Chaos Mesh / Litmus / Gremlin。流程稳态定义 → 假设 → 实验 → 学习 → 改进。要让故障演练常态化。10. FinOps 体系如何从 0 到 1 搭建 三阶段Inform成本可视化→ Optimize资源优化→ Operate流程化运营。组织上建立 FinOps 团队/虚拟组织技术上做标签治理、预算告警、Showback/Chargeback、文化上让业务方承担成本。11. 云上合规体系等保 / SOC2 / GDPR / ISO27001落地路径 差距分析 → 控制项落地IAM / 加密 / 日志 / 漏洞管理 / 备份→ 内部审计 → 第三方审计。技术上常用 Landing Zone多账号/多订阅做隔离。12. 边缘计算与云的协同架构 边缘节点轻量化K3s / OpenYurt / KubeEdge云端统一编排、边缘本地自治边缘网络5G MEC 边缘 AI 推理。云边端三层协同。13. AI Infra 在云上的设计重点 GPU 共享MIG / vGPU / MPS 调度Volcano / KubeRay 推理服务vLLM / Triton 向量检索Milvus / Qdrant 训练数据湖Iceberg / Delta。重点讲 GPU 利用率与成本。14. 大规模 K8s 集群中 etcd 瓶颈与解法 etcd 限制单集群建议 ≤ 10K 节点、≤ 100K Pod。原因每次写都广播、序列化、刷盘。解法拆 etcd、按业务域拆集群、用 CRD 分流、用 apiserver cache。15. 组织级 DevOps 转型的路径 1先树立标杆团队2平台化内部 DevOps 平台3度量体系部署频率 / 变更前置时间 / 变更失败率 / MTTR - DORA4推广到全员5文化变革Blame-free。避免一刀切。16. 多云选型方法论 维度业务连续性、成本、地域覆盖、生态绑定、迁移成本、合规、厂商锁定风险。实战经验核心系统单云深度优化边缘业务多云容灾谈判筹码。17. 技术债务治理的实操方法 1识别SonarQube / 代码评审 / 架构审计2量化圈复杂度、重复率、依赖陈旧度3分摊每个迭代预留 15-20% 时间还债4治理架构守护、卡点审查5文化让做正确的事比做完就行被奖励。18. 如何权衡成本、性能、可维护性 没有银弹要让架构决策被显性记录ADR 架构决策记录。不同阶段取舍不同初创期重速度与成本成长期重扩展性成熟期重稳定与可维护性。19. 跨云容灾方案设计 三级备份级RPO 小时级、温备级RPO 分钟级、多活级RPO 秒级。技术冷备镜像 DNS 切换 / 热备双写 流量切换 / 双活单元化架构。20. 你对未来 3-5 年云计算趋势的判断 候选趋势任选 3 个展开① Serverless AI 一体化② WebAssembly 在边缘的爆发③ eBPF 重塑可观测与安全④ FinOps 成为 CFO 视角的标配⑤ GPU 即基础设施⑥ 多云 中立工具链兴起⑦ AI Agent 改变运维方式。讲趋势时一定结合具体落地场景。六、给求职者的 3 条建议认证是敲门砖能力才是天花板。一线认证CKA / AWS SAA / Azure AZ-305首年拿下 1-2 张即可别陷进考证循环。挑业务胜过挑公司。同样的岗位在做双 11、在做出海 SaaS、在做金融合规3 年后差距巨大。技术深度 × 业务宽度 议价权。前 3 年打深 1-2 个技术栈建议 K8s 一种云后 3 年补业务理解与跨栈视野。
返回列表