在Ubuntu 20.04上构建你的专属Kubernetes CKA v1.28实战沙盒
准备CKA认证考试,最怕的就是纸上谈兵。官方文档背得再熟,面对一个真实的、需要你动手去排错、去配置的Kubernetes集群时,感觉可能完全不同。很多朋友会选择直接购买现成的模拟环境或在线实验平台,这当然方便,但自己从零开始搭建一遍,这个过程本身就是一次无价的深度预习。今天,我们就抛开那些一键安装脚本,回归最本质的命令行,在Ubuntu 20.04上,亲手搭建一个与CKA v1.28考试环境高度一致的Kubernetes学习沙盒。这不仅是为了“模拟”,更是为了“理解”。
1. 环境准备与系统调优
在按下第一个安装命令前,花些时间把基础打牢,能避免后续80%的诡异问题。我们选择Ubuntu 20.04 LTS,因为它提供了良好的稳定性和广泛的社区支持,与考试推荐环境一致。
首先,确保你的系统是最新的。通过SSH连接到你的虚拟机或物理机,执行以下更新操作:
sudo apt update && sudo apt upgrade -y
更新完成后,建议重启系统以确保所有更新生效。接下来,我们需要进行一些关键的内核参数和系统配置调整,这是Kubernetes能够稳定运行的前提。编辑/etc/sysctl.d/kubernetes.conf文件:
sudo tee /etc/sysctl.d/kubernetes.conf <<EOF
net.bridge.bridge-nf-call-ip6tables = 1
net.bridge.bridge-nf-call-iptables = 1
net.ipv4.ip_forward = 1
EOF
注意:
net.ipv4.ip_forward = 1对于Pod网络通信至关重要,它允许Linux主机转发IP数据包。
加载这些新的内核参数:
sudo sysctl --system
然后,我们需要禁用交换空间(swap)。CKA考试环境以及生产集群通常都要求禁用swap,以确保kubelet正常工作。
sudo swapoff -a
sudo sed -i '/ swap / s/^\(.*\)$/#\1/g' /etc/fstab
第一行命令立即关闭swap,第二行则通过注释掉/etc/fstab中swap相关的行,使其在系统重启后也不会被启用。
容器运行时选择:Containerd 从Kubernetes 1.24开始,dockershim已被移除,我们需要直接安装containerd或CRI-O。这里我们选择containerd,它是目前最主流、也最被推荐的生产级容器运行时。
安装必要的依赖并添加Docker的GPG密钥和仓库(这里使用Docker仓库是因为它提供了稳定版本的containerd):
sudo apt-get install -y apt-transport-https ca-certificates curl software-properties-common
curl -fsSL https://download.docker.com/linux/ubuntu/gpg | sudo apt-key add -
sudo add-apt-repository "deb [arch=amd64] https://download.docker.com/linux/ubuntu $(lsb_release -cs) stable"
sudo apt-get update
现在安装containerd:
sudo apt-get install -y containerd.io
安装后,需要生成containerd的默认配置文件,并启用systemd作为cgroup驱动,这与kubelet的配置保持一致。
sudo mkdir -p /etc/containerd
containerd config default | sudo tee /etc/containerd/config.toml
sudo sed -i 's/SystemdCgroup = false/SystemdCgroup = true/' /etc/containerd/config.toml
sudo systemctl restart containerd
sudo systemctl enable containerd
至此,你的Ubuntu系统已经为迎接Kubernetes做好了准备。一个干净、优化过的基础操作系统,是构建一切复杂系统的基石。
2. 使用Kubeadm部署Kubernetes v1.28集群
Kubeadm是Kubernetes官方推荐的集群引导工具,它简化了安装流程,但并没有隐藏细节,非常适合学习和理解集群的组成。我们将部署一个单控制平面(Master)节点集群,这对于模拟练习来说完全足够。
安装kubeadm, kubelet和kubectl 首先,添加Kubernetes的APT仓库。请注意,我们这里锁定v1.28版本,以匹配CKA考试环境。
sudo curl -fsSLo /usr/share/keyrings/kubernetes-archive-keyring.gpg https://packages.cloud.google.com/apt/doc/apt-key.gpg
echo "deb [signed-by=/usr/share/keyrings/kubernetes-archive-keyring.gpg] https://apt.kubernetes.io/ kubernetes-xenial main" | sudo tee /etc/apt/sources.list.d/kubernetes.list
sudo apt-get update
安装指定版本的组件:
sudo apt-get install -y kubelet=1.28.0-00 kubeadm=1.28.0-00 kubectl=1.28.0-00
sudo apt-mark hold kubelet kubeadm kubectl
apt-mark hold命令用于防止这些软件包被意外升级,保持环境的一致性。
初始化控制平面节点
这是最关键的一步。我们需要运行kubeadm init。这里有几个参数需要特别关注:
--pod-network-cidr: 指定Pod网络的IP地址段,我们使用Calico网络插件的默认网段。--cri-socket: 指定容器运行时接口(CRI)的socket路径,因为我们用的是containerd。--control-plane-endpoint: 如果是单节点,可以省略;如果是高可用集群,则需要指定负载均衡器的地址。
执行初始化命令:
sudo kubeadm init --pod-network-cidr=192.168.0.0/16 --cri-socket=unix:///var/run/containerd/containerd.sock --upload-certs
这个过程可能需要几分钟,它会拉取所需的镜像、生成各种证书和密钥。如果一切顺利,你会在命令输出的最后看到类似这样的成功信息,以及加入集群的指令(先保存下来,虽然我们目前是单节点)。
为了让当前用户能使用kubectl(无需sudo),需要执行以下操作:
mkdir -p $HOME/.kube
sudo cp -i /etc/kubernetes/admin.conf $HOME/.kube/config
sudo chown $(id -u):$(id -g) $HOME/.kube/config
现在,检查集群节点状态,你会看到控制平面节点处于NotReady状态,这是因为网络插件(CNI)尚未安装。
kubectl get nodes
安装Calico网络插件 Pod之间要能通信,必须安装CNI网络插件。Calico功能强大且文档完善,是很多人的选择。使用以下命令安装其Tigera Calico operator:
kubectl create -f https://raw.githubusercontent.com/projectcalico/calico/v3.26.4/manifests/tigera-operator.yaml
接着,安装Calico的自定义资源定义(CRD)和实例。你需要一个配置文件,我们创建一个简单的custom-resources.yaml:
cat > custom-resources.yaml <<EOF
apiVersion: operator.tigera.io/v1
kind: Installation
metadata:
name: default
spec:
calicoNetwork:
ipPools:
- blockSize: 26
cidr: 192.168.0.0/16
encapsulation: VXLANCrossSubnet
natOutgoing: Enabled
nodeSelector: all()
EOF
kubectl create -f custom-resources.yaml
等待几分钟,让Calico的Pod全部运行起来。你可以用watch kubectl get pods -n calico-system来观察进度。当Calico就绪后,再次检查节点状态,应该会显示Ready。
kubectl get nodes -o wide
至此,一个功能完整的Kubernetes v1.28单节点集群已经在你的Ubuntu 20.04上运行起来了。这个集群具备了所有核心组件:API Server、Controller Manager、Scheduler、etcd、kube-proxy,以及Calico网络。
3. 模拟环境的核心:题库集成与练习方法
有了集群,接下来就是如何高效地用它来练习CKA考题。单纯的“做题”和“在真实集群上做题”有天壤之别。我们的目标是搭建一个可以反复练习、并自带题目上下文的环境。
思路:利用命名空间进行环境隔离
我们不建议直接在default命名空间里胡乱操作。更好的做法是为每一道题或每一类题创建一个独立的命名空间(Namespace)。这样,你可以随时清理一个命名空间来重置该题目的环境,而不会影响其他题目或系统组件。
例如,针对“配置应用健康检查”的题目,可以这样做:
# 创建一个用于健康检查练习的命名空间
kubectl create ns healthcheck-practice
# 在此命名空间下部署一个用于练习的Nginx应用
kubectl -n healthcheck-practice create deployment nginx --image=nginx:1.21
# 然后,在这个隔离的环境里,练习添加livenessProbe和readinessProbe
如何“导入”题库? 所谓的“题库集成”,并不是有一个魔法按钮能把题目变到集群里。它指的是你有一套结构化的练习方案。我推荐的方法是:
-
题目归档:将收集到的CKA v1.28题目(通常是YAML任务描述)保存到本地一个目录,例如
~/cka-practice/,并按知识点分类。~/cka-practice/ ├── 01-cluster-architecture/ │ ├── task1-etcd-backup.md │ └── task2-rolebinding.yaml ├── 02-workloads/ │ ├── task1-rolling-update.md │ └── task2-configmap-secret.md └── ... -
环境初始化脚本:为每道题或每个章节编写一个Bash脚本(例如
init-task1.sh)。这个脚本负责创建命名空间、部署题目所需的初始资源(比如一个待修复的Deployment、一个需要配置的Service等)。#!/bin/bash # init-task1.sh - 初始化“多容器Pod定义”练习环境 set -e NAMESPACE="multi-container-practice" kubectl create ns $NAMESPACE 2>/dev/null || true # 部署一个只有单个容器的Pod,题目要求改为多容器 kubectl -n $NAMESPACE run app --image=busybox --command -- sleep 3600 echo “练习环境已就绪。请在命名空间 '$NAMESPACE' 中,将Pod 'app' 修改为包含 'busybox' 和 'nginx' 两个容器的Pod。” -
环境清理脚本:对应的,编写一个
clean-task1.sh,用于删除该命名空间,一键重置环境。#!/bin/bash kubectl delete ns multi-container-practice
通过这种方式,你构建的不仅仅是一个Kubernetes集群,而是一个可重复、可管理、高度模拟考试场景的练习平台。你可以随时切换到任何一道题目的初始状态,从头开始操作。
练习时的黄金法则
- 限时操作:CKA考试时间紧张。练习时,给自己设定严格的时间限制(例如,一道题10-15分钟),培养时间感。
- 善用
kubectl快捷命令:kubectl explain: 这是你最好的朋友。忘记某个字段的含义?立刻kubectl explain pod.spec.containers.livenessProbe。alias k=kubectl: 节省大量敲击时间。kubectl -n <namespace> get all: 快速查看某个命名空间下的所有资源概览。
- 使用
dry-run和-o yaml --dry-run=client:在创建资源时,先导出YAML模板进行修改,而不是尝试记忆所有字段。kubectl create deployment myapp --image=nginx --dry-run=client -o yaml > deployment.yaml vi deployment.yaml # 编辑YAML文件,添加策略、探针等 kubectl apply -f deployment.yaml
4. 针对考纲重点的专项实战演练
CKA考试大纲明确划分了权重。我们需要在自建环境中,针对高分值区域进行强化训练。下面我们挑两个重点领域,进行深度实操解析。
故障排除(权重30%) 这是考试的“大头”,也是最考验实战能力的部分。故障可能出现在集群层、节点层、Pod层或应用层。
-
场景一:Pod一直处于Pending状态 这是经典问题。首先查看Pod的描述信息,错误信息通常就在这里。
kubectl describe pod <pod-name> -n <namespace>常见原因和解决思路可以总结如下表:
可能原因 描述信息中的线索 排查与解决命令 资源不足 Insufficient cpu/memorykubectl describe nodes查看节点资源分配情况节点Selector不匹配 node(s) didn‘t match Pod‘s node selector检查Pod的 nodeSelector或nodeAffinity配置污点(Taint)容忍 node(s) had taint {key:value}, that the pod didn‘t toleratekubectl describe node <node-name>查看污点,为Pod添加对应的tolerationsPV绑定失败 waiting for a volume to be created检查PersistentVolumeClaim(PVC)的状态 kubectl get pvc -
场景二:Pod处于CrashLoopBackOff状态 这意味着容器启动后立即崩溃。排查步骤:
- 查看日志:
kubectl logs <pod-name> -n <namespace>。如果Pod内有多个容器,用-c <container-name>指定。 - 查看前一个容器的日志(如果当前容器无法启动):
kubectl logs <pod-name> --previous。 - 进入调试模式:如果日志不清晰,可以尝试修改Pod命令,让它保持运行以便进入检查。例如,将原启动命令替换为
sleep 3600,然后kubectl exec进入容器内部,手动执行原命令并观察输出。
- 查看日志:
集群架构、安装与配置(权重25%) 这部分考察你对Kubernetes核心组件的理解和管理能力。
-
实战:使用Kubeadm升级集群 假设我们要将集群从v1.28.0升级到v1.28.3。
- 首先,在所有节点上升级
kubeadm工具本身。sudo apt-get update sudo apt-get install -y kubeadm=1.28.3-00 kubeadm version - 在控制平面节点上,规划升级。
这个命令会告诉你可用的升级版本和具体步骤。sudo kubeadm upgrade plan - 执行升级。务必按照
kubeadm upgrade plan输出的指令操作,通常类似:sudo kubeadm upgrade apply v1.28.3 - 升级控制平面组件后,腾空(drain)节点,升级kubelet(如果需要,先升级
kubectl)。kubectl drain <control-plane-node-name> --ignore-daemonsets sudo apt-get install -y kubelet=1.28.3-00 kubectl=1.28.3-00 sudo systemctl daemon-reload sudo systemctl restart kubelet kubectl uncordon <control-plane-node-name> - 对工作节点(如果有)重复类似过程(使用
kubeadm upgrade node)。
- 首先,在所有节点上升级
-
实战:etcd备份与恢复 etcd存储着集群的所有状态,其备份是灾难恢复的基石。由于我们是用Kubeadm安装的,etcd以静态Pod形式运行。
- 备份:找到etcd Pod的清单文件,获取其证书和端点信息进行备份。
# 查找etcd证书路径(通常在/etc/kubernetes/pki/etcd/) sudo find /etc/kubernetes/pki/etcd -name "*.crt" -o -name "*.key" # 执行备份(假设我们备份到/home目录) sudo ETCDCTL_API=3 etcdctl \ --endpoints=https://127.0.0.1:2379 \ --cacert=/etc/kubernetes/pki/etcd/ca.crt \ --cert=/etc/kubernetes/pki/etcd/server.crt \ --key=/etc/kubernetes/pki/etcd/server.key \ snapshot save /home/etcd-snapshot-$(date +%Y%m%d).db - 恢复:这是一个破坏性操作,务必在测试环境练习。恢复需要先停止kube-apiserver,然后使用
etcdctl snapshot restore命令,并替换现有的etcd数据目录,最后重启etcd和kube-apiserver。具体步骤较为复杂,强烈建议参考官方文档并在你的模拟环境中完整演练一遍。
- 备份:找到etcd Pod的清单文件,获取其证书和端点信息进行备份。
5. 高效备考策略与资源利用
搭建环境是第一步,如何用它进行有效练习则是成功的另一半。结合我通过认证的经验,分享几个关键策略。
模拟考试,创造真实感 每周安排1-2次完整的模拟考试。找一份可靠的、按真实考试时长(通常3小时)设计的模拟题集。
- 环境准备:在模拟开始前,用快照功能保存你的Ubuntu虚拟机状态,或者运行你的“环境清理脚本”,确保从一个干净、标准的集群开始。
- 严格计时:使用计时器,中间不休息,不查阅外部资料(除了官方文档
kubernetes.io/docs和kubernetes.io/blog,这是考试允许的)。 - 过程复盘:结束后,不仅核对答案,更要复盘:哪道题超时了?为什么?是命令不熟,还是思路不清?把卡壳的地方记下来,回到自建环境中针对性练习。
深度利用官方文档 考试时能访问的只有官方文档。平时练习就要强迫自己习惯用它。
- 书签管理:在浏览器中精心组织书签文件夹。例如:
- 核心概念:Pod、Deployment、Service、ConfigMap、Secret、Volume的API参考页。
- 任务指南:
kubectl备忘单、配置Pod的liveness probe、使用ConfigMap配置容器、管理Deployment的滚动更新等实践页面。 - 工具参考:
kubectl命令参考、Kubeadm文档。
- 搜索技巧:在文档站内,直接使用关键词搜索比导航更快。例如,遇到“Static Pod”相关题目,直接在文档搜索“static pod”,通常第一个结果就是你要的。
构建你的命令“肌肉记忆” 考试是实操,速度至关重要。以下命令组合应该达到“不假思索”的程度:
- 资源管理:
kubectl get/describe/edit/delete/logs/exec -n <ns> <resource>/<name> - YAML操作:
kubectl run/creat -o yaml --dry-run=client > file.yaml和kubectl apply -f file.yaml - 故障排查:
kubectl describe ...,kubectl logs ...,kubectl get events --sort-by=.metadata.creationTimestamp - 上下文切换:
kubectl config use-context <context-name>(考试中经常需要在多个集群/命名空间间切换)
最后,记住这个自己搭建的环境最大的优势:你可以放心地“搞破坏”。故意删除一个CoreDNS Pod,看看服务发现如何中断;手动停止kubelet服务,观察节点状态变化;错误配置一个NetworkPolicy,体验网络隔离的效果。这种主动探索带来的理解深度,是任何被动阅读都无法比拟的。当你能从容地修复自己制造的各种“故障”时,通过CKA考试就只是水到渠成的一个结果了。
&spm=1001.2101.3001.5002&articleId=149830378&d=1&t=3&u=f59bfb9e0b5a4d5392a63c26307bc0e8)
1235

被折叠的 条评论
为什么被折叠?



