Loading...
Loading...
Generates and updates secure, production-ready Kubernetes YAML manifests optimized for GKE Autopilot and GKE Standard clusters. Use when creating or modifying GKE deployment manifests, configuring container security contexts, setting CPU/memory resource limits, defining readiness/liveness/startup probes, mounting secrets and volumes, configuring GKE Gateway API routes, targeting Spot VMs, or deploying AI model inference workloads (vLLM, TGI, Gemma). Don't use for live cluster operations, pod troubleshooting (use gke-workload-troubleshooting), or cluster infrastructure provisioning (use gke-cluster-creation).
npx skill4agent add google/skills gke-manifest-generationnamespace: {namespace}SETTINGS.mddefaultServiceAccountdevteam-agent-sarequests.cpu: "100m""200m"requests.memory: "256Mi""512Mi"limits.cpu: "400m""800m"limits.memory: "512Mi""1Gi"limits.cpu: "4"100m-test-dev-stagingnodeSelectornodeSelector:
cloud.google.com/gke-spot: "true"
tolerations:
- key: "cloud.google.com/gke-spot"
operator: "Equal"
value: "true"
effect: "NoSchedule"securityContextrunAsNonRoot: truerunAsUser: 10000runAsGroup: 10000fsGroup: 10000allowPrivilegeEscalation: falseseccompProfile: {type: RuntimeDefault}readOnlyRootFilesystem: truereadOnlyRootFilesystememptyDir/tmp/var/run/volumesdefaultMode: 0400livenessProbereadinessProbehttpGettcpSocketexecexec.command: ["redis-cli", "ping"]startupProbestartupProbestartupProbe:
httpGet:
path: /healthz
port: 8080
failureThreshold: 30
periodSeconds: 10initialDelaySeconds: 515type: ClusterIPtype: LoadBalancerNodePortname: http-webname: grpc-apiGatewayHTTPRouteIngressConfigMapSecretsubPathsubPathstandard-rwopremium-rwostandardpremiumstandard-rwopremium-rwopremium-rwopremiumpodAntiAffinitytopologySpreadConstraintstopologyKey: "kubernetes.io/hostname"PodDisruptionBudgetnamenamenamenvidia.com/gpurequestslimitsnodeSelectorcloud.google.com/gke-accelerator: nvidia-l4/dev/shmemptyDirmedium: Memory/dev/shmcsi.storage.gke.ioreadOnly: truegcloudgcloud container ai profiles manifests create \
--model={model_name} \
--model-server={server_name} \
--accelerator-type={accelerator_type} \
--output=manifest \
--output-path={output_file_path}answer_querysearch_documentsget_document/dev/shmGatewayHTTPRoute