程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
Kubernetes 相关技术文章
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
In-Place Pod Resize:v1.33 默认开启后,如何不重建 Pod 调整 CPU/内存
编程
In-Place Pod Resize:v1.33 默认开启后,如何不重建 Pod 调整 CPU/内存
2026-10-08 00:03:55
KEP-1287 的 In-Place Pod Resize 在 v1.33 默认开启:本文讲清 /resize 子资源、期望值 vs 实际值字段、resizePolicy 两档策略、PodResizePending/InProgress 条件、内存 limit 禁止下调、Pod 级聚合资源校验,以及 containerd/cgroup/Windows 等已知限制与排障对照。
In-Place
Pod
Resize
InPlacePodVerticalScaling
Kubernetes
K8s
资源调整
容器资源
运维
KEP-1287
Kubernetes v1.35:cgroup v1 节点 kubelet 不再启动,containerd 1.x 走到最后一版
综合
Kubernetes v1.35:cgroup v1 节点 kubelet 不再启动,containerd 1.x 走到最后一版
2026-10-04 21:02:38
Kubernetes v1.35 起 kubelet 默认在 cgroup v1 节点上拒绝启动(可用 failCgroupV1: false 过渡),v1.35 是最后一个支持 containerd 1.x 的版本,kube-proxy ipvs 被弃用、--pod-infra-container-image 被移除,Ingress NGINX 维护到 2026 年 3 月后归档。本文按集群侧动手顺序整理。
Kubernetes
容器
运维
cgroup
OpenTelemetry Collector 配置:组件都写了,为什么还是没生效
编程
OpenTelemetry Collector 配置:组件都写了,为什么还是没生效
2026-10-02 00:03:55
写了 receivers/processors 却不生效、validate 也过不了?多数是组件没挂到 service.pipelines。梳理 Collector 的配置模型:配了≠启用、type[/name] 复用、处理器顺序、多管道实例隔离、fanoutconsumer 复制语义,以及 K8s Helm Chart 的 mode 必填与 presets 重复取数、日志爆炸循环等坑。
OpenTelemetry
Collector
可观测性
运维
分布式追踪
遥测
Kubernetes
K8s v1.36:externalIPs 进入三阶段弃用,gitRepo 卷已永久禁用
综合
K8s v1.36:externalIPs 进入三阶段弃用,gitRepo 卷已永久禁用
2026-09-29 21:02:08
Kubernetes v1.36 的重点是清理历史包袱:Service 的 .spec.externalIPs 进入弃用,并给出 v1.36 警告、最早 v1.40 禁用、最早 v1.43 完全移除的三阶段时间表;gitRepo 卷驱动被永久禁用、不可再启用。本文把升级前要处理的项按影响面排开,并给出 LoadBalancer/NodePort/Gateway API 替代方案与 init 容器迁移路径。
Kubernetes
k8s1.36
externalIPs
gitRepo
运维
集群升级
containerd 1.7 EOL 与 K8s 1.35 cgroup v1 硬失败
综合
containerd 1.7 EOL 与 K8s 1.35 cgroup v1 硬失败
2026-09-27 21:03:10
containerd 1.7 于 2026-09-01 EOL,Kubernetes 1.35 的 failCgroupV1 默认 true,会让只有 cgroup v1 的节点上 kubelet 拒绝启动,且 1.35 是最后一个支持 containerd 1.x 的版本。本文把运行时支持矩阵、指标 kubelet_cri_losing_support 与升级动作排成一次审计。
Kubernetes
containerd
K8s
1.35
cgroup
v2
运维
Kubernetes ingress 六小时 502:default_server 挂在一个被健康检查清空的 upstream 上
案例
Kubernetes ingress 六小时 502:default_server 挂在一个被健康检查清空的 upstream 上
2026-09-26 21:06:20
一次 Kubernetes ingress 六小时 502:后端 Deployment 全挂,nginx 健康检查把 upstream 池清空,而该池是 80/443 的 default_server,所有未匹配域名一起 502。本文复盘错误日志、fall=5 清池过程,以及超时、max_fails、DNS upstream、keepalive 的一组修复。
运维
nginx
Kubernetes
故障复盘
高可用
MCP Mesh 的 A2A 桥接:协议只给信封,注册、故障转移和 DDDI 由 mesh 补
编程
MCP Mesh 的 A2A 桥接:协议只给信封,注册、故障转移和 DDDI 由 mesh 补
2026-09-24 00:04:41
A2A v1.0 只定义了 HTTP+JSON-RPC 信封,能力发现按 card,没有 resolver、failover 和依赖注入。本文用 MCP Mesh(Python/Java/TypeScript)说明 mesh 层补了什么:/.well-known/agent.json 自动生成、tag+能力故障转移、orphan-reset 健康重连、DDDI 与长任务 JobController,并给出 producer/consumer 双向代码、meshctl 与边界(仅 bearer、每 card 一个 skill)。
agent
mesh
MCP
Mesh
A2A
智能体网格
多智能体
DDDI
Kubernetes
containerd 2.0/2.1 变更清单与升级前检查:NRI、CDI 默认启用,废弃 API 命中会中断升级
综合
containerd 2.0/2.1 变更清单与升级前检查:NRI、CDI 默认启用,废弃 API 命中会中断升级
2026-09-22 21:04:43
containerd 2.0/2.1 把 NRI、CDI 默认打开,移除 CRI v1alpha2、AUFS snapshotter、io_uring 权限,Docker Schema 1 镜像默认禁用。本文给出 ctr deprecations list 等升级前检查命令,以及 shim-v3 不可回退的注意事项。
containerd
Kubernetes
容器运行时
运维
UCP 上线前要算清:3 节点、2 个 /16 预留网段、最低 10 Gbps 集群互联
编程
UCP 上线前要算清:3 节点、2 个 /16 预留网段、最低 10 Gbps 集群互联
2026-09-22 00:04:19
Extreme Networks Universal Compute Platform 是本地部署的 Kubernetes/Docker CaaS 平台。本文按官方文档梳理上线前必须算清的硬约束:3 节点、2 个 /16 预留网段、集群互联最低 10 Gbps、VRRP+NGINX 高可用,以及引擎安装、备份升级与管理 API 的实操要点。
Universal
Compute
通用计算
容器编排
Kubernetes
私有云
CaaS
运维
Cursor Self-Hosted Machines 企业部署:执行在内网,推理和 Agent Loop 仍在 Cursor 云端
资讯
Cursor Self-Hosted Machines 企业部署:执行在内网,推理和 Agent Loop 仍在 Cursor 云端
2026-09-20 21:31:35
Cursor 2026 年 9 月推出 Self-Hosted Machines,把 Agent 的文件编辑、Shell、Build、MCP 执行迁到企业自有服务器。本文讲清它的真实数据边界:执行留在内网,但推理与 Agent Loop 仍在 Cursor 云端,工具输出会回传。附 My Machines 与 Team Pools 取舍、K8s 单任务隔离 Pod 配置、出站白名单域名、Secretless Access 与 90 天落地路线。
Cursor
自托管
Kubernetes
AI
Agent
安全
Kata Containers 4.0 默认切到 runtime-rs:老的 TOML 配置不是照搬就能跑
编程
Kata Containers 4.0 默认切到 runtime-rs:老的 TOML 配置不是照搬就能跑
2026-09-19 00:04:38
Kata Containers 4.0 起默认运行时从 Go runtime 换成 Rust 的 runtime-rs,默认 RuntimeClass 变为 qemu-runtime-rs,Go runtime 进入弃用期。升级时最容易踩的是配置文件:哪些选项被无替代丢弃、哪些改名换表换单位、guest swap 为何被 QEMU 插件拒绝,一篇讲清迁移要逐项核对的差异。
Kata
Containers
容器运行时
安全容器
Kubernetes
containerd
虚拟化
Rust
Traefik Proxy v3.7「Langres」GA:ingress-nginx 迁移路径与 80+ 注解兼容
综合
Traefik Proxy v3.7「Langres」GA:ingress-nginx 迁移路径与 80+ 注解兼容
2026-09-15 21:03:53
Traefik Proxy v3.7 让 ingress-nginx 迁移路径正式 GA:原生支持 80+ NGINX 注解,另可把中间件挂到 Service 上、完整支持 Gateway API v1.5.1、Retry/Failover 按状态码触发。本文按迁移兼容、路由能力、安全升级三部分整理,附 v3.7.6 修复的 CVE。
Traefik
反向代理
Kubernetes
运维
Kubernetes 1.35 升级清单:Pod 原地改资源转 GA,ipvs 与 Ingress NGINX 退场
综合
Kubernetes 1.35 升级清单:Pod 原地改资源转 GA,ipvs 与 Ingress NGINX 退场
2026-09-14 21:01:57
K8s 1.35 共 60 项增强:原地改 Pod 资源、PreferSameNode 流量分发转 GA;KYAML、Gang scheduling 进入 Beta/Alpha;ipvs 模式弃用应转 nftables,Ingress NGINX 退役迁 Gateway API,cgroup v1 结束。附升级前可执行的 cgroup/kube-proxy/Ingress 自查命令清单。
Kubernetes
运维
kube-proxy
Gateway
API
容器
Kubernetes v1.34 发布:58 项增强,DRA 核心 API 在 resource.k8s.io 组 GA
综合
Kubernetes v1.34 发布:58 项增强,DRA 核心 API 在 resource.k8s.io 组 GA
2026-09-13 21:06:03
Kubernetes v1.34(O' WaW)发布解读:58 项增强中 DRA 核心 API 在 resource.k8s.io 组正式 GA,含 admin-access 限制、优先设备列表、可消耗容量与绑定条件;梳理 23 项稳定特性(如卷扩缩失败恢复、有序命名空间删除、PreStop sleep)及 beta/alpha 清单与版本维护期、EOL 提醒。
Kubernetes
运维
容器
DRA
云原生
250 个 Agent 复用 8 个 Pod:Google 的 Agent Substrate 如何在 K8s 上做亚秒级挂起恢复
编程
250 个 Agent 复用 8 个 Pod:Google 的 Agent Substrate 如何在 K8s 上做亚秒级挂起恢复
2026-09-12 09:52:58
Google 开源的 Agent Substrate 用多路复用把大量 AI Agent 塞进少量 Pod:Actor 空闲即挂起、需要时亚秒级恢复,内存与文件系统状态不丢。本文拆解其 30 倍超售比原理、控制面/数据面架构、与 K8s 的关系,并给出基于 kind 的本地部署命令与局限。
Agent
Substrate
Kubernetes
Go
AI
gVisor
8 个 Go 开源仓库:从 Web 框架、微服务到学习路线
编程
8 个 Go 开源仓库:从 Web 框架、微服务到学习路线
2026-09-12 09:46:38
按核心库、中间件、学习资源、项目与资源五类,整理 8 个值得 Go 开发者关注的 GitHub 仓库,含 gin、go-zero、gorm、etcd、Kubernetes、awesome-go 等,附仓库地址与 star 数,便于按需选型和学习。
Go
开源项目
Gin
GORM
Kubernetes
Kubernetes v1.37 正式发布:HPA 缩容到零默认启用,watchcache 初始化完成
编程
Kubernetes v1.37 正式发布:HPA 缩容到零默认启用,watchcache 初始化完成
2026-09-09 08:01:10
Kubernetes v1.37(Garhwal)发布,67 项增强:HPA 缩容到零转 Beta 并默认启用、watchcache 初始化转 Stable、manifest-based admission 转 Beta、KYAML 与 metrics.k8s.io 转 Stable、Pod 级 checkpoint/restore 进入 Alpha。
Kubernetes
容器编排
云原生
HPA
Cilium Cluster Mesh 多集群实操:启用流程、Global Service 与 Native Routing 注意点
编程
Cilium Cluster Mesh 多集群实操:启用流程、Global Service 与 Native Routing 注意点
2026-09-09 00:04:23
用 Cilium Cluster Mesh 把多个 Kubernetes 集群在 eBPF 层连成统一网络:从 clustermesh enable/connect 到 Global Service 跨集群负载均衡,再到 Native Routing 先决条件与 SNAT 性能取舍、跨集群网络策略的坑。面向做多集群与云设施排障的工程师。
cluster
mesh
cilium
kubernetes
多集群
eBPF
Kubernetes controller 在你把东西搞坏时到底做什么
编程
Kubernetes controller 在你把东西搞坏时到底做什么
2026-09-08 05:08:47
Reconcile 只收到 namespace+name、controller 不轮询 API、resync 不是复查、predicate 有隐藏成本;实测 GenerationChangedPredicate 砍掉 48.5% 稳态 reconcile。
Kubernetes
Go
DevOps
实践
CNCF 开源项目漏洞处理配方卡:SECURITY.md、embargo 与 CVE 披露
编程
CNCF 开源项目漏洞处理配方卡:SECURITY.md、embargo 与 CVE 披露
2026-09-07 20:22:33
CNCF TAG Security 面向中小开源项目的漏洞处理三步配方:SECURITY.md 上报通道、先鉴别后修复的 embargo 管理、补丁与 CVE 披露协同发布,附披露内容清单。
安全
开源
CNCF
Kubernetes
Kubernetes 并不新,但 AI 让它再次变得令人担忧:CNCF 探讨 AI 时代云原生的安全挑战
编程
Kubernetes 并不新,但 AI 让它再次变得令人担忧:CNCF 探讨 AI 时代云原生的安全挑战
2026-09-07 01:12:53
CNCF 博客探讨 AI 时代 Kubernetes 的新安全挑战:AI工作负载的特殊性(GPU/大内存/数据安全/供应链)、AI代理的安全风险(权限管理/行为不可预测/人机协作)、AI驱动的攻击面扩大(AI增强攻击/AI系统作为目标/AI生成代码安全)、传统安全工具不足,提出零信任架构、AI原生安全工具、安全左移和治理合规等应对思路。
Kubernetes
CNCF
AI安全
云原生
零信任
DevSecOps
AI代理
Deno 推出 Claw Patrol:面向 AI 代理的开源安全防火墙
编程
Deno 推出 Claw Patrol:面向 AI 代理的开源安全防火墙
2026-09-07 00:14:42
Deno 官方推出开源项目 Claw Patrol,在 AI 代理与外部工具之间插入安全层,通过策略引擎检查每个工具调用并决定允许/拒绝/修改/要求审批,支持声明式策略定义、人工与自动审批、完整审计日志、多维度异常检测和细粒度速率限制,解决 AI 代理生产环境授权的安全困境。
Deno
Claw Patrol
AI安全
Agent
安全防火墙
开源
DevOps
Kubernetes
容器 cron 9 点变 17 点:默认 UTC、DST 漂移与 K8s CronJob timeZone
案例
容器 cron 9 点变 17 点:默认 UTC、DST 漂移与 K8s CronJob timeZone
2026-09-07 00:05:40
cron 定时任务跑错点的排障:容器默认 UTC 让 0 9 表达式错 8 小时、集群多机时区不一致、DST 切换导致任务跳跑或重复执行,以及 K8s CronJob 1.27 起 timeZone 字段与 CRON_TZ、anacron 的处理边界。
cron
定时任务
时区
DST
Kubernetes
CPU + GPU:为什么 AI 平台工程是一个异构基础设施问题
编程
CPU + GPU:为什么 AI 平台工程是一个异构基础设施问题
2026-09-06 17:14:03
CNCF分析AI平台工程的异构基础设施挑战。AI工作负载与传统应用截然不同:计算密集(GPU)、内存密集(大模型HBM)、存储密集(PB级数据集)、网络密集(分布式训练AllReduce)、资源异构(CPU+GPU+加速器)。GPU从可选加速器变成核心计算资源。核心挑战:资源调度(多维分配、GPU拓扑感知、碎片化、超额订阅差异)、资源利用率(训练<50%、推理波动、碎片化浪费、上下文切换开销)、网络架构(RDMA、GPU Direct RDMA、NCCL、多网络平面)、存储系统(并行文件系统Lustre/BeeGFS、对象存储、数据缓存、分层存储)、多租户隔离(GPU共享MIG/时间分片、性能隔离、计费配额)、生命周期管理(训练/微调/推理/批处理/交互式)。技术方案:Kubernetes GPU调度(设备插件、扩展资源、拓扑管理)、GPU虚拟化(MIG、vGPU)、RDMA网络、Volcano/Kueue调度器、Kubeflow/Ray/KServe平台。演进方向:GPU一等资源、异构调度标准化、网络存储协同、弹性成本优化、全面可观测性。
CNCF
AI平台
异构基础设施
GPU
Kubernetes
CPU
分布式训练
云原生
资源调度
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
3
4
5
6
7
8
下一页
共 8 页
到第
页
确定