过去十几年,云基础设施的一套基本假设相当稳定:人通过控制台、命令行或API发起操作,平台接收请求,再把计算、存储和网络资源分配下去。即便后来有了自动扩缩容、基础设施即代码和各种自动化运维工具,真正做决策的主体通常还是人,或者是人提前写好的固定逻辑。AI Agent正在打破这个前提。
在近日举行的KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026上,InfoQ分别与OpenInfra基金会总经理Thierry Carrez、CNCF执行总监Jonathan Bryce进行了交流。Thierry提到,他们现在关注的核心问题之一是“未来的基础设施需求”正在发生变化,过去十年的软件架构主要围绕人类操作设计,但现在基础设施的使用者开始包含越来越多AI Agent,底层需要探索更直接的控制方式。
Jonathan则从Kubernetes一侧给出另一部分答案。他提到,面对越来越复杂的AI硬件,Kubernetes已经开始通过DRA(动态资源分配)等插件机制,让GPU和其他加速器更灵活地接入集群;CNCF也推出了Kubernetes AI Conformance,希望把AI基础设施里的兼容问题从技术接口延伸到共同规则。
问题不只是“Agent会消耗更多算力”。如果Agent只是又一种跑在Kubernetes上的应用,云原生基础设施面对的无非是更多Pod、更高并发和更多GPU;但如果Agent开始自己决定什么时候申请资源、调用什么工具、调整多少实例,甚至直接参与基础设施状态的改变,它就不再只是一个“被调度的工作负载”,而逐渐成为基础设施的调用者。过去为人设计的云原生控制面还能不能继续工作,正成为云平台架构师与基础设施工程师必须面对的问题。