据SiliconANGLE报道,Nutanix公司在8月26日推出多项新功能,旨在让企业能够在不拆分基础设施管理的情况下,将代理式人工智能应用与现有虚拟机和容器化工作负载一同运行。新功能包括Nutanix Enterprise AI 2.8正式上市、Nutanix Kubernetes Platform 2.19即将发布,以及云合作伙伴计划Service Provider Central正式可用。Nutanix将这一方式称为“双原生”,其平台把虚拟机和容器都视为一等基础设施,客户可以在Acropolis Hypervisor上运行Kubernetes,也可以在裸机系统上直接部署Kubernetes。
Nutanix产品管理执行副总裁Thomas Cornely表示,区别不仅在于支持两种架构,“重点不是让容器跑起来,而是如何运维和管理这些容器”。客户可为每个工作负载选择运行环境,Nutanix根据选择优化部署,“选择权在他们手中”。
Enterprise AI 2.8在Nutanix Agent Gateway中新增了正式可用的Model Context Protocol(MCP)网关,为AI代理可访问的工具和数据提供统一治理点。单独的MCP服务器可让代理在受控条件下访问Nutanix软件管理的基础设施。该网关还跟踪令牌使用情况,允许组织在团队、用户或代理级别设置配额,以应对自主代理反复调用模型导致成本失控的担忧。Cornely说,客户首先要求的是可见性、控制和治理,“他们无法控制每个令牌的成本”。他提到,有客户的月度AI预算在一周内就花完。
Enterprise AI 2.8中的Private Inference新增低秩适配(LoRA)微调,支持低于80亿参数的模型、基于张量并行的多GPU推理、批量推理和推测解码。Nutanix称推测解码可将令牌生成速度提高至多2.5倍,但Cornely承认结果取决于模型和基础设施配置。该版本还扩展了审计功能,可将消费控制应用于单个代理,再按用户、代理和团队聚合,MCP活动日志可记录代理访问的数据源和应用以及采取的操作。Cornely表示,检查提示词并非该产品的默认用途。
Nutanix Kubernetes Platform 2.19即将推出,将Kubernetes管理扩展到虚拟化和裸机环境。NKP Metal自动完成操作系统、固件和容器部署,NKP on AHV与Nutanix Flow集成以实现网络隔离。应用目录将提供开源Kubeflow、Milvus和Slurm的策展部署。该平台已获得云原生计算基金会Kubernetes AI一致性认证。Nutanix还表示,其Unified Storage产品已获得Nvidia企业级认证,用于以低延迟和高吞吐量向GPU提供数据。
面向服务提供商,SP Central提供多租户控制平面,用于提供基础设施、应用、云原生和AI服务。“Powered by Nutanix: Verified Services”计划提供入门、交付材料和徽章,帮助合作伙伴建立经常性服务业务。