VMware Integra Nemotron, Gemma, Qwen y GLM en su Nube Privada para Impulsar la IA Empresarial

3
minutos de tiempo de lectura
NetApp Revoluciona Entornos VMware con Innovadoras Capacidades de Optimizacion

Broadcom ha dado un paso significativo en el ámbito de la inteligencia artificial al expandir las capacidades de VMware Cloud Foundation (VCF), validando modelos de IA de renombradas compañías como NVIDIA, Google DeepMind, NEC, Alibaba Cloud y Z.ai para su ejecución en infraestructuras privadas. Este anuncio, realizado durante el evento VMware Explore 2026, busca facilitar a las empresas la oferta de servicios de inferencia y modelos directamente desde sus propios centros de datos o nubes privadas, asegurando un mejor control sobre sus datos, infraestructura y costos.

La tendencia apunta hacia una nueva fase en la implementación de la IA en el entorno empresarial, caracterizada por un cambio desde la dependencia exclusiva de APIs y servicios públicos hacia la adopción de soluciones privadas. Según el informe «Private Cloud Outlook 2026» de Broadcom, un 56% de las empresas encuestadas ya ejecutan o planean ejecutar inferencia de IA en producción dentro de nubes privadas, lo que subraya el interés creciente en el control local de estos procesos.

VMware Cloud Foundation permite que los modelos de IA coexistan con máquinas virtuales tradicionales, Kubernetes y otras aplicaciones en una única plataforma de infraestructura, validando de manera destacada cinco familias de modelos IA: Nemotron 3 de NVIDIA, Gemma 4 de Google DeepMind, cotomi de NEC, Qwen3.8-27B de Alibaba y GLM 5.2 de Z.ai. Cada modelo responde a necesidades específicas, desde aplicaciones multimodales y agentes de inteligencia artificial hasta aplicaciones empresariales japonesas y modelos de larga duración y razonamiento.

Broadcom ofrece vLLM como runtime predeterminado, lo que permite la operatividad de más de 150 modelos abiertos adicionales, extendiendo así la flexibilidad y opciones para las empresas. La importancia de vLLM radica en su capacidad para administrar eficazmente memoria, concurrencia y generación de tokens, evitando que la infraestructura se limite a un único catálogo de modelos.

El enfoque de Broadcom con VCF se centra principalmente en la inferencia de IA, permitiendo a las organizaciones el uso de modelos ya entrenados para diversos propósitos internos, como asistentes corporativos, búsquedas documentales y generación de código. Sin embargo, uno de los grandes desafíos será determinar los costos operativos y el beneficio real de operar estos modelos de manera local versus optar por servicios externos.

La privacidad y el control de datos son otras motivaciones significativas para las organizaciones al considerar la implementación de la IA en núcleos privados. La capacidad de mantener la mayoría del procesamiento dentro de la infraestructura interna y el control sobre los datos sensibles ofrece ventajas únicas en términos de seguridad y cumplimiento normativo.

Finalmente, el concepto de «Model as a Service» propone centralizar la administración de modelos IA dentro de la infraestructura de VCF, permitiendo a las empresas ofrecer estos como servicios internos a diferentes departamentos sin la necesidad de que cada uno gestione su propio entorno de inferencia. Esta metodología no solo busca simplificar la gestión de recursos, sino también optimizar el uso de valiosos recursos como las GPUs.

Al expandirse en la nube privada, VMware Cloud Foundation se perfila como una plataforma robusta que integra las operaciones convencionales con las nuevas demandas de la inteligencia artificial, ofreciendo a las empresas una mayor autonomía y flexibilidad para adaptarse a un entorno tecnológico en constante evolución.

TE PUEDE INTERESAR