es.wedoany.com Noticia: El 11 de agosto, IBM y la plataforma de inteligencia artificial en la nube Together AI firmaron un acuerdo plurianual por valor de 240 millones de dólares. IBM construirá en Estados Unidos un clúster de inferencia de IA a gran escala basado en los sistemas NVIDIA HGX B300, que proporcionará capacidad de cómputo en la nube para los servicios de inferencia de modelos abiertos de Together AI. El clúster está previsto que entre en funcionamiento en el primer trimestre de 2027.

El clúster se desplegará en IBM Cloud, con una configuración inicial estimada de aproximadamente 2000 chips NVIDIA Blackwell Ultra B300, y utilizará la plataforma de red Ethernet NVIDIA Spectrum-X para conectar los nodos de cómputo. IBM indicó que este es el primer clúster de cómputo de su plataforma en la nube construido específicamente para operaciones de inferencia de IA a gran escala, con tecnología HGX B300 y Spectrum-X.
La plataforma HGX B300 es utilizada por los fabricantes de servidores para construir sistemas de IA de alta densidad. Cada sistema HGX B300 está configurado con 8 GPU Blackwell Ultra, con una capacidad total de memoria de GPU de 2,1 TB, interconexión NVLink de quinta generación, un ancho de banda total de interconexión entre GPU de 14,4 TB/s y un ancho de banda de red de 1,6 TB/s. Según el cálculo de aproximadamente 2000 chips, el despliegue inicial equivale a unos 250 sistemas HGX B300 de ocho GPU, aunque el número real de servidores y la configuración de los racks dependerán del diseño de ingeniería final.
A diferencia de los clústeres de cómputo destinados principalmente al entrenamiento de modelos, este proyecto se centra en la inferencia de modelos, es decir, en utilizar modelos ya entrenados para procesar solicitudes de usuarios y generar texto, código u otro contenido. Together AI operará modelos abiertos como DeepSeek, MiniMax y Kimi a través de este clúster, ofreciendo a los clientes empresariales servicios de invocación de modelos e inferencia de nivel de producción.
Kai Mak, director de ingresos de Together AI, afirmó que la compañía espera que la capacidad de cómputo correspondiente se reserve por completo entre dos y tres meses antes de su lanzamiento oficial. Together AI procesa actualmente alrededor de 400 billones de tokens al mes. A medida que los clientes empresariales amplían el despliegue de modelos abiertos, la compañía está incrementando sus recursos de GPU mediante construcción propia, arrendamiento y acuerdos de cómputo en la nube a largo plazo.
En julio de 2026, Together AI completó una ronda de financiación Serie C de 800 millones de dólares, alcanzando una valoración post-inversión de 8300 millones de dólares. Esta ronda fue liderada por Prosperity7 Ventures, filial de Saudi Aramco, con la participación de NVIDIA, Vista Equity Partners, General Catalyst y otras instituciones. La compañía planea utilizar los fondos recaudados para ampliar sus productos e infraestructura de cómputo, y aumentar la escala total de su infraestructura aproximadamente 50 veces en los próximos cinco años.
Este acuerdo también ampliará el despliegue de cómputo Blackwell Ultra en IBM Cloud. IBM ya había anunciado anteriormente la disponibilidad de GPU NVIDIA Blackwell Ultra en su plataforma en la nube para cargas de trabajo de entrenamiento de grandes modelos, inferencia y razonamiento complejo. Una vez que el nuevo clúster esté operativo, Together AI se convertirá en el principal usuario de esta capacidad de cómputo dedicada. Los siguientes pasos para ambas partes incluyen el despliegue de servidores, la construcción de la red Spectrum-X, la integración de la plataforma de software, la depuración del clúster y la operación comercial en el primer trimestre de 2027.





















