AMD y Cerebras anunciaron una alianza para dividir las cargas de inferencia de IA entre sus respectivas plataformas, mientras AMD presentó Helios y reforzó sus acuerdos con Anthropic, OpenAI y Meta.
***
- La alianza asignará a AMD el procesamiento de solicitudes y ventanas de contexto, mientras Cerebras acelerará la generación de tokens.
- Cerebras planea desplegar sistemas AMD Helios y ofrecer la solución conjunta mediante Cerebras Cloud a finales de 2026.
- AMD presentó nuevos procesadores EPYC, GPUs Instinct, sistemas Helios y tecnologías para robótica, con un mercado potencial de USD $2 billones para 2030.
🚀 AMD y Cerebras anunciaron una colaboración para acelerar la inferencia de IA.
AMD asumirá el procesamiento de solicitudes mientras Cerebras se enfocará en la generación de tokens.
La solución utilizará sistemas Helios y se ofrecerá a través de Cerebras Cloud en 2026.
Se… pic.twitter.com/5vO14XiSYY
— Diario฿itcoin (@DiarioBitcoin) July 24, 2026
AMD y Cerebras Systems anunciaron una colaboración para mejorar la infraestructura dedicada a la inferencia de inteligencia artificial. El acuerdo permitirá dividir distintas etapas de una carga de trabajo entre los sistemas de ambas compañías.
La inferencia ocurre después del entrenamiento de un modelo y convierte ese conocimiento en respuestas para los usuarios. Por ello, influye directamente en la velocidad, el costo y la capacidad de escalar servicios de IA cotidianos.
La solución conjunta combinará los sistemas AMD Helios, diseñados para operar a escala de rack, con el Motor de Wafer a Escala de Cerebras. La propuesta busca combinar capacidad de procesamiento, ancho de banda de memoria y latencia reducida.
Según explicó AMD, sus chips procesarán las solicitudes y administrarán grandes ventanas de contexto. Los sistemas de Cerebras se concentrarán en acelerar la generación de tokens, una tarea que exige un ancho de banda de memoria sustancial.
Lisa Su, presidenta y CEO de AMD, describió el acuerdo como parte de un cambio más amplio en la arquitectura de los servicios de IA. Durante una conferencia con periodistas, afirmó que la industria verá una mayor desagregación de las cargas de trabajo.
El concepto de desagregación consiste en utilizar distintos aceleradores para diferentes fases del procesamiento. En lugar de depender de un solo tipo de chip, los operadores pueden asignar cada función al hardware que ofrezca una mejor relación entre velocidad, consumo y costo.
Cerebras planea desplegar sistemas AMD Helios en sus centros de datos. La oferta combinada estará disponible a través de Cerebras Cloud más adelante en 2026, según la información divulgada por las compañías.
Helios encabeza la nueva plataforma de AMD
AMD presentó su infraestructura de próxima generación durante el evento Advancing AI 2026, celebrado el 23 de julio en San Francisco. El anuncio incluyó CPUs EPYC de sexta generación, GPUs Instinct MI400, soluciones Helios y productos para computación en el edge.
La empresa describió a AMD Helios como su primera solución de inteligencia artificial a escala de rack. También la presentó como el rack de IA más potente del mundo, una afirmación comercial que AMD respalda con sus propias estimaciones de rendimiento.
La arquitectura Helios integra 72 GPUs AMD Instinct MI455X y 18 CPUs AMD EPYC de sexta generación, conocidos como Venice. La conexión depende de la red AMD Pensando, mientras el software ROCm proporciona la base abierta para desarrollar y desplegar aplicaciones.
AMD asegura que Helios puede entregar hasta 30% más tokens de inferencia por dólar que la solución competitiva líder. La compañía calculó esa ventaja con la carga de trabajo Kimi K2 Thinking, bajo diferentes niveles de interactividad y con proyecciones de precios por hora.
La comparación mencionada por AMD utiliza un rack AMD Helios frente a un rack NVIDIA Vera Rubin NVL72. La compañía advirtió que las configuraciones pueden variar según el fabricante y producir resultados diferentes.
Los sistemas Helios estarán disponibles mediante fabricantes de equipos como Bull, HPE, Lenovo y Supermicro. AMD también identificó a Sanmina y Wiwynn como socios de infraestructura para estas implementaciones.
OpenAI, Anthropic, Meta, Microsoft, Oracle, HUMAIN, Tensorwave, Vultr y Cirrascale figuran entre las organizaciones que, según AMD, están eligiendo Helios. La lista refleja el intento de la empresa por posicionarse en distintos segmentos del mercado de IA.
OpenAI y AMD trabajan en la optimización de la pila completa, desde el silicio hasta el software. El trabajo utiliza el marco Triton de OpenAI junto con ROCm para ajustar cargas de trabajo de clase GPT en GPUs MI455X y racks Helios.
OpenAI espera poner Helios en línea desde el cuarto trimestre de 2026, con despliegues que aumentarían durante 2027. AMD no presentó ese calendario como una garantía general para todos los clientes.
Anthropic, Meta y el ecosistema de software
La alianza con Cerebras se conoció poco después de que AMD anunciara una relación estratégica con Anthropic. Ambas compañías delinearon planes para desplegar hasta 2 gigavatios de GPUs Instinct MI455X en soluciones de rackscale Helios.
El primer gigavatio de esa capacidad está previsto para estar disponible en 2027. AMD también acordó invertir hasta USD $5.000 millones en Anthropic, de acuerdo con la información presentada durante el evento.
AMD y Anthropic iniciaron además una colaboración de ingeniería de varios años. Sus equipos utilizarán Claude para optimizar cargas de trabajo en GPUs Instinct y acelerar el desarrollo del software ROCm.
Meta está validando los procesadores EPYC de sexta generación en sus laboratorios. La compañía también comenzó a probar cargas de trabajo en racks Helios mientras prepara posibles despliegues a escala de gigavatios.
El software representa una pieza central en la estrategia de AMD para competir en IA. ROCm funciona como una plataforma abierta para desarrollar aplicaciones en GPUs Instinct y busca ofrecer flexibilidad frente a ecosistemas más cerrados.
AMD presentó ROCm.ai, una plataforma de desarrollo asistida por inteligencia artificial. La herramienta permite que agentes de programación como Claude, Codex y Cursor comprendan de forma nativa las plataformas AMD y el entorno ROCm.
Los marcos PyTorch, Hugging Face, vLLM y SGLang ya cuentan con habilitación para MI455X. AMD afirmó que estas herramientas están obteniendo resultados relevantes en el proceso de preparación del nuevo acelerador.
La compañía también lanzó las GPUs Instinct MI350P para facilitar la aceleración de IA en infraestructuras existentes. AMD sostiene que la MI350P puede ofrecer hasta 4,2 veces más tokens por segundo por dólar que la competencia, según pruebas internas.
Para cargas científicas y de alta precisión, AMD introdujo la Instinct MI430X. El acelerador ofrece hasta 288 TFLOPS de rendimiento FP64 basado en hardware y está orientado a computación de alto rendimiento e inteligencia artificial soberana.
Una expansión que llega al edge y la robótica
El portafolio presentado por AMD no se limita a los grandes centros de datos. La empresa busca cubrir también computadoras personales, dispositivos embebidos, sistemas de telecomunicaciones y equipos ubicados en el edge.
AMD lanzó los procesadores EPYC de sexta generación para cargas de trabajo en la nube, empresas, computación general y HPC. Algunos modelos alcanzan 256 núcleos y 512 hilos, además de soporte para hasta 16 canales de memoria MRDIMM.
La empresa sostiene que estos procesadores pueden ayudar a mantener completamente abastecidos a los aceleradores de IA. También los presenta como una alternativa eficiente para ejecutar agentes y aplicaciones empresariales de propósito general.
En el ámbito de la inteligencia artificial física, AMD introdujo nuevos módulos de sistema Kria alimentados por procesadores Ryzen AI Embedded X100. El portafolio está diseñado para máquinas capaces de percibir, razonar y actuar en el mundo físico.
La plataforma de desarrollo de robótica AMD Kria combina computación de CPU, GPU, NPU y FPGA. La compañía la describe como una solución integrada y abierta para acelerar el paso desde el prototipo hasta la producción.
AMD también presentó la plataforma Ryzen AI Halo, que busca facilitar el desarrollo local de IA. Más equipos basados en procesadores Ryzen AI Max PRO 400 estarán disponibles durante este año mediante AMD y sus socios OEM.
Cisco y AMD colaboran para combinar motores de inferencia de alto rendimiento con redes, observabilidad y seguridad. El objetivo es ayudar a las empresas a desplegar y gobernar sistemas de IA agentic híbridos y locales.
Competencia, mercado y riesgos de ejecución
La alianza con Cerebras muestra que la competencia en chips de IA no depende únicamente del rendimiento máximo de un acelerador. También involucra la capacidad de coordinar memoria, redes, CPUs, software y diferentes tipos de procesamiento.
La inferencia plantea retos distintos al entrenamiento de modelos. Las empresas deben responder solicitudes con rapidez, manejar contextos cada vez mayores y controlar el costo de cada token generado.
AMD calcula que la inteligencia artificial podría llevar su mercado total direccionable a aproximadamente USD $2 billones en 2030. Esa estimación incluye servidores de centros de datos, computadoras personales y otros dispositivos embebidos y de edge.
Los datos de mercado divulgados por Simply Wall St situaron recientemente las acciones de Cerebras en USD $220,00, con una subida de 4,9%. AMD cerró en USD $539,69, con una caída de 2,3% en la referencia citada.
La misma información señaló movimientos en otras empresas de semiconductores. Tongfu Microelectronics avanzó 9,8% hasta CN¥ 76,64, mientras STMicroelectronics retrocedió 17,7% hasta EUR €47,94.
AMD enfrenta una competencia intensa, además de riesgos relacionados con la ejecución de sus planes. La disponibilidad de memoria, componentes, capacidad de fabricación y procesos avanzados puede afectar el ritmo de los despliegues.
La compañía también identificó riesgos asociados con regulaciones de exportación, aranceles, licencias, propiedad intelectual y cambios en las condiciones económicas. Las restricciones comerciales podrían influir en la distribución internacional de sus productos.
Los planes para Anthropic, OpenAI, Meta y Cerebras contienen declaraciones a futuro. AMD señaló que los resultados reales pueden diferir debido a factores de mercado, suministro, fabricación, seguridad, compatibilidad de software y demanda de los clientes.
La hoja de ruta contempla GPUs Instinct MI500 en 2027 y MI600 en 2028. AMD también proyecta CPUs Zen 7 para 2028, CPUs Zen 8 para 2030 y futuras soluciones Helios 500 y Helios 600.
La colaboración con Cerebras añade una pieza especializada a esa estrategia. Si la solución cumple sus objetivos de latencia y economía, podría ofrecer a los proveedores de nube una forma más flexible de atender cargas de inferencia variables.
Por ahora, el acuerdo representa una promesa tecnológica y comercial, no una demostración de resultados generalizados para todos los clientes. Su impacto dependerá de la disponibilidad de Helios, la integración con Cerebras Cloud y la adopción de ROCm.
Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.
Este artículo fue escrito por un redactor de contenido de IA.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
Estados Unidos
Stripe negocia comprar el mercado de modelos de IA OpenRouter por unos USD $10.000 millones
Estafas
Facebook lanza una insignia gratuita basada en selfies para demostrar que eres humano
IA
Tribunal indio respalda a OpenAI en disputa por derechos de autor con ANI
IA