¡Apunta a Nvidia! Cerebras (CBRS.US) lanza el “acelerador de IA más rápido” CS-4, afirmando que la velocidad de inferencia es 30 veces mayor que la solución con GPU
Cerebras lanzó el sistema CS-4 y lo calificó como el acelerador de IA más rápido de la industria.
De acuerdo con información de Zhitong Finanzas APP, la empresa de chips de IA Cerebras Systems (CBRS.US) presentó oficialmente su nuevo sistema de IA a nivel de rack, el Cerebras CS-4, en la conferencia SUPERNOVA en San Francisco, proclamándolo como el "acelerador de IA más rápido del sector". Este sistema está dirigido al segmento de inferencia de IA y compite directamente con los productos de servidores GPU de Nvidia (NVDA.US). Se espera que el CS-4 comience a enviarse este trimestre (tercer trimestre de 2026) y actualmente está siendo probado por unos pocos clientes seleccionados.
Especificaciones técnicas: Tres procesadores a nivel de oblea logran una capacidad de cómputo de 750 PFLOPs
El CS-4 es el primer producto de la nueva arquitectura de plataforma a nivel de rack Nexus de Cerebras, impulsado por tres nuevos procesadores Wafer Scale Engine 3 Turbo (WSE-3T) a nivel de oblea. El WSE-3T es el procesador de IA más grande hasta la fecha, integrando 4 billones de transistores y 900,000 núcleos optimizados para IA en cada chip, cubriendo un área de silicio de 46,225 milímetros cuadrados y con 44GB de SRAM incorporada.
El sistema CS-4 proporciona una potencia de cómputo de IA de 750 PFLOPs, un ancho de banda de memoria de 129.6 PB por segundo y un rendimiento de I/O de 7.2 Tbps por segundo. Comparado con el CS-3 anterior, el CS-4 duplica la velocidad y mejora el rendimiento por vatio en 10 veces, mejorando significativamente la rentabilidad para centros de datos. Frente al WSE-3, el WSE-3T duplica la capacidad de IA de una sola oblea de 125 PFLOPs a 250 PFLOPs, y el ancho de banda de memoria de 21.6 PB/s a 43.2 PB/s. El consumo de energía por chip también aumenta de 15 kilovatios a aproximadamente 33 kilovatios.
En cuanto a la arquitectura, el CS-4 utiliza la plataforma modular Nexus, separando computación, energía e I/O en componentes independientes. El módulo de conversión de energía ahora se encuentra a sólo 0.5 milímetros del procesador (comparado con los tradicionales 50 mm en tarjetas GPU estándar), eliminando casi completamente la pérdida de energía a nivel de placa. El diseño modular "tipo mochila" integra conversión de energía, refrigeración líquida y electrónica de control, reduciendo el tiempo de despliegue de varios días a solo unas horas.
Avances en rendimiento: Más de 4400 Tokens por segundo por usuario en la prueba GPT-OSS-120B
Cerebras asegura que el CS-4 establece un nuevo estándar industrial en velocidad de inferencia. En pruebas directas con el modelo GPT-OSS-120B, el CS-4 es capaz de generar más de 4,400 tokens por usuario por segundo, alcanzando hasta 30 veces el rendimiento de las soluciones GPU. El sistema soporta modelos con más de 50 billones de parámetros.
Sean Lie, CTO y cofundador de Cerebras, comentó: "Ser 30 veces más rápido no sólo hace que la respuesta sea más fluida, sino que permite que los sistemas inteligentes tengan un orden de magnitud más espacio para razonar, verificar o llamar herramientas en el mismo tiempo real". Andrew Feldman, CEO de Cerebras, señaló: "Históricamente, la inferencia rápida significaba usar modelos más pequeños y menos potentes. El CS-4 logra la velocidad líder en la industria con los modelos más grandes del momento, cambiando radicalmente este paradigma".
En cuanto a eficiencia energética, el CS-4 mejora hasta 10 veces el rendimiento por vatio sobre el CS-3, lo que repercute en una mayor eficiencia económica para los centros de datos. Andrew Feldman, CEO de Cerebras, subrayó que, dado que los tokens generados rápidamente tienen más valor que los tokens más lentos, el CS-4 es capaz de entregar tokens de mayor calidad y mayor volumen total bajo un mismo presupuesto de potencia, "cambiando radicalmente el paradigma".
El CS-4 también utiliza un diseño que reduce en un 50% el número de componentes, haciendo que el despliegue sea más sencillo y rápido para los clientes. A nivel de arquitectura del sistema, la nueva plataforma Nexus separa computación, energía e I/O en componentes modulares: la conversión de energía, que en las placas GPU tradicionales está a una distancia de unos 50 mm del procesador, se ha reducido a tan sólo 0,5 mm, lo que reduce significativamente la pérdida de energía a nivel de placa y permite mayores frecuencias de operación. El diseño "mochila" enchufable integra conversión de energía, refrigeración líquida y electrónica de control en una unidad independiente, reduciendo el tiempo de despliegue de días a horas.
Es destacable que el sistema a nivel de oblea de Cerebras utiliza SRAM (memoria estática de acceso aleatorio), en lugar de DRAM como es habitual en la industria. La SRAM es mucho más rápida que la DRAM, pero también es más voluminosa y costosa, y la oblea del tamaño de un plato de Cerebras proporciona el espacio físico necesario para utilizar SRAM. Además, el diseño de chip único permite distancias de transferencia de datos mucho más cortas que los sistemas de múltiples chips de Nvidia o AMD.
Colaboración en el ecosistema: Alianza con AMD Helios, con objetivo de 5 veces más eficiencia
El subsistema I/O programable del CS-4 soporta el estándar RDMA RoCE v2 basado en Ethernet y puede integrarse en sistemas heterogéneos. Cerebras ya ha colaborado con AMD (AMD.US) para esta arquitectura, combinando la solución Helios de AMD a nivel de rack con WSE, logrando una generación de tokens por vatio por segundo 5 veces superior a la de una configuración sólo con Cerebras. AWS Trainium también figura como socio colaborador.
Dylan Patel, fundador y CEO de SemiAnalysis, señaló que las mejoras en la desplegabilidad y capacidad de red del CS-4 le permiten escalar a modelos de mayor tamaño, creando una auténtica "fábrica de tokens a gran escala".
Contexto de mercado: Tras la salida a bolsa, las acciones cayeron un 35% desde el máximo, y el CS-4 se considera un punto de inflexión clave
Cerebras debutó el 14 de mayo de 2026 en el Nasdaq a un precio de 185 dólares por acción, abriendo el día en 350 dólares y cerrando en 311,07 dólares, con una subida del 68%. Sin embargo, el precio de las acciones ha caído continuamente desde entonces, cotizando alrededor de 220 dólares el martes, lo que supone una caída de aproximadamente el 35% desde el máximo.
El informe financiero del segundo trimestre de la empresa fue mixto: los ingresos principales ascendieron a 209,9 millones de dólares, un aumento del 103% interanual; pero la pérdida por acción fue de 2,98 dólares, frente a los 1,91 dólares de beneficio del mismo periodo del año anterior. La previsión de la compañía de triplicar sus ingresos principales en 2027 y las expectativas positivas para el tercer trimestre no lograron convencer por completo a los inversores. Sin embargo, la empresa mantiene obligaciones contractuales pendientes por 25.400 millones de dólares, lo que otorga una gran visibilidad a los ingresos futuros.
Importancia sectorial: El mercado de inferencia de IA enfrenta una reconfiguración
El lanzamiento del CS-4 coincide con un momento clave de explosión en la demanda de inferencia de IA. A medida que los grandes modelos pasan de la etapa de entrenamiento al despliegue masivo, la eficiencia de la inferencia se está convirtiendo en el principal factor de competitividad para las infraestructuras de IA. Si la ventaja de velocidad 30 veces superior que asegura Cerebras se valida en pruebas de referencia independientes, esto podría modificar las decisiones de compra de los operadores de centros de datos de ultragrande escala.
La presentación del Cerebras CS-4 señala que la competencia de chips de IA está acelerando su enfoque, pasando del entrenamiento de modelos al mercado de inferencia. Si este sistema podrá realmente desafiar el dominio de Nvidia en el ámbito de la inferencia de IA dependerá de si su supuesta capacidad de rendimiento se confirma en pruebas independientes y de si el CS-4 puede suministrarse a gran escala y con rapidez para satisfacer la creciente demanda de generación rápida de tokens por parte de los operadores de centros de datos de ultragrande escala.
El negocio de inferencia en la nube de Cerebras ya logró un crecimiento interanual del 287% en el segundo trimestre, alcanzando unos ingresos centrales de la nube de 127,7 millones de dólares. El lanzamiento del CS-4 marca una nueva etapa en la transición de Cerebras del negocio de ventas de hardware a un modelo de negocio de alquiler de capacidad de inferencia.
Disclaimer: The content of this article solely reflects the author's opinion and does not represent the platform in any capacity. This article is not intended to serve as a reference for making investment decisions.
You may also like
Preapertura de acciones estadounidenses | Futuros de los tres principales índices bursátiles con movimientos mixtos; Moderna se dispara en la preapertura; Actas de la reunión de la Reserva Federal de julio y subasta de bonos del Tesoro a 20 años llegan esta noche
El 19 de agosto (miércoles) antes de la apertura del mercado estadounidense, los futuros de los tres principales índices bursátiles de EE.UU. mostraron variaciones mixtas.

La última investigación de la fábrica de Tesla de JP Morgan sobre el despliegue a gran escala de Robotaxi y el ritmo de lanzamiento del robot Optimus
La expansión de la flota Robotaxi experimentará una aceleración significativa entre finales de 2026 y principios de 2027, con el lanzamiento de FSD v15 dentro del año identificado como el factor clave para dicha expansión. En cuanto a Optimus, el diseño Gen 3 ya ha sido finalizado, la cadena de suministro está prácticamente asegurada, y tras el inicio de la producción en serie (SoP), el objetivo preliminar es empezar la fase de entrenamiento en la "Academia Optimus" durante la segunda mitad de 2026, comenzando las ventas comerciales externas más pronto en la segunda mitad de 2027.
En medio de la tormenta en el mercado global de bonos, la "economía de altos precios" se convierte en el nuevo punto vulnerable: Japón tiene opciones limitadas de respuesta
La fuerte caída de los bonos pone en riesgo los planes fiscales, pero las medidas de respuesta de las autoridades japonesas parecen ser mínimas.


