Bitget App
Trading Inteligente
Comprar criptoMercadosTradingFuturosEarnCentroMás
¡Apuntando a Nvidia! Cerebras (CBRS.US) lanza el “acelerador de IA más rápido” CS-4, afirmando que su velocidad de inferencia es 30 veces mayor que la de soluciones con GPU

¡Apuntando a Nvidia! Cerebras (CBRS.US) lanza el “acelerador de IA más rápido” CS-4, afirmando que su velocidad de inferencia es 30 veces mayor que la de soluciones con GPU

智通财经智通财经2026/08/19 11:01
Mostrar el original
Por:智通财经

Cerebras lanzó el sistema CS-4 y lo calificó como el acelerador de IA más rápido de la industria.

De acuerdo a noticias de Zhihui Financiero APP, la empresa de chips de IA, Cerebras Systems (CBRS.US), presentó oficialmente su nuevo sistema de IA a nivel rack, Cerebras CS-4, en el evento SUPERNOVA realizado en San Francisco, afirmando que es "el acelerador de IA más rápido de la industria". Este sistema está dirigido al segmento de inferencia de IA y compite directamente con los servidores GPU de Nvidia (NVDA.US). Se espera que el CS-4 comience a enviarse este trimestre (tercer trimestre de 2026), actualmente algunos clientes están realizando pruebas de muestra.

Especificaciones técnicas: tres procesadores a escala de oblea para alcanzar 750 PFLOPs de potencia

El CS-4 es el primer producto de la nueva generación de la arquitectura Nexus de nivel rack de Cerebras, impulsado por tres nuevos procesadores Wafer Scale Engine 3 Turbo (WSE-3T). El WSE-3T es el procesador de IA más grande hasta la fecha, con cada chip integrando 4 billones de transistores y 900 mil núcleos optimizados para IA, cubriendo 46.225 mm² de silicio e incorporando 44 GB de SRAM.

El sistema CS-4 ofrece 750 PFLOPs de potencia de IA, ancho de banda de memoria de 129,6 PB por segundo y una capacidad de entrada/salida de 7,2 Tbps por segundo. Comparado con el CS-3 de la generación anterior, el CS-4 es dos veces más rápido y ofrece diez veces más rendimiento por vatio, mejorando significativamente la eficiencia económica de los data centers. En comparación con el WSE-3 anterior, el WSE-3T duplica la potencia de IA por chip de 125 PFLOPS a 250 PFLOPS y el ancho de banda de memoria de 21,6 PB/s a 43,2 PB/s. El consumo de energía por chip también aumentó de 15 kW a aproximadamente 33 kW.

A nivel arquitectónico, el CS-4 utiliza la plataforma modular Nexus, desglosando cómputo, energía e I/O en componentes independientes. El módulo de conversión de energía se ha acercado desde una distancia tradicional de 50 mm en placas GPU a solo 0,5 mm del procesador, eliminando casi por completo las pérdidas de consumo energético en la placa. El diseño enchufable tipo "mochila" integra conversión de energía, enfriamiento líquido y controles electrónicos en una sola unidad, reduciendo el tiempo de despliegue de varios días a solo unas horas.

Logro de rendimiento: más de 4.400 tokens por segundo por usuario en pruebas con GPT-OSS-120B

Cerebras afirma que el CS-4 establece un nuevo estándar de velocidad en inferencia. En pruebas directas con el modelo GPT-OSS-120B, el CS-4 puede generar más de 4.400 tokens por usuario por segundo, hasta 30 veces más que las opciones con GPU. El sistema puede soportar modelos de más de 50 billones de parámetros.

Sean Lie, CTO y cofundador de Cerebras, declaró: “Ser hasta 30 veces más rápido no solo significa una respuesta más fluida, sino que permite a los sistemas de agentes inteligentes contar con un orden de magnitud más de espacio para inferencia, verificación o utilización de herramientas en el mismo tiempo real”. Andrew Feldman, CEO de Cerebras, señaló: “Históricamente, inferencias rápidas requerían modelos más pequeños y menos potentes. El CS-4 logra velocidades líderes en la industria incluso con los modelos más avanzados, cambiando radicalmente este paradigma”.

En eficiencia energética, el CS-4 ofrece hasta 10 veces más rendimiento por vatio que el CS-3, mejorando considerablemente la economía de los data centers. Andrew Feldman señaló que, dado que los tokens rápidos son más valiosos que los tokens lentos, el CS-4 puede proporcionar tokens de mayor calidad y en mayor cantidad dentro del mismo presupuesto energético, “cambiando radicalmente el paradigma”.

El CS-4 también implementa un diseño que reduce en un 50% la cantidad de componentes, facilitando una implementación más rápida y sencilla para los clientes. Arquitectónicamente, la nueva plataforma Nexus divide el cómputo, alimentación e I/O en módulos: la conversión de energía va desde unos 50 milímetros en placas GPU tradicionales a solo 0,5 mm del procesador, bajando drásticamente el consumo en placa y permitiendo frecuencias superiores. El diseño enchufable "mochila" integra la conversión de energía, enfriamiento líquido y controles electrónicos en una unidad independiente, reduciendo el tiempo de despliegue de varios días a solo unas horas.

Cabe destacar que el sistema a nivel de oblea de Cerebras utiliza memoria estática SRAM, en lugar de la DRAM estándar de la industria. El SRAM es mucho más rápido que el DRAM, aunque más voluminoso y costoso; las obleas del tamaño de un plato que fabrica Cerebras hacen posible su uso. Al mismo tiempo, el diseño de chip único implica que la distancia de transferencia de datos es mucho menor que en los sistemas multinúcleo de Nvidia o AMD.

Cooperación en el ecosistema: alianza con AMD Helios para buscar una mejora de cinco veces en eficiencia

El subsistema programable de I/O del CS-4 soporta el estándar RoCE v2 RDMA sobre Ethernet y puede integrarse con sistemas heterogéneos. Cerebras ha establecido una alianza con AMD (AMD.US) sobre esta arquitectura, combinando la solución rack AMD Helios con el WSE; la cantidad de tokens generados por vatio por segundo supera cinco veces a la configuración Cerebras pura. AWS Trainium también fue mencionado como socio estratégico.

Dylan Patel, fundador y CEO de SemiAnalysis, opinó que las mejoras en desplegabilidad y networking del CS-4 permiten su escalabilidad hacia modelos aún más grandes, creando una “fábrica de tokens a gran escala”.

Contexto de mercado: tras salir a bolsa, acciones bajaron 35% desde su pico – CS-4 se convierte en punto clave de inflexión

Cerebras salió a bolsa en el Nasdaq el 14 de mayo de 2026 a un precio de 185 dólares por acción; ese día abrió en 350 dólares y cerró en 311,07, con una suba del 68%. Sin embargo, las acciones cayeron progresivamente y el martes cotizaban alrededor de 220 dólares, un 35% menos desde su punto más alto.

El balance del segundo trimestre de la compañía fue mixto: ingresos principales de 209,9 millones de dólares, un 103% más que el año anterior; pero una pérdida por acción de 2,98 dólares, en contraste con una ganancia de 1,91 dólares un año atrás. Las perspectivas de triplicar ingresos en el segmento principal hacia 2027, junto con un pronóstico favorable para el tercer trimestre, no lograron convencer completamente a los inversores. Sin embargo, la compañía tiene compromisos pendientes de 25.400 millones de dólares, lo que ofrece fuerte visibilidad futura de ingresos.

Significado en la industria: el mercado de inferencia de IA enfrenta una reorganización

La presentación del CS-4 ocurre junto a un crecimiento explosivo en la demanda de servicios de inferencia en IA. A medida que los grandes modelos pasan de la etapa de entrenamiento a despliegues a gran escala, la eficiencia en inferencia se convierte en el principal factor competitivo para la infraestructura de IA. Si la ventaja de velocidad de 30 veces anunciada por Cerebras logra ser verificable en pruebas independientes, podría cambiar las decisiones de compra de los operadores de data centers a hiperescala.

El lanzamiento del Cerebras CS-4 significa que la competencia en chips de IA está pasando aceleradamente del entrenamiento de modelos al mercado de la inferencia. Si este sistema logra realmente desafiar el dominio de Nvidia en inferencia de IA dependerá de si sus afirmaciones de rendimiento resisten evaluaciones independientes y si el CS-4 puede entregarse en cantidades suficientes y con rapidez, cubriendo la creciente demanda de tokens veloces en los data centers hiperescala.

El negocio de inferencia en la nube de Cerebras ya creció un 287% interanual en el segundo trimestre, alcanzando 127,7 millones de dólares de ingresos principales por nube. El lanzamiento del CS-4 marca una etapa nueva en la transición del modelo de negocio de Cerebras, de la venta de hardware al alquiler de capacidades de inferencia.

0
0

Descargo de responsabilidad: El contenido de este artículo refleja únicamente la opinión del autor y no representa en modo alguno a la plataforma. Este artículo no se pretende servir de referencia para tomar decisiones de inversión.

PoolX: Haz staking y gana nuevos tokens.
APR de hasta 12%. Gana más airdrop bloqueando más.
¡Bloquea ahora!

También te puede gustar

¡El Departamento del Tesoro de EE.UU. interviene de emergencia para estabilizar el mercado de bonos! El tamaño de las recompras de bonos del Tesoro a largo plazo al menos se duplicará y los rendimientos de los bonos estadounidenses caen en toda la línea.

El Departamento del Tesoro de Estados Unidos anunció el miércoles que al menos duplicará el tamaño de las "operaciones de recompra para respaldar la liquidez" dirigidas a los bonos del Tesoro con vencimiento entre 10 y 30 años.

智通财经2026/08/19 14:01
¡El Departamento del Tesoro de EE.UU. interviene de emergencia para estabilizar el mercado de bonos! El tamaño de las recompras de bonos del Tesoro a largo plazo al menos se duplicará y los rendimientos de los bonos estadounidenses caen en toda la línea.

¡Los centros de datos de IA disparan la demanda de chips de gestión de energía! Los ingresos de Analog Devices (ADI.US) en el tercer trimestre alcanzan un récord y la perspectiva para el cuarto trimestre supera las expectativas.

Debido a la demanda de chips impulsada por la inteligencia artificial, el desempeño de Analog Devices superó las expectativas.

智通财经2026/08/19 13:36
¡Los centros de datos de IA disparan la demanda de chips de gestión de energía! Los ingresos de Analog Devices (ADI.US) en el tercer trimestre alcanzan un récord y la perspectiva para el cuarto trimestre supera las expectativas.

¡La nueva estrategia de “retorno a la rentabilidad” del CEO sigue dando resultados! Los ingresos del Q2 de Target (TGT.US) superan las expectativas y los reembolsos de aranceles impulsan las ganancias, mientras la guía anual vuelve a ajustarse al alza.

A medida que las acciones del nuevo CEO, Fiddelke, para revertir la tendencia negativa comienzan a dar resultados, Target volvió a aumentar sus previsiones de rendimiento anual.

智通财经2026/08/19 12:46
¡La nueva estrategia de “retorno a la rentabilidad” del CEO sigue dando resultados! Los ingresos del Q2 de Target (TGT.US) superan las expectativas y los reembolsos de aranceles impulsan las ganancias, mientras la guía anual vuelve a ajustarse al alza.

Previa del mercado estadounidense | Futuros de los tres principales índices bursátiles presentan variaciones mixtas, Moderna se dispara en la previa; las actas de la reunión de la Reserva Federal de julio y la subasta de bonos del Tesoro a 20 años se publican esta noche

El 19 de agosto (miércoles), antes de la apertura del mercado estadounidense, los futuros de los tres principales índices bursátiles de EE. UU. tuvieron desempeños mixtos.

智通财经2026/08/19 12:12
Previa del mercado estadounidense | Futuros de los tres principales índices bursátiles presentan variaciones mixtas, Moderna se dispara en la previa; las actas de la reunión de la Reserva Federal de julio y la subasta de bonos del Tesoro a 20 años se publican esta noche