Zhipu reduce en un 80 % los costes de inferencia de tokens utilizando 100.000 chips nacionales desde principios de 2026

Según Zhipu, la empresa ha logrado una inferencia escalable y de bajo coste utilizando 100.000 chips de fabricación nacional, lo que ha reducido los costes de inferencia de tokens en un 80% desde comienzos de 2026.

Anteriormente, el modelo GLM-5.3-Flash procesó 6,2 billones de llamadas de tokens durante las pruebas beta bajo el alias Ox-Alpha en OpenRouter y OpenCode. Tras su lanzamiento oficial, todo el tráfico en línea sigue procesándose en la flota de 100.000 chips de fabricación nacional, lo que valida la capacidad de la infraestructura a escala de producción.

Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios