🚨 Z.ai запустила GLM 5.3 FlashX со скоростью до 200 токенов в секунду

🚨 Z.ai запустила GLM 5.3 FlashX со скоростью до 200 токенов в секунду
По сути это тот же GLM 5.3 Flash на 320B параметров, но с сильно оптимизированным инференсом и генерацией до 5× быстрее.
Работает на 100 000+ китайских AI чипов. API стоит в 2.5× дороже обычного Flash.