PANews 9月18日消息,据智谱公众号,公司推出GLM-5.3-FlashX,API与体验中心已开放,官方称最高推理速度达200 tokens/s,此次提速建立在10万张国产芯片提供的推理算力之上,并追加了Infra与推理优化投入。其基础模型GLM-5.3-Flash于8月26日开源,总参数3200亿、激活参数180亿,上下文100万tokens,此前曾以”Ox Alpha”匿名测试。 文章导航 trade.xyz 上线长期美国国债指数产品 TLT 永续合约 | PANews 美国联邦公报网站曾使用被指抄袭的中国Qwen模型提供AI检索 | PANews