Yuchen Jin@Yuchenj_UWGLM-5.3-Flash ra mắt: Tốc độ suy luận đạt 270 tok/s với chi phí tối ưu
GLM-5.3-Flash at 270 tok/s! Databricks inference team is on fire. So proud of the team! On our Off…
DịchGLM-5.3-Flash thiết lập chuẩn mực mới với tốc độ 270 tok/s, mang lại chất lượng vượt trội 10% so với bản tiền nhiệm nhưng chỉ tốn 1/10 chi phí vận hành.













