Zhipu AI vừa phát hành GLM-5.3-Flash, mô hình đa phương thức mã nguồn mở với 320B tham số nhưng chỉ kích hoạt 18B. Nhờ tối ưu hóa kiến trúc, mô hình đạt hiệu suất gấp 3 lần so với thế hệ trước, giúp giảm đáng kể chi phí vận hành trên phần cứng NVIDIA.
Zhipu chính thức ra mắt GLM-5.3-Flash với 320 tỷ tham số, xác nhận đây chính là mô hình Ox Alpha từng gây xôn xao. Đây là mô hình đa phương thức gốc đầu tiên trong dòng GLM-5, hỗ trợ xử lý linh hoạt văn bản, hình ảnh và video.
Zhipu vừa phát hành GLM-5.3-Flash, mô hình đa phương thức đầu tiên trong dòng GLM-5 với hiệu suất ngang ngửa Claude Opus 4.8 nhưng giá thành chỉ bằng 1/40, đồng thời đánh dấu bước tiến lớn khi vận hành trên hạ tầng chip nội địa.
Diễn biến sự kiện · 14 bài →Thêm 19 nguồn khác đưa tinX: SiliconFlow (@SiliconFlowAI)X: Rohan Paul (@rohanpaul_ai)X: Hongming (@hongming731)X: X.PIN (@thexpin)PandailyWeChat: Baidu AI Cloud (ERNIE)IT HomeThe Decoder: AI NewsWeChat: KhazixMarkTechPostHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Artificial Analysis (@ArtificialAnlys)X: Testing Catalog (@testingcatalog)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Kim (@kimmonismus)X: OpenRouter (@OpenRouter)WeChat: Zhipu AI (GLM)X: Zhipu AI Z.ai (@Zai_org)TechNode
Vì sao đáng đọc: Đây là bước tiến quan trọng về tối ưu hóa chi phí và khả năng tự chủ hạ tầng tính toán cho mô hình AI quy mô lớn, có tính ứng dụng thực tiễn cao cho doanh nghiệp.
Brilliant piece by Zhipu Founder Tang Jie. AI scaling is moving past parameter growth. "How many …
DịchĐường cong tăng trưởng mô hình không còn phụ thuộc vào tham số, mà nằm ở dữ liệu, tính toán và hậu huấn luyện. Zhipu chứng minh GLM-5.3 dù cùng cấu trúc với bản cũ nhưng nhờ tối ưu hóa suy luận và RL, hiệu suất đã vượt trội đáng kể.