Một tập đoàn Fintech đã ứng dụng giải pháp Dedicated Model Inference của Together AI để vận hành trợ lý lập trình GLM 5.2, giúp xử lý hiệu quả lưu lượng truy cập cao điểm trong giờ làm việc của đội ngũ kỹ sư.
Ant Group giới thiệu GLM-5.2-singprobe, một lớp bảo vệ tích hợp giúp đánh giá rủi ro về ý định truy vấn, nội dung độc hại và ảo tưởng ngay trong quá trình tạo token với chi phí vận hành cực thấp.
SiliconFlow ranks #1 in token share for GLM-5.2 on @OpenRouter.🚀 🔥 42.5% token share ⚡ 91.8% cache…
DịchMô hình GLM-5.2 của SiliconFlow hiện chiếm 42,5% thị phần token trên OpenRouter với độ ổn định 100% và tỷ lệ cache hit ấn tượng 91,8%. Hãng cũng đã hé lộ về phiên bản GLM-5.3 sắp ra mắt.
Own your harness. Very excited about this new open-source agent harness. I had early access, and…
DịchCông cụ Agent Harness mới vừa ra mắt cho phép tối ưu hóa hiệu suất, giúp giảm tới 75% chi phí khi chạy trên các mô hình mở như GLM-5.2 và nhiều mô hình tiên tiến khác.
Mistral AI cho phép tích hợp mô hình bên thứ ba vào nền tảng của mình, bắt đầu với Zhipu GLM-5.2, hỗ trợ triển khai tại Mỹ hoặc châu Âu để đảm bảo tuân thủ dữ liệu.