Thanks to our day0 partner @DeepInfra to bring the finance and visual enhanced intelligence to more …
DịchAntLingAGI hợp tác cùng DeepInfra để phát hành hai mô hình mới là Ling-3.0-flash-Fin (tài chính) và Ling-3.0-flash-VL (thị giác), mở rộng khả năng tiếp cận cho người dùng.
Today, we're introducing the Weight Cache Daemon for SGLang. 🚀 On Ling-2.6-1T FP8, it reduced weigh…
DịchAntLing vừa giới thiệu Weight Cache Daemon cho SGLang, giúp rút ngắn thời gian tải trọng số xuống còn 0,63 giây và giảm tổng thời gian khởi động engine từ 8,8 phút xuống chỉ còn 0,53 phút.
Vì sao đáng đọc: Giải pháp kỹ thuật thực tế giúp tối ưu hóa hiệu suất triển khai LLM, mang lại giá trị cao cho cộng đồng kỹ sư AI và các nhà phát triển hạ tầng.
Tổng 2 tin, không còn tin nào nữa
40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (11 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả