Liquid AI vừa giới thiệu các mô hình dự thảo DSpark cho dòng LFM2.5, giúp tăng tốc độ giải mã lên tới 3,18 lần trên GPU H100 và 2,87 lần trên chip M4 Max mà vẫn giữ nguyên chất lượng đầu ra.
Hugging Face giới thiệu các mô hình dự đoán DSpark cho dòng LFM2.5, giúp tăng tốc độ xử lý trên GPU lên 3,18 lần và thiết bị đầu cuối lên 2,87 lần mà không làm giảm chất lượng đầu ra. Công nghệ này đã hỗ trợ mã nguồn mở cho llama.cpp và SGLang.
Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng giúp tối ưu hóa hiệu suất mô hình nhỏ, có tính ứng dụng cao cho cộng đồng phát triển AI và triển khai thực tế.
Liquid AI ra mắt mô hình LFM2.5-VL-3B, tối ưu hóa khả năng xử lý thị giác cho các thiết bị biên với tốc độ vượt trội và hiệu suất cao, mở ra tiềm năng ứng dụng thực tế rộng rãi.