DiffuTester là khung làm việc mới giúp tăng tốc tạo unit test cho các mô hình ngôn ngữ khuếch tán (dLLM) bằng cách khai thác cấu trúc AST, giúp đẩy nhanh tốc độ tạo mã gấp 2-3 lần mà vẫn đảm bảo chất lượng.
New Stanford paper Prefix Sliding shows that long reasoning does not need the full chain of thought …
DịchPhương pháp Prefix Sliding cho phép mô hình AI lược bỏ các token suy luận trung gian, chỉ giữ lại tiền tố nhiệm vụ và cửa sổ trượt gần nhất, giúp tối ưu hóa tốc độ suy luận gấp 3 lần mà không làm giảm hiệu suất.
Liquid AI vừa giới thiệu các mô hình dự thảo DSpark cho dòng LFM2.5, giúp tăng tốc độ giải mã lên tới 3,18 lần trên GPU H100 và 2,87 lần trên chip M4 Max mà vẫn giữ nguyên chất lượng đầu ra.