Pruna-Qwen-Image-2.1 a set of a few-step LoRA adapters that make Qwen-Image-2.1 up to 6.3× faster f…
DịchPruna giới thiệu bộ LoRA adapter giúp Qwen-Image-2.1 tạo và chỉnh sửa ảnh chỉ với 5-8 bước thay vì 40 bước, giúp tăng tốc độ xử lý lên tới 6,3 lần mà vẫn đảm bảo chất lượng.
ACLArena là khung nghiên cứu mới giúp phân tích cơ chế quên và khái quát hóa trong học liên tục cho tác nhân AI, đồng thời đề xuất phương pháp kết hợp phát lại dữ liệu chất lượng cao với mạng định tuyến LoRA chuyên biệt để tối ưu hiệu suất.
Hugging Face ra mắt AsyncGRPOTrainer giúp tách biệt quá trình huấn luyện LoRA và suy luận vLLM trên các máy chủ khác nhau mà không cần NCCL, giúp tăng tốc độ huấn luyện lên 3.9 lần.
Vì sao đáng đọc: Đây là giải pháp kỹ thuật thực tiễn cao, giải quyết bài toán khó về hạ tầng khi huấn luyện RLHF, giúp tiết kiệm tài nguyên và tăng hiệu suất đáng kể cho các kỹ sư AI.
NoRA (Normalized Low-Rank Adaptation) giới thiệu một thay đổi đơn giản nhưng hiệu quả trong cấu trúc LoRA, giúp cải thiện khả năng hội tụ mà không làm tăng chi phí tính toán.
NoRA cải thiện hiệu suất LoRA bằng cách chuẩn hóa ma trận chiếu dưới, giúp tăng tốc hội tụ, ổn định huấn luyện và giảm thiểu quên lãng mà không làm tăng chi phí tính toán.
GeoRA từ Meituan và Đại học Bắc Kinh giúp tối ưu hóa quá trình huấn luyện RLVR bằng cách căn chỉnh hình học cập nhật, giúp giảm 99,5% tham số cần huấn luyện mà vẫn vượt trội hơn các phương pháp như LoRA hay PiSSA trên các tác vụ toán học, y tế và lập trình.
Small models, specialized capabilities. 🚀 Developer @JacobLinCool customized MiniCPM5-1B with two …
DịchNhà phát triển JacobLinCool đã tinh chỉnh MiniCPM5-1B bằng hai bộ LoRA để tạo ra trợ lý tư vấn sáng tạo và công cụ phân loại dự án thi đấu, chứng minh tiềm năng mạnh mẽ của các mô hình nhỏ khi được tối ưu hóa cho tác vụ cụ thể.
What can you build with AI audio models beyond voice generation? 🎙️ Developer @maxar2032 has creat…
DịchPlugin ComfyUI_VoxCPM_SM mới cho phép người dùng chạy mô hình VoxCPM2 trên máy tính cá nhân với yêu cầu VRAM thấp, hỗ trợ định dạng GGUF và tinh chỉnh LoRA bằng dữ liệu giọng nói tùy chỉnh.
CLEAR là khung điều chỉnh an toàn mới sử dụng cổng điều khiển ẩn để kích hoạt bộ điều hợp LoRA linh hoạt, giúp giảm phản hồi độc hại mà vẫn giữ nguyên chất lượng câu trả lời cho các truy vấn thông thường.
Vì sao đáng đọc: Giải quyết bài toán đánh đổi giữa an toàn và hiệu năng trong LLM bằng kỹ thuật tinh chỉnh thông minh, có kết quả thực nghiệm ấn tượng trên Llama-3.
Bài viết hướng dẫn quy trình từ A-Z sử dụng TRL và LoRA để huấn luyện mô hình Qwen2.5 bằng DPO, tập trung vào việc phát hiện thiên kiến và đánh giá hiệu suất mô hình.
A streaming video LoRA adapter for MiniMax H3? This is a wild initiative, thank you! 😲 But reaching …
DịchMiniMax đang kêu gọi cộng đồng tham gia hackathon để tối ưu hóa khả năng tạo video thời gian thực trên mô hình H3 thông qua bộ chuyển đổi LoRA mới.
Hướng dẫn chi tiết quy trình tinh chỉnh LoRA cho mô hình Qwen3-0.6B, tập trung vào kỹ thuật gọi công cụ (tool-calling) thông qua định dạng ChatML và tối ưu hóa hàm mất mát.