Hugging Face chia sẻ cách dùng thư viện TRL để tinh chỉnh mô hình LiquidAI trên GPU miễn phí. Chỉ với 500 mẫu và 100 bước huấn luyện, hiệu suất đạt chuẩn IFStruct đã cải thiện đáng kể từ 22.6% lên 29.7%.
Bài viết cung cấp quy trình toàn diện sử dụng LangSmith để quản lý dữ liệu, tinh chỉnh và kiểm chứng hiệu quả các mô hình LLM như LLaMA2 và GPT-3.5, giúp nhà phát triển tối ưu hóa mô hình một cách hệ thống.
AI agents are becoming capable builders.👍 Powered by MiniCPM-o-4.5 and a strong open-source ecosy…
DịchOpenBMB giới thiệu khả năng của MiniCPM-o-4.5 trong việc điều khiển AI Agent tự động hóa toàn bộ quy trình từ hiểu mô hình, tinh chỉnh đến triển khai, điển hình là việc hoàn tất tinh chỉnh mô hình đa phương thức chỉ trong 68 phút với tương tác tối thiểu.
Bài viết hướng dẫn quy trình từ A-Z sử dụng TRL và LoRA để huấn luyện mô hình Qwen2.5 bằng DPO, tập trung vào việc phát hiện thiên kiến và đánh giá hiệu suất mô hình.
New Meta paper shows, small models may not be bad predictors of scale; they may just be getting unde…
DịchNghiên cứu của Meta chỉ ra rằng các mô hình nhỏ có thể đạt hiệu suất cao nếu được tinh chỉnh siêu tham số kỹ lưỡng. Các mô hình này bắt đầu tuân theo quy luật mở rộng từ quy mô 4 triệu tham số và cực kỳ nhạy cảm với cấu hình huấn luyện.
Hướng dẫn chi tiết quy trình tinh chỉnh LoRA cho mô hình Qwen3-0.6B, tập trung vào kỹ thuật gọi công cụ (tool-calling) thông qua định dạng ChatML và tối ưu hóa hàm mất mát.
We want our models to be widely accessible and customizable for the dev community. So we got some pa…
DịchCohere bắt tay với các đối tác nhằm hỗ trợ cộng đồng lập trình viên tùy chỉnh và triển khai mô hình, tiêu biểu là việc tinh chỉnh North Micro Vision cho các tác vụ hiểu tài liệu trên thiết bị biên.