Nghiên cứu
Ra mắt LLaDA-Image: Mô hình tạo ảnh mạnh mẽ với công thức huấn luyện hoàn toàn mở
(giờ Việt Nam)
Tóm tắt AI
LLaDA-Image là khung làm việc thống nhất kết hợp Diffusion Transformer 6B được huấn luyện từ đầu với mô-đun hiểu ngôn ngữ hình ảnh dựa trên nền tảng LLaDA2.0-Mini.
Chính văn · Bản dịch AI
Tác giả: Chuyan Chen, Haoxing Chen, Kun Chen, Zhenglin Cheng, Long Cui, Ruishan Fang, Zhangxuan Gu, Zhicheng Huang, Zhenzhong Lan, Yuanting Lei, Haoquan Li, Jianguo Li, Rongchuan Li, Sidu Li, Tao Lin, Deyuan Liu, Jiacheng Liu, Lin Liu, Yuxuan Lou, Zhisheng Lu, Yuxin Ma, Shuheng Shen, Peng Sun, Chaoyang Wang, Hongjun Wang, Xiaomei Wang, Yongxin Wang, Chengzhang Wu, Hongru Wu, Jun Xie
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Jun Xie [xem email] [v1] Thứ Năm, ngày 3 tháng 9 năm 2026 13:02:40 UTC (44.735 KB)
Bài viết được AI dịch và tổng hợp tự động từ HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.