18/08

Thứ Ba · 1 tin

17/08

Thứ Hai · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

SPARGen: Hợp nhất nhận thức và suy luận không gian thông qua mô hình tạo sinh đa phương thức

SPARGen là khung làm việc đa phương thức thống nhất, giải quyết các bài toán tái dựng 3D, tương ứng mật độ và suy luận không gian bằng cách chuyển đổi chúng thành các tác vụ tạo sinh có điều kiện, giúp tối ưu hóa khả năng biểu diễn không gian.

15/08

Thứ Bảy · 2 tin
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnECCV 2026: UniMotion - Bước tiến mới đưa chuyển động liên tục vào mô hình đa phương thức

UniMotion là khung mô hình thống nhất đầu tiên tích hợp chuyển động liên tục cùng văn bản và hình ảnh, giải quyết hiệu quả các bài toán từ hiểu, tạo lập đến chỉnh sửa chuyển động con người một cách tự nhiên và chính xác.


Vì sao đáng đọc: Nghiên cứu đột phá được chấp nhận tại ECCV 2026, giải quyết lỗ hổng quan trọng trong việc xử lý chuyển động liên tục của con người trong các mô hình đa phương thức hiện nay.
AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 50/100

Xiaohongshu ra mắt mô hình AI dots3-note: Trợ lý thông minh cho cuộc sống hàng ngày

Xiaohongshu (RedNote) -often called China's Facebook, with 350 million users and over a decade of lif…

DịchXiaohongshu vừa mã nguồn mở dots3-note, mô hình MoE 280B với cửa sổ ngữ cảnh 512K, hỗ trợ đa phương thức và tối ưu hóa cho các tác vụ dài hạn trong đời sống thông qua phương pháp huấn luyện TEMPO.

14/08

Thứ Sáu · 9 tin
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 68/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-27B: Mô hình đa phương thức mã nguồn mở mạnh mẽ

Alibaba dropped the weights for Qwen3.8-27B as a 27B open-weight multimodal model built for local de…

DịchAlibaba vừa phát hành Qwen3.8-27B, mô hình đa phương thức 27 tỷ tham số theo giấy phép Apache 2.0, hỗ trợ tốt các framework như Transformers, vLLM và triển khai lượng tử hóa cục bộ.

Cùng sự kiện, tinh chọn hiển thị «Alibaba chính thức mã nguồn mở dòng mô hình Qwen3.8 mạnh mẽ»
Kim@kimmonismus
Mô hìnhĐiểm AI 42/100

Cùng sự kiệnQwen3.8-27B: Mô hình mã nguồn mở nhỏ gọn thách thức đẳng cấp Claude Opus 4.6 Max

So yeah, you can now run Opus 4.6 max locally. Just let that sink in.

DịchQwen ra mắt mô hình đa phương thức 27B với khả năng lập trình và điều khiển máy tính vượt trội Claude Opus 4.6 Max. Hỗ trợ cửa sổ ngữ cảnh lên tới 1M token và giấy phép Apache 2.0 cho phép tự triển khai cục bộ.

Cùng sự kiện, tinh chọn hiển thị «Alibaba chính thức mã nguồn mở dòng mô hình Qwen3.8 mạnh mẽ»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)@alibaba_qwen
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnQwen3.8-27B ra mắt: Mô hình đa phương thức 27B vượt mặt bản Qwen3.7-Plus

Alibaba trình làng Qwen3.8-27B, mô hình đa phương thức mạnh mẽ với 27 tỷ tham số, hỗ trợ ngữ cảnh 262K và có thể mở rộng lên 1M token. Model này vượt trội trong lập trình và xử lý công việc văn phòng, đồng thời được phát hành theo giấy phép Apache 2.0.

Cùng sự kiện, tinh chọn hiển thị «Alibaba chính thức mã nguồn mở dòng mô hình Qwen3.8 mạnh mẽ»
Kim@kimmonismus
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnQwen3.8-27B ra mắt: Mô hình nhỏ thách thức các AI Agent hàng đầu

Qwen-3.8 27b released! Significant jump! Qwen just released Qwen3.8-27B, a compact open-weight mult…

DịchAlibaba trình làng Qwen3.8-27B, mô hình đa phương thức mã nguồn mở với khả năng lập trình và điều khiển máy tính vượt trội, thách thức cả Claude Opus 4.6 Max dù chỉ sở hữu 27 tỷ tham số.

Cùng sự kiện, tinh chọn hiển thị «Alibaba chính thức mã nguồn mở dòng mô hình Qwen3.8 mạnh mẽ»
WeChat: Xiaohongshu Tech (dots.llm)
Mô hìnhĐiểm AI 79/100

Tinh chọnTiểu Hồng Thư ra mắt dots3-note Preview: Mô hình 280B tối ưu cho tác vụ Agent và đa phương thức

Tiểu Hồng Thư vừa công bố mã nguồn mở dots3-note Preview, mô hình nhẹ nhất trong dòng dots3 với 280B tham số (16B kích hoạt). Sản phẩm hỗ trợ cửa sổ ngữ cảnh 512K, xử lý đa phương thức (văn bản, hình ảnh, âm thanh) và tối ưu hóa cho suy luận phức tạp.

Diễn biến sự kiện · 2 bài →Thêm 1 nguồn khác đưa tinX: Kim (@kimmonismus)

Vì sao đáng đọc: Đây là bước tiến đáng chú ý từ một nền tảng lớn như Tiểu Hồng Thư, mô hình có thông số kỹ thuật ấn tượng cho các tác vụ Agent và đa phương thức, rất phù hợp với xu hướng AI hiện nay.
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Nghiên cứu Meta & Oxford: Mô hình đa phương thức chỉ cần 5% dữ liệu tạo ảnh để đạt hiệu suất tối ưu

The Meta/Oxford study finds, a multimodal model may need surprisingly little image-generation data i…

DịchNghiên cứu chỉ ra rằng việc cân bằng tỷ lệ dữ liệu ngôn ngữ và hình ảnh giúp mô hình đa phương thức đạt hiệu suất cao hơn dù giảm 5 lần dữ liệu tạo ảnh. Đồng thời, việc đưa hình ảnh vào quá muộn dễ gây ra tình trạng 'lười thị giác', khiến mô hình quá phụ thuộc vào ngôn ngữ.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 53/100

OmniScientist: Hệ thống AI toàn năng tự động thực hiện nghiên cứu khoa học đa ngành

OmniScientist là AI khoa học đầu tiên xử lý trực tiếp dữ liệu thô đa phương thức (hình ảnh, âm thanh, 3D, bảng biểu) để tự động hoàn thiện quy trình nghiên cứu từ dữ liệu đến bài báo khoa học hoàn chỉnh trên nhiều lĩnh vực.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Mô hìnhĐiểm AI 66/100

Intern-S2-Preview: Mô hình nền tảng AI đột phá cho khám phá khoa học

Intern-S2-Preview là dòng mô hình nền tảng đa phương thức chuyên dụng cho nghiên cứu khoa học, hỗ trợ suy luận phức tạp và xử lý chuỗi thời gian dài với hiệu suất vượt trội trên nhiều tiêu chuẩn đánh giá.

13/08

Thứ Năm · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Ảo tưởng về công cụ thị giác: Đánh giá nhân quả khả năng 'tư duy bằng hình ảnh' của LLM

Nghiên cứu chỉ ra rằng các thao tác thị giác như cắt/phóng ảnh trong LLM đa phương thức thường không cải thiện hiệu suất đáng kể mà lại gây tốn kém tài nguyên. Tác giả đề xuất mô hình đồ thị nhân quả để kiểm chứng liệu các công cụ này có thực sự hỗ trợ tư duy hay chỉ là sự ngẫu nhiên.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

NeuPAT: Tối ưu hóa phân bổ độ dẻo thần kinh giúp mô hình đa phương thức giữ vững khả năng ngôn ngữ

NeuPAT là phương pháp mới giúp bảo vệ các neuron quan trọng trong LLM khi huấn luyện đa phương thức, ngăn chặn tình trạng suy giảm khả năng ngôn ngữ vốn có bằng cách phân bổ mức độ cập nhật linh hoạt cho từng neuron.

12/08

Thứ Tư · 3 tin
Luma AI@LumaLabsAI
Sản phẩmĐiểm AI 57/100

Luma AI tích hợp mô hình đa phương thức FLUX 3

FLUX 3 is now live in Luma. @bfl_ai 's first general model for image, video, audio, and action-pred…

DịchLuma AI vừa ra mắt FLUX 3, mô hình đa phương thức đầu tiên từ Black Forest Labs hỗ trợ xử lý đồng thời hình ảnh, video, âm thanh và dự đoán chuyển động. Người dùng hiện đã có thể trải nghiệm tính năng tạo video kèm âm thanh gốc ngay trên nền tảng.

Tổng 18 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (22 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “đa phương thức” — Trang 5 | AIHOT.vn