24/09

Thứ Năm · 1 tin

23/09

Thứ Tư · 1 tin

20/09

Chủ Nhật · 1 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 46/100

GAVEL: Đưa tỷ lệ thành công của robot Qwen3-8B lên 91,8% nhờ mô hình thế giới dạng đồ thị

Impressive paper showing the impact of a good harness. Improves Qwen3-8B from 41.2% to 91.8% on lon…

DịchGAVEL giúp Qwen3-8B tăng vọt tỷ lệ thành công trong các tác vụ robot dài hạn từ 41,2% lên 91,8% bằng cách sử dụng mô hình thế giới dạng đồ thị để dự đoán hậu quả và xử lý lỗi mà không cần can thiệp vào mô hình gốc.

16/09

Thứ Tư · 1 tin

14/09

Thứ Hai · 3 tin
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 48/100

Cùng sự kiệnAnt Group ra mắt SingProbe: Công cụ kiểm soát an toàn AI dựa trên Qwen3-4B

Ant Group giới thiệu SingProbe, mô hình kiểm soát an toàn (guardrail) tích hợp trên Qwen3-4B, giúp đánh giá ý định, độ an toàn và rủi ro ảo tưởng theo thời gian thực với chi phí tính toán cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt SingProbe: Công cụ kiểm soát an toàn AI dựa trên Gemma-2»
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 42/100

Cùng sự kiệnAnt Group ra mắt Qwen3-8B-singprobe: Công cụ giám sát an toàn AI hiệu năng cao

Ant Group giới thiệu Qwen3-8B-singprobe, mô hình giám sát luồng giúp phát hiện ý định độc hại và ảo tưởng của AI theo thời gian thực với chi phí tính toán cực thấp, dưới 0,5%.

Cùng sự kiện, bài đại diện «Ant Group ra mắt SingProbe: Công cụ giám sát AI siêu nhẹ dựa trên Qwen3.5-4B»
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 43/100

Cùng sự kiệnAnt Group ra mắt Qwen3-0.6B-singprobe: Công cụ giám sát an toàn AI thời gian thực

Ant Group giới thiệu mô hình Qwen3-0.6B-singprobe, tận dụng trạng thái ẩn của mô hình nền để phát hiện rủi ro an toàn và ảo tưởng theo từng token với chi phí vận hành cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt Qwen3.5-9B-singprobe: Công cụ giám sát an toàn AI siêu nhẹ»

12/09

Thứ Bảy · 1 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 46/100

Nghiên cứu: LLM đạt điểm cao nhưng hổng kiến thức nền, Qwen3-80B chỉ đạt 48% độ nhất quán

Humans usually need the foundations before the advanced skill; we need to know the basics before the…

DịchNghiên cứu cho thấy dù Qwen3-80B đạt điểm cao hơn con người trong các bài kiểm tra, nhưng chỉ 48% câu trả lời đúng của nó đảm bảo được tính logic từ các kiến thức nền tảng, cho thấy mô hình AI hiện nay dễ bị 'học vẹt' thay vì hiểu sâu.

08/09

Thứ Ba · 1 tin

24/08

Thứ Hai · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 42/100

Meta công bố EvoHarness-RL: Đưa Qwen3-8B đạt hiệu suất 96.9% trong tác vụ ALFWorld

New Meta paper says giving an agent more memory and tools is not enough if the agent never learns wh…

DịchNghiên cứu mới từ Meta giới thiệu EvoHarness-RL, phương pháp huấn luyện RL giúp AI tự quyết định thời điểm dùng công cụ thay vì truy cập liên tục, giúp Qwen3-8B tăng vọt hiệu suất giải quyết tác vụ phức tạp.

21/08

Thứ Sáu · 1 tin

19/08

Thứ Tư · 1 tin

15/08

Thứ Bảy · 1 tin
Tổng 13 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (35 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Qwen3” | AIHOT.vn