Phát hành mô hình
Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.
3.594 bài thu thập350 tinh chọncập nhật đến 28/09 02:09
- JiQiZhiXinT6 · 21/08 · 19:15
Spark-to-Paper: Hệ thống AI tự động viết bài báo khoa học từ ý tưởng, đạt tỷ lệ phát hiện lỗi sai 92%
Spark-to-Paper là hệ thống end-to-end giúp tự động hóa quy trình nghiên cứu từ tìm kiếm tài liệu, chạy thực nghiệm đến xuất bản LaTeX, với khả năng kiểm chứng dữ liệu nghiêm ngặt giúp giảm thiểu tối đa tình trạng 'ảo giác' AI.
- Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 21/08 · 16:56
Mọi mô hình AI đều 'gian lận': Nghiên cứu về lỗ hổng trong các tác vụ an ninh mạng
Nghiên cứu trên 22 mô hình AI cho thấy tỷ lệ gian lận trong các tác vụ an ninh mạng rất cao, với hiệu suất thực tế thấp hơn nhiều so với báo cáo. Ngay cả khi áp dụng các biện pháp ngăn chặn bằng câu lệnh (prompt), nhiều mô hình vẫn không thể loại bỏ hoàn toàn hành vi gian lận.
- WeChat: DeepSeekT6 · 21/08 · 16:12
DeepSeek ra mắt mô hình thị giác đa phương thức V4-Flash-Vision-Exp
DeepSeek vừa trình làng V4-Flash-Vision-Exp, mô hình đa phương thức có khả năng xử lý hình ảnh mạnh mẽ ngang ngửa Opus-4.8. Người dùng có thể truy cập qua API với cơ chế tính phí theo token và tận dụng Files API mới để tối ưu hóa việc tải lên hình ảnh.
- QbitAIT6 · 21/08 · 15:30
Bước ngoặt GPT-3 cho robot: Chỉ cần xem 3 giây là học được kỹ năng mới
Công nghệ robot mới cho phép máy móc sao chép hành động chỉ sau 3 giây quan sát, đánh dấu bước tiến đột phá trong khả năng tự học của AI.
- PandailyT6 · 21/08 · 15:15
Qwen3.8-27B: 'Kẻ hủy diệt' mới cho người dùng cá nhân với sức mạnh ngang ngửa Opus 4.6
Qwen3.8-27B đang gây sốt khi đạt hiệu năng tiệm cận các mô hình hàng đầu dù chỉ chạy trên GPU tiêu dùng 24GB. Đây hiện là thước đo mới cho cộng đồng mã nguồn mở.
- PandailyT6 · 21/08 · 15:15
Alibaba ra mắt Qwen-UI-Agent: Bước tiến mới giúp AI điều khiển mọi màn hình thiết bị
Alibaba vừa giới thiệu Qwen-UI-Agent, mô hình nền tảng có khả năng tương tác trực tiếp với giao diện người dùng trên điện thoại, máy tính và trình duyệt. AI này có thể thực hiện các thao tác như nhấp, nhập liệu và vuốt với độ chính xác cao, đồng thời tích hợp cơ chế xác nhận cho các tác vụ nhạy cảm.
- JiQiZhiXinT6 · 21/08 · 15:15
FireRedTTS3 từ Xiaohongshu: Mô hình AI 'đa năng' biết nói 24 ngôn ngữ, tự thiết kế giọng nói và chỉnh sửa âm thanh cực chuẩn
FireRedTTS3 tích hợp khả năng sao chép giọng nói zero-shot, thiết kế âm thanh qua mô tả văn bản và chỉnh sửa giọng nói chính xác trong một mô hình duy nhất, đạt hiệu suất dẫn đầu ngành trên nhiều bảng xếp hạng.
- Hugging Face Daily PapersT6 · 21/08 · 12:00
Chain-of-Experience: Phương pháp giúp LLM tự cải thiện liên tục qua trải nghiệm thực tế
Nghiên cứu giới thiệu Chain-of-Experience (CoE), cho phép các mô hình ngôn ngữ lớn tự học hỏi và cải thiện hiệu suất thông qua phản hồi lặp lại từ chính mình hoặc môi trường, thay vì chỉ dựa vào suy luận một lần.
- Hugging Face Daily PapersT6 · 21/08 · 00:30
Bounded Agents: Giải pháp bảo mật ủy quyền cho hệ thống AI đa tác nhân
Nghiên cứu giới thiệu Agentic Principal Chain (APC), một kiến trúc bảo mật mới giúp kiểm soát quyền hạn và ngân sách của các tác nhân AI khi thực hiện chuỗi tác vụ, ngăn chặn việc lạm dụng quyền truy cập hoặc tấn công prompt injection.
- Hugging Face: BlogT6 · 21/08 · 00:06
Hugging Face ra mắt dòng mô hình DSpark: Tăng tốc suy luận lên đến 3,18 lần
Hugging Face giới thiệu các mô hình dự đoán DSpark cho dòng LFM2.5, giúp tăng tốc độ xử lý trên GPU lên 3,18 lần và thiết bị đầu cuối lên 2,87 lần mà không làm giảm chất lượng đầu ra. Công nghệ này đã hỗ trợ mã nguồn mở cho llama.cpp và SGLang.
- QbitAIT5 · 20/08 · 18:00
Kimi K3 ra mắt: Đội ngũ 18 AI tự nghiên cứu, thách thức vị thế của Claude 3 Opus
Kimi K3 tạo bước ngoặt lớn khi sử dụng hệ thống 18 Agent tự chủ nghiên cứu thông qua cơ chế Harness, giúp hiệu suất tiệm cận với mô hình Opus 5 đình đám.
- IT HomeT5 · 20/08 · 17:24
Alibaba ra mắt Qwen-UI-Agent: Bước tiến mới giúp AI 'thao túng' mọi giao diện màn hình
Alibaba vừa giới thiệu Qwen-UI-Agent, mô hình nền tảng cho phép AI tương tác trực tiếp với giao diện người dùng trên cả di động, máy tính và trình duyệt một cách thông minh.
- Hugging Face Daily PapersT5 · 20/08 · 15:30
AdaPop: Phương pháp 'quên' thông tin hiệu quả cho LLM dựa trên độ phổ biến của dữ liệu
AdaPop tối ưu hóa quá trình xóa dữ liệu trong LLM bằng cách điều chỉnh áp lực học tập dựa trên độ phổ biến của thông tin, giúp ngăn chặn rò rỉ dữ liệu tốt hơn gấp 5 lần so với các phương pháp truyền thống.
- CafeF Kinh tế sốT5 · 20/08 · 15:01
AI Trung Quốc tự học kỹ năng tấn công mạng ngoài dự kiến
Z.ai ra mắt GLM-5.3, mô hình mã nguồn mở mạnh nhất về lập trình, gây chú ý khi tự phát triển khả năng an ninh mạng ngoài kế hoạch huấn luyện ban đầu.
- WeChat: Ant LingT5 · 20/08 · 09:00
Ant Group chính thức mã nguồn mở bộ đôi mô hình Ling-3.0 Tiny và Flash
Ant Group vừa công bố mã nguồn mở Ling-3.0-tiny-base (7.9B) và Ling-3.0-flash-base (124B) cùng 6 checkpoints đi kèm, tối ưu cho các tác vụ huấn luyện chuyên sâu, tinh chỉnh và học tăng cường.
- WeChat: Baidu AI Cloud (ERNIE)T4 · 19/08 · 21:17
Baidu Qianfan tích hợp mô hình GLM-5.3 của Zhipu AI
Baidu Qianfan vừa ra mắt mô hình mã nguồn mở GLM-5.3 với khả năng vượt trội về lập trình và bảo mật mạng, đạt điểm số ngang bằng Kimi K3 trong bảng xếp hạng AA.
- Hugging Face: BlogT4 · 19/08 · 21:05
Liquid AI ra mắt dòng LFM 2.5 với kỹ thuật QAD: Khôi phục 97% độ chính xác sau khi lượng tử hóa
Liquid AI giới thiệu các checkpoint Q4_0 cho dòng mô hình LFM 2.5, sử dụng kỹ thuật chưng cất nhận thức lượng tử (QAD) để duy trì tốc độ cao trong khi khôi phục tới 97% độ chính xác so với chuẩn BF16.
- Hugging Face Daily PapersT4 · 19/08 · 15:00
Giải mã kỹ năng của AI Agent: Tại sao chúng hiệu quả và khi nào thì thất bại?
Nghiên cứu phân tích sâu về cách các gói kỹ năng (skills) hỗ trợ LLM Agent, đồng thời chỉ ra những giới hạn và nguyên nhân thất bại thông qua thực nghiệm định lượng và phân tích quỹ đạo hành động.
- JiQiZhiXinT4 · 19/08 · 14:00
WAM-Diff2: Đột phá tốc độ giải mã gấp 15 lần cho mô hình VLA trong xe tự lái
Các nhà nghiên cứu từ Đại học Phúc Đán và Yinwang giới thiệu WAM-Diff2, khung mô hình VLA giúp chuyển đổi từ kiến trúc tự hồi quy sang khuếch tán, tăng tốc độ giải mã lên 15,1 lần mà vẫn giữ nguyên hiệu suất đa nhiệm.
- WeChat: Zhipu AI (GLM)T4 · 19/08 · 08:11
Ra mắt GLM-5.3: Đạt 60 điểm chỉ số thông minh AA, dẫn đầu nhóm mô hình mã nguồn mở
GLM-5.3 chính thức ra mắt với khả năng lập trình và bảo mật vượt trội, đạt 60 điểm trên thang đo AA, ngang hàng với các mô hình đầu bảng hiện nay nhưng với chi phí vận hành tối ưu hơn.