Nghiên cứu & Luận văn
Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.
2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40
- JiQiZhiXinCN · 30/08 · 14:00
AI định hình năng suất lao động thế nào? Báo cáo 68 trang từ 12 đại học hàng đầu thế giới
Nhóm nghiên cứu từ Đại học Fudan, Stanford và Oxford công bố báo cáo chuyên sâu về cách Agentic AI chuyển đổi từ công cụ hỗ trợ thành tác nhân thực thi, tái cấu trúc quy trình làm việc và năng suất trong 11 ngành công nghiệp trọng điểm.
- JiQiZhiXinT7 · 29/08 · 23:45
AI bắt đầu tự tay làm thí nghiệm: Kỷ nguyên mới của nghiên cứu khoa học
Anthropic và Google DeepMind đang hiện thực hóa viễn cảnh AI điều khiển thiết bị vật lý. Thông qua các tiêu chuẩn kết nối mới, AI không chỉ dừng lại ở lý thuyết mà đã có thể trực tiếp vận hành máy móc, tự thiết kế và thực thi các thí nghiệm khoa học phức tạp.
- JiQiZhiXinT7 · 29/08 · 23:45
Recuris: Bước đột phá mới về bộ nhớ cho AI Agent, giúp nâng cấp hiệu suất từ mô hình 3B đến Claude Opus 5
Recuris là kiến trúc AI Agent đầu tiên áp dụng cơ chế tự cải tiến đệ quy vào tầng kiểm soát bộ nhớ, giúp giải quyết vấn đề nhiễu thông tin và tối ưu hóa khả năng thực hiện các tác vụ dài hạn mà không cần đào tạo lại.
- IT HomeT7 · 29/08 · 20:00
Đột phá từ Harvard: Thiết kế protein nhân tạo với 34 loại axit amin mà không cần tế bào sống
Nhóm nghiên cứu tại Harvard phát triển công cụ AGENTEX cho phép tổng hợp protein từ 34 loại axit amin trong ống nghiệm, vượt xa giới hạn 20 loại tự nhiên mà không cần chỉnh sửa bộ gen tế bào.
- JiQiZhiXinT7 · 29/08 · 15:45
Anthropic đột phá: AI tự căn chỉnh AI, hiệu suất tăng gấp 15.000 lần
Anthropic giới thiệu nghiên cứu về 'Nhà nghiên cứu căn chỉnh tự động' (AAR), cho phép AI tự thiết lập hướng nghiên cứu và giải quyết các lỗi an toàn với chi phí thấp hơn 37 lần so với con người, đạt hiệu quả vượt trội trong việc sửa lỗi mô hình.
- JiQiZhiXinT7 · 29/08 · 15:45
TikTok và Đại học Bắc Kinh ra mắt hệ thống thông báo thông minh STEPS, được vinh danh tại RecSys 2026
TikTok và ĐH Bắc Kinh giới thiệu STEPS, hệ thống thông báo tự kích hoạt dựa trên tác nhân (Agentic) giúp tối ưu hóa thời điểm gửi tin. Hệ thống đã triển khai thành công cho hơn 1 tỷ người dùng, giúp tăng tỷ lệ hoạt động và giảm đáng kể tỷ lệ người dùng tắt thông báo.
- Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T7 · 29/08 · 14:56
Đột phá toán học: Hệ thống đa tác nhân AI tự chủ khám phá các định lý mới
Trong môi trường Station, các tác nhân AI tự phối hợp nghiên cứu, thực hiện thí nghiệm và xây dựng tài liệu khoa học, từ đó tìm ra các kết quả toán học mới vượt xa các nghiên cứu hiện có, bao gồm các tập hợp Kakeya và cấu hình điểm phức tạp.
- Hugging Face Daily PapersT7 · 29/08 · 07:30
Luce: Công nghệ Gaussian tái chiếu sáng cho tạo hình tài sản 3D
Luce là mô hình 3D đột phá kết hợp hình học và vật liệu PBR vào đám mây Gaussian, cho phép tạo tài sản 3D chất lượng cao từ một ảnh duy nhất với khả năng tái chiếu sáng linh hoạt.
- Anthropic: Research (công bố - Web)T7 · 29/08 · 00:25
Anthropic dùng Claude tự huấn luyện mô hình, giải quyết triệt để các lỗi căn chỉnh AI
Anthropic áp dụng phương pháp để Claude tự huấn luyện nhằm khắc phục 10 loại lỗi căn chỉnh như gian lận hay nịnh hót. Kết quả cho thấy Claude vượt trội hơn cả các chuyên gia con người trong việc xử lý các tình huống an toàn mà không làm giảm năng lực tổng quát của mô hình.
- JiQiZhiXinT6 · 28/08 · 19:45
Code-as-World: Bước tiến mới giúp AI 'giải mã' thế giới vật lý từ video
Thay vì chỉ mô phỏng hình ảnh, khung làm việc Code-as-World cho phép AI tái tạo thế giới thực dưới dạng mã nguồn có thể thực thi và kiểm chứng, từ đó giúp máy móc hiểu sâu sắc các quy luật vật lý thay vì chỉ bắt chước bề nổi.
- JiQiZhiXinT6 · 28/08 · 19:45
Harness Continual Learning: Bước tiến mới trong học liên tục cho AI Agent
Nghiên cứu đề xuất phương pháp học liên tục mới, tập trung tối ưu hóa hệ thống hỗ trợ (Harness) thay vì chỉ tinh chỉnh tham số mô hình, giúp AI Agent tiến hóa linh hoạt mà không cần huấn luyện lại.
- Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 28/08 · 19:25
Terminal-Bench-Science 0.1: Bộ tiêu chuẩn mới đánh giá năng lực AI trong nghiên cứu khoa học
Các nhà nghiên cứu tại Stanford vừa ra mắt Terminal-Bench-Science 0.1, bộ benchmark gồm 70 tác vụ chuyên sâu thuộc nhiều lĩnh vực khoa học nhằm đo lường khả năng thực hiện quy trình nghiên cứu thực tế của các AI agent.
- JiQiZhiXinT6 · 28/08 · 13:45
ECCV 2026 Oral: MAVIN - Bước tiến mới giúp AI 'đạo diễn' video đa góc quay theo kịch bản
MAVIN là mô hình tiên phong cho phép AI tạo video đa góc quay với khả năng kiểm soát chặt chẽ về thời gian, đồng bộ âm thanh và nhất quán nhân vật, giải quyết bài toán khó trong việc kể chuyện bằng video dài.
- Hugging Face Daily PapersT6 · 28/08 · 11:45
Procedura: Bước tiến mới trong mô hình hóa 3D bằng tác nhân AI và lập trình tham số
Procedura là khung tác nhân AI mới giúp chuyển đổi văn bản thành các mô hình 3D dưới dạng mã nguồn có cấu trúc, cho phép chỉnh sửa tham số và đảm bảo tính chính xác về kỹ thuật thay vì chỉ tạo lưới bề mặt đơn thuần.
- Hugging Face Daily PapersT6 · 28/08 · 11:45
Phát triển game bằng AI: Đột phá mới trong việc huấn luyện mô hình thế giới thông qua dữ liệu có thể kiểm chứng
Nghiên cứu đề xuất sử dụng công cụ phát triển game làm môi trường huấn luyện mô hình thế giới, cung cấp tín hiệu phản hồi chính xác về vật lý và va chạm thay vì dựa vào các chỉ số mơ hồ như CLIP.
- Hugging Face Daily PapersT6 · 28/08 · 09:45
Zero-WAM: Mô hình hóa hành động từ video người để robot thực hiện tác vụ mới
Zero-WAM là mô hình video-hành động cho phép robot thực hiện các tác vụ chưa từng học thông qua việc quan sát video hướng dẫn từ con người, giúp giải quyết bài toán tổng quát hóa trong điều khiển robot.
- JiQiZhiXinT6 · 28/08 · 01:45
AI viết code 'lấn sân' robot: Coding-agent đạt tỷ lệ điều hướng thành công 78% mà không cần huấn luyện chuyên biệt
Nhóm nghiên cứu từ ĐH Adelaide chứng minh các coding-agent như Claude Code có thể điều khiển robot trong môi trường lạ chỉ với camera đơn và 4 nút lệnh, đạt hiệu suất ngang ngửa các mô hình chuyên dụng mà không cần đào tạo lại.
- LMSYS: Blog (nhóm Chatbot Arena)T6 · 28/08 · 00:57
MiniMax-H3 trên 8x H200: Tăng tốc không mất dữ liệu lên tới 1,95 lần
Nhóm SGLang Diffusion thử nghiệm MiniMax-H3 trên 8 GPU NVIDIA H200, đạt tốc độ nhanh gấp 1,95 lần so với Diffusers mà không làm giảm chất lượng hình ảnh.
- JiQiZhiXinT5 · 27/08 · 23:45
Thử thách 'địa ngục' cho AI: Chuyển đổi 200.000 dòng code mà không được sai sót
SWE Refactor Bench ra đời để kiểm tra khả năng tái cấu trúc toàn bộ hệ thống quy mô lớn của AI. Đây là bài kiểm tra khắc nghiệt hơn nhiều so với việc sửa lỗi thông thường, nơi các mô hình hàng đầu như GPT hay Claude hiện vẫn đang gặp khó khăn.
- JiQiZhiXinT5 · 27/08 · 19:45
ECCV 2026 | OmniColor: Khung làm việc thống nhất cho tô màu tranh vẽ nét đa phương thức
OmniColor là giải pháp đột phá từ ĐH Bách khoa Hồng Kông, cho phép tô màu tranh vẽ nét dựa trên sự kết hợp linh hoạt giữa văn bản, gợi ý màu sắc, hình ảnh tham chiếu và khung hình lịch sử, giải quyết triệt để vấn đề xung đột điều kiện trong quy trình sản xuất hoạt hình chuyên nghiệp.