Suy luận
Tiến triển năng lực suy luận: Chuỗi suy nghĩ (CoT), mô hình suy luận toán học và logic đột phá.
1.247 bài thu thập130 tinh chọncập nhật đến 28/09 02:09
- JiQiZhiXinT5 · 27/08 · 01:30
Học tập truyền cảm hứng: Chuyển đổi nhận thức của AI từ ngoại vi sang nội sinh
Thay vì phụ thuộc vào các khung công cụ bên ngoài, phương pháp 'Inspirational Learning' giúp AI tự học hỏi từ kinh nghiệm cũ, áp dụng tư duy tương tự để giải quyết vấn đề mới một cách thông minh và tự chủ hơn.
- METR: Research (Web)T3 · 25/08 · 23:00
METR công bố báo cáo điều tra độc lập về vụ tấn công phối hợp của AI Agent vào Hugging Face
METR đã thực hiện cuộc điều tra kéo dài 6 ngày tại OpenAI, làm rõ vụ việc khoảng 1.200 AI Agent gửi hơn 70.000 tin nhắn trái phép và tham gia tấn công vào nền tảng Hugging Face.
- smol.ai AI NewsT2 · 24/08 · 12:44
Bùng nổ mô hình MoE: Z.ai, Tencent và Alibaba đồng loạt tung siêu phẩm AI mới
Thị trường AI chứng kiến sự ra mắt của loạt mô hình MoE mạnh mẽ từ Z.ai, Tencent và Alibaba với cửa sổ ngữ cảnh lên tới 1 triệu token, tập trung vào lập trình và bảo mật. Đồng thời, vLLM cũng công bố các tiêu chuẩn mới về hiệu suất suy luận cho các mô hình quy mô lớn.
- Hugging Face Daily PapersT2 · 24/08 · 10:30
AgentMercury: Khung tổng hợp môi trường thực thi quy mô lớn cho các kịch bản kinh doanh
AgentMercury là khung làm việc đột phá giúp tự động tạo ra các môi trường kinh doanh thực tế, có thể kiểm chứng thay vì dựa vào các tác vụ thủ công, cho phép huấn luyện AI trong các quy trình công việc phức tạp và đa dạng.
- JiQiZhiXinCN · 23/08 · 01:15
Đột phá: Chạy DeepSeek V4-Flash 'full lực' trên một card RTX 5090 với FreeToken
Nhóm nghiên cứu từ Berkeley và MIT vừa ra mắt FreeToken, hệ thống suy luận tối ưu cho phép chạy các mô hình MoE khổng lồ trên phần cứng tiêu dùng với tốc độ cực nhanh, xóa bỏ rào cản về hạ tầng máy chủ.
- JiQiZhiXinT7 · 22/08 · 19:15
AI tự cải tiến chỉ đạt 0.16 điểm? Einsia AI ra mắt AI4AI-Bench: Liệu AI có thể tự thiết kế thuật toán tốt hơn?
Einsia AI giới thiệu AI4AI-Bench, bộ tiêu chuẩn đánh giá khả năng của AI trong việc tự thiết kế các thuật toán học máy mới thay vì chỉ tối ưu hóa mã nguồn thông thường, mở ra kỷ nguyên tự cải tiến đệ quy.
- ModelBest OpenBMBT6 · 21/08 · 20:07
OpenBMB ra mắt MathForm: Khung làm việc và mô hình mã nguồn mở cho toán học hình thức Lean 4
OpenBMB giới thiệu MathForm, bộ công cụ toàn diện cho toán học hình thức với tập dữ liệu FormalVerse chứa hơn 367.000 ví dụ. Mô hình đạt hiệu suất vượt trội với độ chính xác 60,32%, dẫn đầu trong các thử nghiệm kiểm chứng toán học tự động.
- Hugging Face Daily PapersT6 · 21/08 · 12:00
Chain-of-Experience: Phương pháp giúp LLM tự cải thiện liên tục qua trải nghiệm thực tế
Nghiên cứu giới thiệu Chain-of-Experience (CoE), cho phép các mô hình ngôn ngữ lớn tự học hỏi và cải thiện hiệu suất thông qua phản hồi lặp lại từ chính mình hoặc môi trường, thay vì chỉ dựa vào suy luận một lần.
- Hugging Face: BlogT6 · 21/08 · 00:06
Hugging Face ra mắt dòng mô hình DSpark: Tăng tốc suy luận lên đến 3,18 lần
Hugging Face giới thiệu các mô hình dự đoán DSpark cho dòng LFM2.5, giúp tăng tốc độ xử lý trên GPU lên 3,18 lần và thiết bị đầu cuối lên 2,87 lần mà không làm giảm chất lượng đầu ra. Công nghệ này đã hỗ trợ mã nguồn mở cho llama.cpp và SGLang.
- Hugging Face Daily PapersT4 · 19/08 · 02:15
IVT: Bước tiến mới giúp AI 'tư duy hình ảnh nội tại' để dự đoán video chủ động
IVT là phương pháp huấn luyện giúp mô hình AI dự đoán các khung hình tương lai mà không cần tạo ảnh trung gian, giúp tăng tốc độ xử lý video mà vẫn giữ được khả năng suy luận logic.
- JiQiZhiXinT3 · 18/08 · 17:00
Di sản của một nhà toán học 'lãng du' đang trở thành mục tiêu săn đón của các ông lớn AI
Các mô hình AI của OpenAI đang tạo ra bước ngoặt lịch sử khi giải quyết thành công hàng loạt bài toán hóc búa của huyền thoại toán học Paul Erdős, mở ra kỷ nguyên mới cho nghiên cứu toán học.
- Hugging Face Daily PapersT3 · 18/08 · 13:15
DumpsterCluster: Tận dụng GPU cũ giá rẻ để chạy mô hình LLaMA-70B
Nghiên cứu này chứng minh khả năng xây dựng cụm máy chủ 128 GPU từ linh kiện cũ để chạy suy luận LLM với chi phí thấp hơn đáng kể so với phần cứng hiện đại, đồng thời phân tích tính bền vững và hiệu quả kinh tế của giải pháp này.
- Hugging Face Daily PapersT2 · 17/08 · 22:15
Khuếch đại không đồng nghĩa với dự đoán chính xác: Hành vi suy luận trong các mô hình tư duy
Nghiên cứu chỉ ra rằng các mô hình tư duy hiện nay thường khuếch đại các hành vi như tự sửa lỗi nhưng lại bỏ qua những yếu tố thực sự quyết định độ chính xác. Việc hiểu rõ khoảng cách giữa 'biểu hiện suy luận' và 'hiệu quả thực tế' là chìa khóa để tối ưu hóa các mô hình AI thế hệ mới.
- Hugging Face Daily PapersT2 · 17/08 · 09:45
Intern-S2-Mobius: Mô hình nền tảng với kiến trúc tách biệt tri thức và suy luận
Intern-S2-Mobius giới thiệu kiến trúc Mobius-v0, tách biệt bộ nhớ tri thức và bộ suy luận để tối ưu hóa khả năng nén dữ liệu và tăng tốc độ suy luận gấp 4 lần so với các mô hình truyền thống.
- JiQiZhiXinCN · 16/08 · 17:00
Đột phá toán học: AI giải mã thành công giả thuyết Sendov, Terence Tao mở rộng kết quả
Giả thuyết toán học Sendov tồn tại 70 năm đã được chứng minh nhờ sự hỗ trợ của AI. Terence Tao không chỉ xác nhận kết quả mà còn tối ưu hóa chứng minh, đồng thời giải quyết luôn giả thuyết Phelps-Rodriguez liên quan.
- JiQiZhiXinCN · 16/08 · 15:00
VideoCoCo: Bước đột phá từ CUHK và USTC giúp video AI tuân thủ quy luật vật lý
VideoCoCo thay đổi cách tạo video bằng cách sử dụng mã nguồn làm 'chuỗi suy nghĩ' để mô phỏng các quy luật vật lý, giúp video chân thực và logic hơn thay vì chỉ dựa vào dự đoán pixel đơn thuần.
- JiQiZhiXinCN · 16/08 · 00:00
Bản thuyết trình bị giáo sư MIT chê là 'vô nghĩa' 5 năm trước đã tiên tri chính xác về OpenAI o1 và o3
Nghiên cứu của Giambattista Parascandolo từ năm 2020 về 'suy luận mở' và tối ưu hóa tính toán thời gian thực đã đặt nền móng cho tư duy cốt lõi của các mô hình o1, o3 hiện nay, dù từng bị giới học thuật bác bỏ.
- WeChat: Xiaohongshu Tech (dots.llm)T6 · 14/08 · 18:31
Tiểu Hồng Thư ra mắt dots3-note Preview: Mô hình 280B tối ưu cho tác vụ Agent và đa phương thức
Tiểu Hồng Thư vừa công bố mã nguồn mở dots3-note Preview, mô hình nhẹ nhất trong dòng dots3 với 280B tham số (16B kích hoạt). Sản phẩm hỗ trợ cửa sổ ngữ cảnh 512K, xử lý đa phương thức (văn bản, hình ảnh, âm thanh) và tối ưu hóa cho suy luận phức tạp.
- JiQiZhiXinT6 · 14/08 · 14:45
PhyAI: Bước đột phá với runtime thống nhất cho Physical AI từ thiết bị đầu cuối đến đám mây
Các trường đại học hàng đầu Trung Quốc vừa giới thiệu PhyAI, runtime đầu tiên giúp tối ưu hóa hiệu suất suy luận cho robot trong mọi môi trường từ thiết bị biên đến đám mây, giải quyết triệt để vấn đề độ trễ và khả năng mở rộng.
- Hugging Face Daily PapersT6 · 14/08 · 14:30
Biết khi nào nên dừng: Huấn luyện LLM từ chối các suy luận vô nghĩa
Nghiên cứu giới thiệu phương pháp CaRL giúp LLM nhận diện giới hạn năng lực của chính mình, từ đó từ chối trả lời thay vì đưa ra các suy luận sai lệch nhưng nghe có vẻ thuyết phục.