Suy luận
CHỦ ĐỀ · TRANG 4

Suy luận

Tiến triển năng lực suy luận: Chuỗi suy nghĩ (CoT), mô hình suy luận toán học và logic đột phá.

1.246 bài thu thập130 tinh chọncập nhật đến 28/09 02:09

  1. Hugging Face Daily PapersT3 · 08/09 · 23:00

    Mô hình nền tảng nhân quả: Bước tiến mới trong suy luận nhân quả bằng AI

    Mô hình nền tảng nhân quả (CFM) cho phép ước tính các tác động nhân quả trên dữ liệu mới thông qua học trong ngữ cảnh mà không cần huấn luyện lại, thay thế quy trình xây dựng mô hình thủ công truyền thống.

  2. JiQiZhiXinT3 · 08/09 · 20:45

    Mặt Bích AI ra mắt MiniCPM5-2B: 'Siêu nhỏ' nhưng mạnh mẽ, đưa khả năng Agent lên thiết bị di động

    Mặt Bích AI vừa mã nguồn mở MiniCPM5-2B, mô hình 2 tỷ tham số sở hữu khả năng thực thi tác vụ phức tạp (Agent) ngay trên thiết bị, vượt mặt nhiều đối thủ lớn hơn về hiệu suất và khả năng suy luận.

  3. Hugging Face Daily PapersT3 · 08/09 · 14:45

    Tăng tốc LLM không mất dữ liệu bằng mô hình khuếch tán rời rạc

    Nghiên cứu giới thiệu phương pháp kết hợp mô hình khuếch tán vào LLM để tạo nhiều token song song, giúp tăng tốc độ suy luận mà không làm giảm độ chính xác so với cách dự đoán tuần tự truyền thống.

  4. Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T3 · 08/09 · 14:27

    Nhà toán học Tristan Buckmaster công bố kết quả về phương trình 'blowup' và tiết lộ trao đổi với OpenAI

    Tristan Buckmaster và Levent Alpöge đã công bố ba kết quả về hiện tượng 'blowup' trong thời gian hữu hạn đối với phương trình môi trường xốp không nén được, đồng thời chia sẻ quá trình thảo luận chuyên môn với OpenAI.

  5. vLLM Blog chính thứcT3 · 08/09 · 07:00

    vLLM kết hợp AgentX: Tối ưu hóa toàn diện cho các tác vụ suy luận AI Agent thực tế

    Đội ngũ vLLM công bố tối ưu hóa hiệu suất cho các tác vụ AI Agent, đạt tốc độ ấn tượng 83K tokens/giây trên mỗi GPU với mô hình DeepSeek V4 Pro dựa trên chuẩn AgentX.

  6. Hugging Face Daily PapersT2 · 07/09 · 17:15

    Giải mã tư duy của LLM: Cấu trúc hình học ẩn sau các chuỗi suy luận

    Nghiên cứu này khám phá cách các mô hình ngôn ngữ lớn tổ chức các thao tác suy luận như phân tích mục tiêu và suy diễn trong không gian biểu diễn ẩn, chứng minh rằng các thao tác này có cấu trúc hình học riêng biệt và không phụ thuộc vào từ vựng.

  7. Hugging Face Daily PapersT2 · 07/09 · 17:15

    TFO: Biến mô hình thị giác-ngôn ngữ (VLM) thành hệ thống hiểu âm thanh mà không cần huấn luyện lại

    TFO là giải pháp plug-and-play cho phép tích hợp khả năng hiểu âm thanh vào các mô hình VLM đóng băng mà không cần thay đổi kiến trúc hay huấn luyện lại, giúp bảo toàn nguyên vẹn năng lực suy luận thị giác ban đầu.

  8. QbitAIT2 · 07/09 · 16:00

    Huy chương Fields tham chiến AI: Sự kết hợp giữa Qwen 4B và GLM tạo đột phá tại ARC-AGI

    Sự hợp tác giữa các chuyên gia toán học hàng đầu và mô hình ngôn ngữ lớn đang mở ra hướng đi mới, khi kết hợp Qwen 4B trên thiết bị di động với sức mạnh đám mây của GLM để chinh phục thử thách ARC-AGI.

  9. JiQiZhiXinT2 · 07/09 · 14:30

    MicrosoftArgus: AI Agent tự chủ giải quyết bài toán toán học 20 năm tuổi sau 1.548 giờ nghiên cứu

    Microsoft cùng các đối tác giới thiệu Argus, hệ thống Agent đột phá có khả năng tự vận hành nghiên cứu dài hạn trong hàng nghìn giờ mà không cần con người can thiệp liên tục, đánh dấu bước tiến từ 'thực thi' sang 'tự ra quyết định' trong AI.

  10. Hugging Face Daily PapersT2 · 07/09 · 09:15

    RISE: Cải thiện mô hình ngôn ngữ thông qua chưng cất chính sách tự suy diễn

    RISE là phương pháp mới giúp mô hình tự tạo ra 'giáo viên' từ quá trình huấn luyện RLVR của chính nó. Bằng cách ngoại suy các thay đổi tham số, phương pháp này chuyển đổi các phản hồi thưa thớt thành mục tiêu học tập dày đặc ở cấp độ token mà không cần mô hình bên ngoài.

  11. Hugging Face Daily PapersT2 · 07/09 · 09:00

    Iris: Đột phá mới trong công nghệ tìm kiếm bằng AI

    Giới thiệu Iris-mini và Iris-pro, hai tác nhân tìm kiếm thông minh được huấn luyện qua quy trình xây dựng dữ liệu từ cấu trúc siêu liên kết web, giúp giải quyết các truy vấn phức tạp mà mô hình truyền thống thường thất bại.

  12. JiQiZhiXinCN · 06/09 · 22:15

    Đội ngũ 12 tiến sĩ và 1 chủ nhân giải Fields đứng sau 'ngựa ô' AI Mostik

    Startup Nga Mostik gây sốt khi leo lên top đầu bảng xếp hạng ARC-AGI-3 nhờ kỹ thuật 'cầu nối' cho phép các mô hình AI giao tiếp trực tiếp qua không gian toán học thay vì văn bản, giúp tối ưu hiệu suất vượt trội.

  13. PandailyCN · 06/09 · 21:15

    DeepSeek xây dựng siêu cụm suy luận với 160.000 chip Huawei Ascend 950DT tại Nội Mông

    DeepSeek đang triển khai một trong những cụm suy luận AI lớn nhất thế giới tại Nội Mông, sử dụng 160.000 chip Huawei Ascend 950DT với quy mô gigawatt, tùy thuộc vào tiến độ cung ứng phần cứng.

  14. JiQiZhiXinT7 · 05/09 · 18:15

    Khi AI tự nghiên cứu chính mình: Mechanist mở ra kỷ nguyên khoa học cơ chế trí tuệ máy

    Mechanist là dự án tiên phong cho phép AI tự đặt giả thuyết, thiết kế thí nghiệm và kiểm chứng để giải mã cách các mô hình ngôn ngữ lớn học tập và suy luận, thay vì phụ thuộc hoàn toàn vào con người.

  15. QbitAIT7 · 05/09 · 12:00

    Terence Tao 'cạn lời' trước cách GPT-6 giải bài toán số nguyên tố sinh đôi

    AI đưa ra đáp án chính xác cho bài toán hóc búa, nhưng Terence Tao cho rằng quy trình tư duy và cách tiếp cận vấn đề mới là điều đáng bàn hơn cả.

  16. QbitAIT7 · 05/09 · 08:30

    Cựu sinh viên lớp Diêu (Yao Class) dẫn dắt: Claude lần đầu tiên chứng minh thành công Định lý lớn Fermat

    Đội ngũ nghiên cứu do các cựu sinh viên lớp Diêu dẫn dắt đã sử dụng Claude để hoàn thiện chứng minh hình thức đầu tiên cho Định lý lớn Fermat, với sự hỗ trợ then chốt từ công cụ Harness.

  17. Anthropic: Research (công bố - Web)T7 · 05/09 · 01:58

    Claude lập kỳ tích: Tự động chứng minh Định lý Fermat trong 11 ngày

    Anthropic công bố Claude đã hoàn thành chứng minh máy tính đầu tiên cho Định lý Fermat chỉ trong 11 ngày, thông qua việc viết 13 triệu dòng mã Lean và xác thực gần 30.000 định lý trung gian.

  18. JiQiZhiXinT6 · 04/09 · 22:15

    GPT-6 Astra lập kỷ lục toán học mới: Giải mã bài toán khoảng cách số nguyên tố

    GPT-6 Astra vừa tạo dấu ấn lịch sử khi rút ngắn giới hạn khoảng cách giữa các số nguyên tố từ 246 xuống 186, đánh dấu bước tiến từ giải toán sang nghiên cứu toán học thực thụ.

  19. Greg BrockmanT6 · 04/09 · 05:07

    GPT-6 Astra thiết lập kỷ lục mới trên ARC-AGI-3: Đạt 99% điểm số, vượt xa khả năng con người

    Greg Brockman xác nhận GPT-6 Astra đạt SOTA trên ARC-AGI-3 với 99% điểm số, vượt qua con người ở 96% các tác vụ. Đáng chú ý, mô hình này tối ưu hóa chi phí hiệu quả hơn nhờ khả năng suy luận vượt trội, giảm thiểu số lượng token và lượt gọi API cần thiết.

  20. Rohan PaulT6 · 04/09 · 04:10

    Rohan Paul phân tích báo cáo an toàn 117 trang của OpenAI GPT-6 Astra

    Rohan Paul tổng hợp các điểm chính từ báo cáo của OpenAI: khả năng tự kiểm soát chuỗi suy nghĩ của Astra tăng vọt từ 16,1% (GPT-5.6 Sol) lên 60,9%, kéo theo sự sụt giảm đáng kể về khả năng giám sát.

Suy luận — Chủ Đề AI · Trang 4 | AIHOT.vn