Suy luận
CHỦ ĐỀ · TRANG 7

Suy luận

Tiến triển năng lực suy luận: Chuỗi suy nghĩ (CoT), mô hình suy luận toán học và logic đột phá.

1.248 bài thu thập132 tinh chọncập nhật đến 28/09 00:12

  1. Hugging Face Daily PapersT6 · 14/08 · 14:30

    Biết khi nào nên dừng: Huấn luyện LLM từ chối các suy luận vô nghĩa

    Nghiên cứu giới thiệu phương pháp CaRL giúp LLM nhận diện giới hạn năng lực của chính mình, từ đó từ chối trả lời thay vì đưa ra các suy luận sai lệch nhưng nghe có vẻ thuyết phục.

  2. Hugging Face Daily PapersT6 · 14/08 · 09:30

    Full-bandwidth Transformer: Đột phá mới trong kiến trúc mô hình ngôn ngữ

    Full-bandwidth Transformer cải thiện khả năng suy luận bằng cách truyền trạng thái ẩn từ lớp trên cùng trở lại đầu vào, giúp mô hình tận dụng được các tính toán chuyên sâu thay vì chỉ dựa vào token đã tạo.

  3. OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)T6 · 14/08 · 01:19

    Hướng dẫn xây dựng với GPT-5.6: Tối ưu chi phí cho hiệu năng AI Agent vượt trội

    Dòng model GPT-5.6 mang đến khả năng suy luận bền bỉ và điều phối đa tác nhân với chi phí thấp hơn đáng kể. Đặc biệt, model Luna đạt hiệu suất ngang ngửa bản 5.5 nhưng giảm chi phí vận hành tới 25 lần.

  4. QbitAIT5 · 13/08 · 19:00

    Claude giải mã thành công ma trận Hadamard bậc dưới 2000: AI bắt đầu chinh phục các bài toán toán học hóc búa

    Claude vừa đạt bước tiến lớn khi giải quyết triệt để các ma trận Hadamard dưới bậc 2000, cho thấy tiềm năng của AI trong việc xử lý những bài toán toán học chưa có lời giải.

  5. QbitAIT5 · 13/08 · 16:00

    Nóng: Ilya Sutskever hé lộ mô hình đầu tiên từ SSI

    SSI vừa chính thức trình làng mô hình đầu tiên, đánh dấu bước tiến đột phá trong việc giải quyết bài toán học liên tục (continual learning) cho AI.

  6. JiQiZhiXinT5 · 13/08 · 04:45

    Đột phá VLA-RL: Khi robot biết 'tiên đoán tương lai' để ra quyết định chính xác

    Nhóm OpenMOSS giới thiệu World Critic Model (WCM), giúp mô hình VLA không chỉ đánh giá hiện tại mà còn dự đoán trạng thái tương lai, giải quyết triệt để hạn chế của việc chỉ nhìn ảnh tĩnh trong điều khiển robot.

  7. Mustafa Suleyman (Microsoft AI CEO)T4 · 12/08 · 23:46

    Microsoft ra mắt MAI-Thinking-1: Mô hình suy luận tự phát triển đầu tiên

    Microsoft chính thức giới thiệu MAI-Thinking-1, mô hình suy luận được xây dựng từ đầu và hiện đã có mặt trên nền tảng Microsoft Foundry.

  8. JiQiZhiXinT4 · 12/08 · 22:45

    Chấn động giới AI: Nghiên cứu 116 trang tiết lộ cách 'trích xuất' tư duy ẩn của Claude và GPT

    Một nghiên cứu mới chỉ ra lỗ hổng bảo mật nghiêm trọng trên các API mô hình lớn, cho phép kẻ xấu trích xuất toàn bộ chuỗi tư duy (reasoning traces) vốn được các hãng như OpenAI hay Anthropic mã hóa để bảo mật.

  9. Nathan Lambert: InterconnectsT4 · 12/08 · 21:02

    Tôi đã viết một cuốn sách giáo khoa về AI: Liệu AI còn bao lâu nữa mới có thể viết lách tốt hơn?

    Tác giả nhận thấy dù AI đã đạt trình độ siêu việt trong lập trình và toán học, khả năng viết văn bản dài và phi hư cấu vẫn dậm chân tại chỗ, gây cản trở việc tự chủ giải quyết các vấn đề khoa học phức tạp.

  10. JiQiZhiXinT4 · 12/08 · 16:45

    Libra: Hệ thống tối ưu hóa tài nguyên cho Agentic RL, tăng tốc độ huấn luyện gấp 3 lần

    Nhóm nghiên cứu từ CUHK và HSU giới thiệu Libra, hệ thống quản lý tài nguyên đột phá giúp giải quyết tình trạng mất cân bằng tải trong huấn luyện Agentic RL, tăng hiệu suất lên gấp 3 lần so với các phương pháp truyền thống.

  11. JiQiZhiXinT4 · 12/08 · 14:45

    Đột phá từ ByteDance: Tối ưu hóa mô hình tạo ảnh bằng 'Structured Prompt' thay vì chỉ tăng độ dài văn bản

    Nhóm Seed của ByteDance phát hiện rằng thông tin hình ảnh trong Caption quan trọng hơn độ dài văn bản. Họ đề xuất Structured Prompt giúp cải thiện đáng kể khả năng suy luận và hiểu biết thế giới của các mô hình khuếch tán.

  12. The Decoder: AI NewsT4 · 12/08 · 00:47

    Lỗ hổng API nghiêm trọng: Hé lộ quy trình suy luận 'bí mật' của các mô hình AI hàng đầu

    Nhóm nghiên cứu phát hiện lỗ hổng API cho phép đọc quy trình suy luận ẩn của OpenAI, Anthropic và Google, đồng thời làm rò rỉ hàng loạt thông tin nhạy cảm như khóa API và mật khẩu từ các phiên hội thoại công khai.

Suy luận — Chủ Đề AI · Trang 7 | AIHOT.vn