26/09

Thứ Bảy · 1 tin
Peter Steinberger@steipete
Mô hìnhĐiểm AI 43/100

Tính năng 'Tiếp tục suy nghĩ' của Anthropic gây tranh cãi về việc trích xuất suy luận

keep thinking

DịchViệc Anthropic gắn nhãn 'tiếp tục suy nghĩ' (keep thinking) đang trở thành tâm điểm tranh luận trong cộng đồng công nghệ, xoay quanh vấn đề quyền riêng tư và khả năng trích xuất các bước suy luận ẩn của mô hình AI.

11/09

Thứ Sáu · 1 tin

10/09

Thứ Năm · 1 tin

09/09

Thứ Tư · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 76/100

Cùng sự kiệnSimon Willison bàn về tranh cãi OpenAI và Anthropic quanh việc giải bài toán thiên niên kỷ Navier-Stokes

Simon Willison phân tích sự kiện OpenAI dùng mô hình chưa công bố để giải bài toán Navier-Stokes trong 88 giờ, sau đó xác thực bằng Lean qua GPT-6 Astra, làm dấy lên nhiều tranh luận về tính minh bạch.

Cùng sự kiện, tinh chọn hiển thị «OpenAI công bố lời giải cho bài toán thiên niên kỷ Navier-Stokes bằng AI»

05/09

Thứ Bảy · 2 tin
QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnTerence Tao 'cạn lời' trước cách GPT-6 giải bài toán số nguyên tố sinh đôi

AI đưa ra đáp án chính xác cho bài toán hóc búa, nhưng Terence Tao cho rằng quy trình tư duy và cách tiếp cận vấn đề mới là điều đáng bàn hơn cả.


Vì sao đáng đọc: Sự kiện thu hút sự chú ý lớn từ cộng đồng toán học và AI khi một thiên tài như Terence Tao đánh giá về khả năng suy luận thực sự của mô hình ngôn ngữ lớn.
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 74/100

Cùng sự kiệnClaude hoàn thành chứng minh hình thức định lý Fermat bằng ngôn ngữ Lean chỉ trong 11 ngày

Another serious win for AI in mathematics: Claude formalized Fermat's Last Theorem in 11 days. AI m…

DịchAnthropic công bố Claude đã hoàn thành việc chuyển đổi chứng minh định lý Fermat của Wiles sang mã Lean thông qua hệ thống đa tác nhân, đánh dấu bước tiến lớn trong toán học máy tính.

Cùng sự kiện, tinh chọn hiển thị «Claude lập kỳ tích: Tự động chứng minh Định lý Fermat trong 11 ngày»

01/09

Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 42/100

Đề xuất khung L0-L4: Lộ trình giúp mô hình suy luận AI vượt xa sự giám sát của con người

Nghiên cứu giới thiệu khung 5 cấp độ (L0-L4) giúp các mô hình suy luận lớn (LRM) tự tiến hóa mà không cần sự can thiệp của con người, thông qua việc tự động hóa quá trình xác thực và tạo lộ trình học tập.

28/08

Thứ Sáu · 1 tin

24/08

Thứ Hai · 1 tin
Kim@kimmonismus
Hướng dẫnĐiểm AI 39/100

Mô hình Claude mới gây ấn tượng với khả năng suy luận vượt trội, nghi vấn là Opus 5.1

The new Claude models show quite good results, even on Medium reasoning. (Opus 5.1?) After Thariq a…

DịchCác mô hình Claude mới đang cho thấy hiệu suất suy luận mạnh mẽ, đặc biệt trong các tác vụ 3D phức tạp. Dù tiêu tốn nhiều token tư duy, đây được dự đoán là bản cập nhật Opus 5.1 sắp ra mắt.

18/08

Thứ Ba · 1 tin
JiQiZhiXin
Mô hìnhĐiểm AI 95/100

Tinh chọnDi sản của một nhà toán học 'lãng du' đang trở thành mục tiêu săn đón của các ông lớn AI

Các mô hình AI của OpenAI đang tạo ra bước ngoặt lịch sử khi giải quyết thành công hàng loạt bài toán hóc búa của huyền thoại toán học Paul Erdős, mở ra kỷ nguyên mới cho nghiên cứu toán học.


Vì sao đáng đọc: Bài viết có tính thời sự cao, kết nối sâu sắc giữa lịch sử toán học và sự tiến hóa của AI, mang lại góc nhìn chuyên sâu về khả năng suy luận của mô hình ngôn ngữ lớn.
Tổng 10 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (37 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI suy luận” | AIHOT.vn