22/09

Thứ Ba · 1 tin

20/09

Chủ Nhật · 1 tin

07/09

Thứ Hai · 1 tin
QbitAI
Mô hìnhĐiểm AI 88/100

Tinh chọnHuy chương Fields tham chiến AI: Sự kết hợp giữa Qwen 4B và GLM tạo đột phá tại ARC-AGI

Sự hợp tác giữa các chuyên gia toán học hàng đầu và mô hình ngôn ngữ lớn đang mở ra hướng đi mới, khi kết hợp Qwen 4B trên thiết bị di động với sức mạnh đám mây của GLM để chinh phục thử thách ARC-AGI.


Vì sao đáng đọc: Tin tức kết hợp giữa nhân vật tầm cỡ (Huy chương Fields) và công nghệ AI tiên tiến (ARC-AGI) tạo sức hút lớn, mang tính chuyên môn cao và có giá trị tham khảo cho giới nghiên cứu.

06/09

Chủ Nhật · 1 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnĐội ngũ 12 tiến sĩ và 1 chủ nhân giải Fields đứng sau 'ngựa ô' AI Mostik

Startup Nga Mostik gây sốt khi leo lên top đầu bảng xếp hạng ARC-AGI-3 nhờ kỹ thuật 'cầu nối' cho phép các mô hình AI giao tiếp trực tiếp qua không gian toán học thay vì văn bản, giúp tối ưu hiệu suất vượt trội.


Vì sao đáng đọc: Tin tức độc quyền về đột phá kỹ thuật mới trong AI, kết hợp đội ngũ học thuật danh giá và giải pháp tối ưu hóa mô hình sáng tạo, rất thu hút giới chuyên môn.

05/09

Thứ Bảy · 1 tin
Francois Chollet@fchollet
Hướng dẫnĐiểm AI 64/100

François Chollet chia sẻ bài phân tích về hiệu suất đột phá của OpenAI trên bài kiểm tra ARC-AGI-3

Pour nos lecteurs francophones

DịchFrançois Chollet giới thiệu bài viết từ Le Point về việc mô hình mới của OpenAI đạt điểm gần tuyệt đối trong bài kiểm tra ARC-AGI-3, kèm theo những góc nhìn chuyên sâu từ chính tác giả của bộ tiêu chuẩn đánh giá này.

04/09

Thứ Sáu · 9 tin
The Decoder: AI News
Hướng dẫnĐiểm AI 78/100

Tinh chọnTranh cãi về hiệu năng GPT-6 Astra: Bước tiến đột phá hay chỉ là con số ảo?

Kết quả đánh giá GPT-6 Astra gây tranh cãi khi các tổ chức đưa ra con số trái ngược. Tuy nhiên, khả năng giải quyết bài toán ARC-AGI-3 vượt xa con người của mô hình này đang khiến giới chuyên gia phải cân nhắc lại dự báo về thời điểm AGI xuất hiện.


Vì sao đáng đọc: Tin tức quan trọng về mô hình đầu bảng mới nhất, ảnh hưởng trực tiếp đến lộ trình phát triển AGI và gây tranh luận lớn trong cộng đồng AI chuyên sâu.
Kim@kimmonismus
Hướng dẫnĐiểm AI 57/100

Cùng sự kiệnARC-AGI 3 đã đạt ngưỡng bão hòa: Cần thiết lập bộ tiêu chuẩn đánh giá mới ngay lập tức

The lesson from today: we need new benchmarks asap.

DịchTác giả của ARC-AGI 3 xác nhận bộ tiêu chuẩn này đã không còn đủ thách thức cho các mô hình AI hiện nay, đồng thời kêu gọi cộng đồng sớm xây dựng các bài kiểm tra năng lực mới.

Cùng sự kiện, tinh chọn hiển thị «ARC-AGI-3 bị chinh phục chỉ sau 6 tháng, tốc độ phát triển AI vượt xa dự đoán»
Greg Brockman@gdb
Mô hìnhĐiểm AI 71/100

Tinh chọnGPT-6 Astra thiết lập kỷ lục mới trên ARC-AGI-3: Đạt 99% điểm số, vượt xa khả năng con người

arc-agi-3 is now saturated

DịchGreg Brockman xác nhận GPT-6 Astra đạt SOTA trên ARC-AGI-3 với 99% điểm số, vượt qua con người ở 96% các tác vụ. Đáng chú ý, mô hình này tối ưu hóa chi phí hiệu quả hơn nhờ khả năng suy luận vượt trội, giảm thiểu số lượng token và lượt gọi API cần thiết.

Diễn biến sự kiện · 2 bài →Thêm 2 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Testing Catalog (@testingcatalog)

Vì sao đáng đọc: Tin tức quan trọng về cột mốc AGI. Việc đạt 99% trên ARC-AGI cho thấy bước tiến lớn về khả năng suy luận logic của AI, thu hút sự quan tâm lớn từ cộng đồng công nghệ.
Testing Catalog@testingcatalog
Hướng dẫnĐiểm AI 67/100

Cùng sự kiệnGPT-6 Astra gây sốc với 99% điểm ARC-AGI: Bước tiến lớn về tư duy logic

OPENAI 🔥: Astra scored 63% on ARC-AGI-3 with a standard harness. > GPT-6 Astra surpasses the huma…

DịchGPT-6 Astra đạt 99% điểm trong bài kiểm tra ARC-AGI-3 nhờ khả năng tự xây dựng mô hình thế giới và ngôn ngữ logic riêng để giải quyết các tình huống lạ, vượt xa hiệu suất trung bình của con người.

Cùng sự kiện, tinh chọn hiển thị «GPT-6 Astra thiết lập kỷ lục mới trên ARC-AGI-3: Đạt 99% điểm số, vượt xa khả năng con người»
Sherwin Wu@sherwinwu
Hướng dẫnĐiểm AI 66/100

Tinh chọnARC-AGI-3 bị chinh phục chỉ sau 6 tháng, tốc độ phát triển AI vượt xa dự đoán

Progress continues to surprise even the best of us. ARC-AGI-3 was the first ARC-AGI benchmark that I…

DịchBenchmark ARC-AGI-3 đã bị mô hình Astra bão hòa chỉ sau nửa năm, nhanh gấp đôi so với dự đoán ban đầu của François Chollet. Sự kiện này cho thấy năng lực của các mô hình AI thế hệ mới đang tiến hóa với tốc độ chóng mặt, thách thức mọi quan điểm cũ về trí tuệ nhân tạo.

Diễn biến sự kiện · 2 bài →Thêm 1 nguồn khác đưa tinX: Kim (@kimmonismus)

Vì sao đáng đọc: Tin tức quan trọng về cột mốc AGI, cho thấy tốc độ phát triển AI đang vượt xa kỳ vọng của các chuyên gia hàng đầu, có giá trị tham khảo cao cho cộng đồng.
Francois Chollet@fchollet
Hướng dẫnĐiểm AI 62/100

François Chollet: AI đạt điểm tuyệt đối ARC-AGI-3 chỉ sau 6 tháng, xóa tan nghi ngờ về độ khó

Side note: when we released ARC-AGI-3 in March, and frontier models scored <1% on it, a few Singular…

DịchFrançois Chollet khẳng định bộ tiêu chuẩn ARC-AGI-3 được thiết kế chuẩn xác. Việc AI tiến bộ từ dưới 1% lên 100% chỉ trong nửa năm cho thấy tốc độ phát triển trí tuệ nhân tạo đang vượt xa mọi dự đoán ban đầu.

Francois Chollet@fchollet
Hướng dẫnĐiểm AI 81/100

Tinh chọnFrançois Chollet đánh giá hiệu suất của GPT-6 Astra trên bộ đề ARC-AGI-3

GPT-6 Astra represents a step-function change in model capability for interactive reasoning problems…

DịchFrançois Chollet cho biết GPT-6 Astra đạt bước tiến lớn trong suy luận tương tác, ghi 66% trên ARC-AGI-3 và gần 100% khi kết hợp kỹ thuật tối ưu hóa, dù chi phí mỗi lượt lên tới 360 USD.


Vì sao đáng đọc: Thông tin từ chuyên gia hàng đầu về một cột mốc quan trọng trong đánh giá trí tuệ nhân tạo tổng quát (AGI), có giá trị tham khảo cao cho cộng đồng AI.

02/09

Thứ Tư · 2 tin
ARC Prize: Blog chính thức
Nghiên cứuĐiểm AI 78/100

Tinh chọnARC Prize công bố kết quả đánh giá GPT-6 Astra trên bộ đề ARC-AGI-3

GPT-6 Astra của OpenAI thiết lập kỷ lục SOTA mới trên ARC-AGI-3 với điểm số ấn tượng, đạt 99.9% ở bài kiểm tra Provider Adapter với chi phí tối ưu.


Vì sao đáng đọc: Đây là cột mốc quan trọng trong việc đo lường trí tuệ nhân tạo tổng quát (AGI), cho thấy bước tiến vượt bậc của GPT-6 trong các bài toán suy luận logic phức tạp.
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 67/100

Fable 5.1 đạt 90% trên ARC-AGI-2 với chi phí tối ưu hơn 32%

Incredible. Fable 5.1 is getting remarkably close to fully saturating ARC-AGI-2, but at materially…

DịchAnthropic ra mắt Fable 5.1 với hiệu suất ấn tượng trên bộ tiêu chuẩn ARC-AGI, đạt 90% ở bản ARC-AGI-2. Nhờ tối ưu hóa token, mô hình này giảm chi phí vận hành trung bình khoảng 32% so với phiên bản tiền nhiệm Fable 5.

01/09

Thứ Ba · 1 tin

26/08

Thứ Tư · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Báo cáo kỹ thuật Prime Agent: Giải mã cơ chế phân tầng bộ nhớ đột phá

Prime Agent, the harness that put Opus 5 at 95.5% on ARC-AGI-3, now has a technical report. The mec…

DịchPrime Agent giới thiệu cơ chế phân tầng bộ nhớ giúp tối ưu hóa khả năng xử lý của AI thông qua việc quản lý dữ liệu trên nhiều lớp, từ ngữ cảnh hoạt động đến lưu trữ ổ đĩa, giúp chuyển đổi các tác vụ ngữ cảnh dài thành bài toán quản trị thông tin hiệu quả.

23/08

Chủ Nhật · 1 tin
Clément Delangue (Hugging Face CEO)@ClementDelangue
Hướng dẫnĐiểm AI 34/100

NVIDIA đạt điểm tuyệt đối trong thử thách ARC-AGI-3 với khung lập trình tự động

NVIDIA built its own coding harness to optimize CUDA GPU kernels and achieved a 100% score on ARC-AG…

DịchNVIDIA vừa ra mắt khung lập trình giúp tối ưu hóa nhân CUDA, đạt tỷ lệ giải quyết 100% các bài toán trong ARC-AGI-3. Bước tiến này hứa hẹn sẽ hạ thấp rào cản kỹ thuật, giúp việc huấn luyện và tối ưu hóa AI trở nên dễ dàng hơn cho mọi người.

21/08

Thứ Sáu · 3 tin
Francois Chollet@fchollet
Hướng dẫnĐiểm AI 39/100

François Chollet: Đạt điểm tuyệt đối trên demo không đồng nghĩa với việc chinh phục ARC-AGI-3

This is very nice work from NVIDIA. Like all high-performing approaches on ARC-AGI-3, it uses deep l…

DịchFrançois Chollet đánh giá cao hệ thống AVO của NVIDIA nhưng cảnh báo rằng việc đạt 100% trên tập demo chỉ giống như hoàn thành hướng dẫn, không phản ánh đúng năng lực thực tế trên bộ tiêu chuẩn ARC-AGI-3.

Kim@kimmonismus
Hướng dẫnĐiểm AI 47/100

NVIDIA ra mắt tác nhân AI AVO: Phá đảo tuyệt đối bài kiểm tra tư duy ARC-AGI-3

Holy: NVIDIA's coding agent AVO scored 100% on ARC-AGI-3's 25 public games, solving all 183 levels. …

DịchTác nhân AI AVO của NVIDIA đã đạt điểm tuyệt đối 100% trong bài kiểm tra ARC-AGI-3 bằng cách tự học qua thử sai mà không cần quy tắc định sẵn. Được vận hành bởi Claude Opus 5, AVO thể hiện khả năng ghi nhớ dài hạn và giải quyết vấn đề phức tạp vượt trội.

14/08

Thứ Sáu · 1 tin
Francois Chollet@fchollet
Hướng dẫnĐiểm AI 37/100

ARC-AGI-3: Các giải pháp hàng đầu đều sử dụng mô hình thế giới biểu tượng dẫn dắt bởi LLM

Jeremy's excellent work here is a great illustration of a very powerful type of approach: LLM-guided…

DịchFrançois Chollet nhận định rằng các phương pháp dẫn đầu trong thử thách ARC-AGI-3 đều dựa trên việc dùng LLM để tổng hợp các mô hình thế giới biểu tượng, thông qua việc viết mã thực thi nhằm giải mã cơ chế nhân quả của thế giới.

Tổng 23 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (35 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “ARC-AGI” | AIHOT.vn