Claude Opus 5.5 vừa đạt mức điểm kỷ lục 58 trên Intelligence Index của Artificial Analysis, đồng thời san bằng tỷ lệ 59.6% với GPT-6 Astra trong bài kiểm tra Terminal-Bench 4.0.
GPT-6 Astra is a big step up for legal, finance, and consulting work!
DịchGPT-6 Astra vừa ra mắt đã đứng đầu bảng xếp hạng Mercor APEX-Agents với điểm số trung bình 62,4%, cho thấy khả năng vượt trội trong các tác vụ tư vấn pháp lý và tài chính.
Perplexity Search debuts on the Artificial Analysis Search Index, with all three context size varian…
DịchPerplexity Search vừa vươn lên dẫn đầu bảng xếp hạng của Artificial Analysis với số điểm 80, vượt qua các đối thủ mạnh như Parallel và Brave Search.
South Korea has once again established a clear #3 position in the global AI race, trailing only the …
DịchNhờ đầu tư công và nhân tài nội địa, Hàn Quốc vươn lên vị trí thứ 3 thế giới về AI. Các mô hình như Motif 3 và Solar Pro 4 đang dẫn đầu bảng xếp hạng ngoài Mỹ và Trung Quốc.
AI memory has a measurement problem. "How much context? " tells us less and less. What matters is…
DịchMemoraX vừa xuất sắc giành vị trí quán quân trong hạng mục bộ nhớ văn bản thương mại tại bảng xếp hạng AML, với khả năng tối ưu hóa vượt trội trong việc ghi nhớ, truy xuất và xử lý dữ liệu cho AI Agent.
Grok 4.6 wins again. 👑 Grok 4.6 takes the #1 spot on GPQA Diamond with a score of 94.9%, beating G…
DịchGrok 4.6 vừa thiết lập cột mốc mới với 94,9% điểm số trên GPQA Diamond, vượt qua hàng loạt đối thủ sừng sỏ như GPT-5.6, Gemini 3.1 Pro và Claude Opus 5 để dẫn đầu thị trường.
Grok 4.6 ranks #1 on OfficeQA Pro with 63.2% accuracy, outperforming Opus 5, Fable 5, and GPT-5.6 So…
DịchGrok 4.6 vừa thiết lập cột mốc mới trên OfficeQA Pro với độ chính xác 63,2%, vượt qua các đối thủ sừng sỏ như Opus 5 và GPT-5.6 trong việc xử lý tài liệu văn phòng thực tế.