DịchGiả thuyết cho rằng cảm giác mô hình bị 'giảm sức mạnh' thực chất đến từ việc sử dụng các loại phần cứng khác nhau (GPU, TPU, Inferentia) để xử lý tải trọng cao, dẫn đến chất lượng đầu ra không đồng nhất.
Earlier this week, we showed that GPT-5.6 and Claude 5 exhibit very different long-context TTFT scal…
DịchPhân tích từ Epoch AI cho thấy GPT-6 Astra tăng giá API khi vượt ngưỡng 272k token đầu vào, với đường cong độ trễ tương đồng GPT-5.6. Nghiên cứu cũng chỉ ra sự khác biệt trong cách xử lý ngữ cảnh dài giữa OpenAI và Claude, phản ánh qua cấu trúc định giá riêng biệt của từng bên.
Bài tổng quan hệ thống hóa các phương pháp tối ưu hóa suy luận cho Video LLM qua bốn giai đoạn: lấy mẫu khung hình, mã hóa đa phương thức, nén token và xử lý LLM, đồng thời chỉ ra những khoảng trống trong tiêu chuẩn đánh giá hiệu năng hiện nay.
You can now easily compare the intelligence, cost, and speed on different effort levels for your pre…
DịchArtificial Analysis vừa giới thiệu trang Model Release, cho phép người dùng so sánh trực quan khả năng thông minh, chi phí và tốc độ của các mô hình AI ở nhiều cấp độ vận hành khác nhau, kèm theo chỉ số năng lực chuyên sâu trong các lĩnh vực như tài chính, luật và y tế.
Announcing Artificial Analysis Intelligence Index v4.3, upgrading Terminal-Bench to 4.0 and adding A…
DịchArtificial Analysis cập nhật chỉ số thông minh v4.3 với chuẩn đo lường AutomationBench-AA mới. Claude Fable 5.1 và GPT-6 Astra hiện đang dẫn đầu, trong khi GLM-5.3 và Kimi K3 thống trị nhóm mô hình mã nguồn mở.
GPT-6 Astra makes significant gains in the Artificial Analysis Coding Agent Index, scoring equal to …
DịchArtificial Analysis công bố GPT-6 Astra đạt 67 điểm Coding Agent Index, tương đương Claude Opus 5 và Fable 5, với hiệu suất token vượt trội và chi phí vận hành cạnh tranh hơn nhiều.