24/09

Thứ Năm · 1 tin
Jason Liu@jxnlco
Quan điểmĐiểm AI 30/100

Phải chăng phần cứng không đồng nhất là nguyên nhân khiến các mô hình AI 'trở nên ngốc nghếch'?

Whereas I mostly blame feature flags

DịchGiả thuyết cho rằng cảm giác mô hình bị 'giảm sức mạnh' thực chất đến từ việc sử dụng các loại phần cứng khác nhau (GPU, TPU, Inferentia) để xử lý tải trọng cao, dẫn đến chất lượng đầu ra không đồng nhất.

11/09

Thứ Sáu · 1 tin
Epoch AI@EpochAIResearch
NgànhĐiểm AI 42/100

Epoch AI: GPT-6 Astra duy trì mô hình định giá và độ trễ tương tự GPT-5.6

Earlier this week, we showed that GPT-5.6 and Claude 5 exhibit very different long-context TTFT scal…

DịchPhân tích từ Epoch AI cho thấy GPT-6 Astra tăng giá API khi vượt ngưỡng 272k token đầu vào, với đường cong độ trễ tương đồng GPT-5.6. Nghiên cứu cũng chỉ ra sự khác biệt trong cách xử lý ngữ cảnh dài giữa OpenAI và Claude, phản ánh qua cấu trúc định giá riêng biệt của từng bên.

10/09

Thứ Năm · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 43/100

Tại sao xử lý video vẫn quá đắt đỏ? Tổng quan về cơ chế tối ưu hiệu năng suy luận cho Video LLM

Bài tổng quan hệ thống hóa các phương pháp tối ưu hóa suy luận cho Video LLM qua bốn giai đoạn: lấy mẫu khung hình, mã hóa đa phương thức, nén token và xử lý LLM, đồng thời chỉ ra những khoảng trống trong tiêu chuẩn đánh giá hiệu năng hiện nay.

09/09

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 53/100

Artificial Analysis ra mắt trang so sánh hiệu năng, chi phí và tốc độ mô hình AI theo từng cấp độ

You can now easily compare the intelligence, cost, and speed on different effort levels for your pre…

DịchArtificial Analysis vừa giới thiệu trang Model Release, cho phép người dùng so sánh trực quan khả năng thông minh, chi phí và tốc độ của các mô hình AI ở nhiều cấp độ vận hành khác nhau, kèm theo chỉ số năng lực chuyên sâu trong các lĩnh vực như tài chính, luật và y tế.

08/09

Thứ Ba · 1 tin
Artificial Analysis@ArtificialAnlys
NgànhĐiểm AI 44/100

Artificial Analysis ra mắt chỉ số thông minh v4.3: Claude và GPT-6 dẫn đầu bảng xếp hạng

Announcing Artificial Analysis Intelligence Index v4.3, upgrading Terminal-Bench to 4.0 and adding A…

DịchArtificial Analysis cập nhật chỉ số thông minh v4.3 với chuẩn đo lường AutomationBench-AA mới. Claude Fable 5.1 và GPT-6 Astra hiện đang dẫn đầu, trong khi GLM-5.3 và Kimi K3 thống trị nhóm mô hình mã nguồn mở.

04/09

Thứ Sáu · 1 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 83/100

Đánh giá GPT-6 Astra: Khả năng lập trình ngang ngửa Fable 5 nhưng chi phí tối ưu hơn

GPT-6 Astra makes significant gains in the Artificial Analysis Coding Agent Index, scoring equal to …

DịchArtificial Analysis công bố GPT-6 Astra đạt 67 điểm Coding Agent Index, tương đương Claude Opus 5 và Fable 5, với hiệu suất token vượt trội và chi phí vận hành cạnh tranh hơn nhiều.

Tổng 6 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (18 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Hiệu năng mô hình” | AIHOT.vn