22/09

Thứ Ba · 1 tin
Nathan Lambert@natolambert
Quan điểmĐiểm AI 45/100

Cùng sự kiệnNathan Lambert kinh ngạc trước hiệu suất vượt trội của Claude Opus 5.5

Sir what is going on here

DịchChuyên gia Nathan Lambert đánh giá cao Claude Opus 5.5 khi đạt kết quả dẫn đầu với chi phí cực thấp ở thiết lập mặc định, đồng thời cải thiện tốc độ tạo văn bản nhanh hơn 30% so với thế hệ tiền nhiệm.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»

21/09

Thứ Hai · 1 tin
karminski@karminski3
Mô hìnhĐiểm AI 14/100

Ra mắt 'Quantum Jev': Mô hình nhanh nhất lịch sử với tốc độ suy luận 0.12ms, chuẩn bị mã nguồn mở

Tác giả công bố Quantum Jev với tốc độ suy luận nhanh gấp 400 lần bản gốc, đạt 0.12ms mỗi lượt. Dự án sẽ sớm được phát hành dưới giấy phép MIT, hứa hẹn giải quyết các bài toán mà Jev hiện tại chưa thể xử lý.

19/09

Thứ Bảy · 1 tin

16/09

Thứ Tư · 2 tin
Kim@kimmonismus
NgànhĐiểm AI 40/100

Jev ra mắt: Mô hình ra quyết định nhanh gấp 200 lần và rẻ gấp 400 lần LLM

Sounds almost too good to be true. Jev is an AI model built for decisions rather than text generat…

DịchDiogo Almeida giới thiệu Jev, mô hình AI chuyên biệt cho việc ra quyết định thay vì tạo văn bản. Sử dụng phương pháp RLCD, Jev tối ưu hóa hiệu suất vượt trội với chi phí cực thấp, mở ra hướng đi mới cho các tác vụ điều khiển và chọn lọc dữ liệu.

Thêm 2 nguồn khác đưa tinWeChat: KhazixX: Rohan Paul (@rohanpaul_ai)
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
NgànhĐiểm AI 29/100

Jev: Mô hình AI mới hứa hẹn rẻ hơn 40-400 lần và nhanh hơn 20-200 lần

Typesafe.ai vừa ra mắt Jev, một mô hình AI đột phá với hiệu suất vượt trội về tốc độ và chi phí. Tuy nhiên, các thông số kỹ thuật chi tiết vẫn chưa được công bố, gây ra nhiều tranh luận trong cộng đồng công nghệ.

14/09

Thứ Hai · 1 tin
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 45/100

Cùng sự kiệnAnt Group ra mắt Qwen3.6-27B-singprobe: Công cụ kiểm soát an toàn AI hiệu suất cao

Ant Group vừa phát hành Qwen3.6-27B-singprobe trên HuggingFace, một mô hình dò tìm an toàn theo thời gian thực giúp đánh giá từng token với chi phí giải mã cực thấp, dưới 0,5%.

Cùng sự kiện, bài đại diện «Ant Group ra mắt SingProbe: Công cụ kiểm soát an toàn AI hiệu năng cao dựa trên Qwen3.6»

09/09

Thứ Tư · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 65/100

Inception ra mắt Mercury 2.5: Mô hình ngôn ngữ khuếch tán mạnh mẽ nhất hiện nay

Inception vừa trình làng Mercury 2.5, mô hình ngôn ngữ khuếch tán lớn nhất và thông minh nhất của hãng với hiệu suất tăng 40% so với bản tiền nhiệm, sẵn sàng cạnh tranh với các đối thủ hàng đầu như GPT-5.6 Luna, Gemini 3.5 Flash-Lite và Claude Haiku 4.5.

07/09

Thứ Hai · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnTFO: Biến mô hình thị giác-ngôn ngữ (VLM) thành hệ thống hiểu âm thanh mà không cần huấn luyện lại

TFO là giải pháp plug-and-play cho phép tích hợp khả năng hiểu âm thanh vào các mô hình VLM đóng băng mà không cần thay đổi kiến trúc hay huấn luyện lại, giúp bảo toàn nguyên vẹn năng lực suy luận thị giác ban đầu.


Vì sao đáng đọc: Giải pháp đột phá giúp tiết kiệm chi phí tính toán đáng kể khi tích hợp đa phương thức, giải quyết trực tiếp vấn đề 'quên lãng' năng lực cũ của các mô hình VLM hiện nay.

03/09

Thứ Năm · 3 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

NeoMME: Bộ mã hóa đa phương thức đa ngôn ngữ tối ưu cho suy luận và tinh chỉnh

NeoMME là kiến trúc bộ mã hóa Transformer hai chiều nhỏ gọn, hỗ trợ đa ngôn ngữ và hình ảnh, giúp tối ưu hóa hiệu suất cho các tác vụ truy xuất tài liệu mà không cần dùng đến các mô hình ngôn ngữ tạo sinh cồng kềnh.

Thêm 1 nguồn khác đưa tinHugging Face: Blog
GitHub Blog
Hướng dẫnĐiểm AI 61/100

Tinh chọnGitHub Copilot tối ưu chi phí vận hành AI mà không làm giảm chất lượng code

Kỹ sư GitHub chia sẻ 4 chiến lược tối ưu hóa, từ việc nén dữ liệu đầu vào đến tinh chỉnh quy trình xử lý tác vụ, giúp giảm đáng kể chi phí suy luận mà vẫn đảm bảo hiệu suất lập trình.


Vì sao đáng đọc: Bài viết cung cấp các giải pháp kỹ thuật thực tế, có tính ứng dụng cao cho các nhà phát triển và doanh nghiệp đang tối ưu hóa chi phí triển khai AI.

01/09

Thứ Ba · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 50/100

Not Diamond công bố phương pháp định tuyến mô hình: Chất lượng vượt Opus với chi phí thấp hơn 80%

Not Diamond just released the methodology behind their model routing which gets Opus xhigh quality w…

DịchNot Diamond giới thiệu phương pháp định tuyến mô hình mới, giúp đạt hiệu suất vượt trội so với Claude 3 Opus nhưng tiết kiệm từ 20-80% chi phí vận hành trên các tiêu chuẩn đánh giá chính.

25/08

Thứ Ba · 1 tin

21/08

Thứ Sáu · 1 tin

13/08

Thứ Năm · 2 tin
Tổng 17 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (36 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI hiệu năng cao” | AIHOT.vn