24/09

Thứ Năm · 3 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 58/100

Best Model for Your Budget: Công cụ cập nhật hàng ngày giúp chọn LLM tối ưu chi phí

Trang web mới của terryds giúp người dùng chọn LLM phù hợp nhất với ngân sách bằng cách đối chiếu chỉ số thông minh (Intelligence Index) với giá thành thực tế, cập nhật dữ liệu hàng ngày từ Artificial Analysis.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 68/100

Đã có đại diệnClaude Opus 5.5 dẫn đầu bảng xếp hạng Coding Agent, nhưng chi phí mỗi tác vụ tăng lên 13,04 USD

Claude Opus 5.5 is the new #1 in the Artificial Analysis Coding Agent Index, with gains across all t…

DịchTheo đánh giá từ Artificial Analysis, Claude Opus 5.5 đã vươn lên vị trí số 1 trên Coding Agent Index với 66 điểm, nhờ hiệu suất vượt trội trong các bài kiểm tra lập trình chuyên sâu, dù đi kèm với mức chi phí vận hành cao hơn đáng kể.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 33/100

Cùng sự kiệnGemini 3.8 Flash TTS dẫn đầu bảng xếp hạng về độ chuẩn xác phát âm

Gemini 3.8 Flash TTS takes the #1 spot on the Artificial Analysis Pronunciation Robustness benchmark…

DịchGemini 3.8 Flash TTS vừa chiếm lĩnh vị trí số 1 trên bảng xếp hạng Artificial Analysis với điểm số 89,5%, vượt qua các đối thủ như Gemini 3.1 Flash TTS và SpaceXAI TTS.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS: Đột phá công nghệ chuyển văn bản thành giọng nói»

22/09

Thứ Ba · 3 tin
Elvis Saravia@omarsar0
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnXiaomi ra mắt MiMo-V2.6-Pro: Đỉnh cao mới trong bảng xếp hạng mô hình mã nguồn mở

New open frontier model! MiMo-V2.6 Pro lands on the Intelligence-vs.-Cost-per-Task Pareto frontier. …

DịchXiaomi vừa trình làng MiMo-V2.6-Pro, đạt 46 điểm trên Artificial Analysis, trở thành mô hình mã nguồn mở thông minh nhất hiện nay với chi phí vận hành tối ưu chỉ 0,13 USD mỗi tác vụ.

Cùng sự kiện, bài đại diện «Đánh giá MiMo-V2.6-Pro từ Xiaomi: Hiệu năng vượt trội với 124.5 tokens/giây»
Clément Delangue (Hugging Face CEO)@ClementDelangue
Mô hìnhĐiểm AI 69/100

Tinh chọnXiaomi ra mắt mô hình MiMo-V2.6-Pro: Đứng đầu bảng xếp hạng Artificial Analysis

Banger! https://huggingface.co/collections/XiaomiMiMo/mimo-v26

DịchXiaomi vừa trình làng MiMo-V2.6-Pro, mô hình mã nguồn mở đạt 46 điểm trên bảng xếp hạng Artificial Analysis, chính thức soán ngôi vị dẫn đầu trong phân khúc mô hình mở.


Vì sao đáng đọc: Đây là cột mốc quan trọng của Xiaomi trong lĩnh vực AI, cho thấy sự tiến bộ vượt bậc về hiệu năng của các mô hình mở so với các đối thủ cạnh tranh.
Artificial Analysis@ArtificialAnlys
NgànhĐiểm AI 33/100

NVIDIA hợp tác cùng Chính phủ Hàn Quốc thúc đẩy dự án AI chủ quyền

NVIDIA hosted a trilateral meeting together with the Korean Government, through the National IT Indu…

DịchNVIDIA cùng Viện Xúc tiến Công nghiệp CNTT Hàn Quốc (NIPA) và Artificial Analysis đã tổ chức hội nghị cấp cao nhằm hỗ trợ chiến lược AI chủ quyền của Hàn Quốc. Artificial Analysis chính thức trở thành đơn vị đánh giá độc lập cho các mô hình AI trong dự án này.

21/09

Thứ Hai · 1 tin
Artificial Analysis@ArtificialAnlys
Nghiên cứuĐiểm AI 65/100

Đã có đại diệnArtificial Analysis đánh giá Grok 4.7: Chỉ số thông minh đạt 46, khả năng lập trình vượt trội

Grok 4.7 scores 46 on the Artificial Analysis Intelligence Index to bring SpaceXAI into the top 4 AI…

DịchArtificial Analysis vừa công bố kết quả đánh giá Grok 4.7 với số điểm 46, tăng 2 điểm so với phiên bản tiền nhiệm, giúp xAI chính thức lọt vào top 4 phòng thí nghiệm AI hàng đầu thế giới.

Cùng sự kiện, tinh chọn hiển thị «Đánh giá Grok 4.7: Lọt Top 4 bảng xếp hạng trí tuệ, năng lực lập trình bứt phá mạnh mẽ»

19/09

Thứ Bảy · 2 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 61/100

Grok Imagine 2.0 lọt Top 4 bảng xếp hạng tạo ảnh AI, dẫn đầu nhóm ngoài OpenAI

xAI's Grok Imagine Image 2.0 takes #4 on the Artificial Analysis Text to Image Leaderboard, the high…

DịchGrok Imagine 2.0 của xAI đã vươn lên vị trí thứ 4 trên bảng xếp hạng Artificial Analysis, trở thành mô hình ngoài OpenAI có thứ hạng cao nhất nhờ sự cân bằng ấn tượng giữa chất lượng hình ảnh và chi phí.

Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 41/100

Artificial Analysis cập nhật chỉ số Coding Agent: Bổ sung báo cáo từ chối an toàn

Safety refusal reporting is now available in the Artificial Analysis Coding Agent Index In our late…

DịchArtificial Analysis vừa bổ sung báo cáo từ chối an toàn vào Coding Agent Index v1.5 để làm rõ hành vi của các mô hình. Đáng chú ý, Claude Fable 5.1 ghi nhận tỷ lệ 'fallback' cao nhất trên Claude Code và Devin Fusion, ảnh hưởng trực tiếp đến kết quả đánh giá.

16/09

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 66/100

Cùng sự kiệnĐánh giá Gemini 3.8 Live: Phiên bản Extended Thinking thống trị bảng xếp hạng giọng nói

Google has released Gemini 3.8 Live, its new Speech to Speech model, with the Extended Thinking (Hig…

DịchArtificial Analysis công bố Gemini 3.8 Live (bản Extended Thinking) đã vươn lên dẫn đầu bảng xếp hạng Speech to Speech Index với 82.6 điểm và đạt hiệu suất 68.6% trên Tau Voice.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói»

15/09

Thứ Ba · 1 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 66/100

Tinh chọnGPT-Live-1 của OpenAI soán ngôi đầu bảng xếp hạng Speech-to-Speech của Artificial Analysis

OpenAI's GPT-Live-1 debuts at #1 on the Artificial Analysis Speech to Speech Index at a score of 81….

DịchArtificial Analysis vừa công bố bảng xếp hạng Speech-to-Speech, trong đó GPT-Live-1 (backend Astra) dẫn đầu với 81,5 điểm, vượt qua Grok Voice Think Fast 2.0 High để chiếm vị trí số 1.


Vì sao đáng đọc: Tin tức cập nhật về hiệu năng mô hình AI mới nhất từ nguồn uy tín, cung cấp dữ liệu so sánh thực tế hữu ích cho người dùng và giới công nghệ.

14/09

Thứ Hai · 2 tin
Artificial Analysis@ArtificialAnlys
NgànhĐiểm AI 44/100

Artificial Analysis ra mắt chỉ số năng lực AI v1.1: Đánh giá chuyên sâu theo từng ngành nghề

Announcing Artificial Analysis Capability Indices v1.1, updated with stronger domain tuning, combini…

DịchArtificial Analysis cập nhật chỉ số năng lực v1.1, kết hợp dữ liệu O*NET để đo lường hiệu suất AI trong 6 lĩnh vực chuyên môn như tài chính, luật và y tế dựa trên Intelligence Index v4.3.

Artificial Analysis@ArtificialAnlys
NgànhĐiểm AI 46/100

Artificial Analysis trở thành đối tác đánh giá chính thức cho các mô hình AI chủ quyền của Hàn Quốc

Artificial Analysis is proud to support the Korean Government as an official evaluation partner for …

DịchArtificial Analysis đã ký thỏa thuận với chính phủ Hàn Quốc để trở thành đơn vị đánh giá độc lập cho các dự án AI quốc gia, với chỉ số đo lường của họ chiếm 25% trọng số trong các cuộc thi AI tại nước này.

12/09

Thứ Bảy · 2 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 64/100

Đánh giá độc lập Devin Fusion: Cấu hình Fable đạt 62 điểm, Astra tối ưu tốc độ và chi phí

We independently benchmarked Devin Fusion for its release today - this is the first time a multi-mod…

DịchArtificial Analysis vừa công bố kết quả kiểm thử độc lập cho Devin Fusion, trở thành tác nhân lập trình đa mô hình đầu tiên góp mặt trong bảng xếp hạng Coding Agent Index của họ.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 75/100

Cùng sự kiệnGPT Image 2.5 Flare và Sunburst thống trị bảng xếp hạng Artificial Analysis

OpenAI's GPT Images 2.5 takes the top two spots on the Artificial Analysis Image Arena, generating h…

DịchHai mô hình mới từ OpenAI là GPT Image 2.5 Flare và Sunburst đã chiếm lĩnh vị trí dẫn đầu trên bảng xếp hạng Image Arena, mang lại chất lượng hình ảnh vượt trội với tốc độ nhanh gấp đôi và mức giá không đổi.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt ChatGPT Images 2.5: Tạo ảnh nhanh hơn, sắc nét và thông minh hơn»

11/09

Thứ Sáu · 1 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 53/100

Octen Search vươn lên vị trí thứ 3 trên bảng xếp hạng Artificial Analysis với tốc độ phản hồi nhanh nhất

Octen Search debuts third on the Artificial Analysis Search Index with a score of 77, achieving the …

DịchOcten Search đạt 77 điểm trên bảng xếp hạng Artificial Analysis, chỉ đứng sau Perplexity Search, đồng thời xác lập kỷ lục là công cụ tìm kiếm AI có tốc độ phản hồi nhanh nhất hiện nay.

09/09

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 53/100

Artificial Analysis ra mắt trang so sánh hiệu năng, chi phí và tốc độ mô hình AI theo từng cấp độ

You can now easily compare the intelligence, cost, and speed on different effort levels for your pre…

DịchArtificial Analysis vừa giới thiệu trang Model Release, cho phép người dùng so sánh trực quan khả năng thông minh, chi phí và tốc độ của các mô hình AI ở nhiều cấp độ vận hành khác nhau, kèm theo chỉ số năng lực chuyên sâu trong các lĩnh vực như tài chính, luật và y tế.

08/09

Thứ Ba · 1 tin
Artificial Analysis@ArtificialAnlys
NgànhĐiểm AI 44/100

Artificial Analysis ra mắt chỉ số thông minh v4.3: Claude và GPT-6 dẫn đầu bảng xếp hạng

Announcing Artificial Analysis Intelligence Index v4.3, upgrading Terminal-Bench to 4.0 and adding A…

DịchArtificial Analysis cập nhật chỉ số thông minh v4.3 với chuẩn đo lường AutomationBench-AA mới. Claude Fable 5.1 và GPT-6 Astra hiện đang dẫn đầu, trong khi GLM-5.3 và Kimi K3 thống trị nhóm mô hình mã nguồn mở.

06/09

Chủ Nhật · 1 tin

05/09

Thứ Bảy · 3 tin
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 45/100

Ethan Mollick chỉ trích cách thay đổi tiêu chuẩn đánh giá của Artificial Analysis v4.2

The whole idea of indexes that you don't change all the criteria in ways that hugely change the rank…

DịchEthan Mollick cho rằng các chỉ số đánh giá AI không nên thay đổi tiêu chuẩn đột ngột làm xáo trộn bảng xếp hạng, đồng thời phê bình việc vẫn giữ lại phương pháp đo lường GDPval-AA thiếu chính xác.

Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Hướng dẫnĐiểm AI 49/100

Artificial Analysis cập nhật Intelligence Index v4.2: Claude 3.5 Sonnet vươn lên dẫn đầu

updated artificial analysis index-muse spark 1.3 max still performs quite well! the efficient front…

DịchBản cập nhật v4.2 bổ sung các bài kiểm tra chuyên sâu về tác vụ trí tuệ và khả năng suy luận tài liệu dài, đồng thời tăng trọng số bộ dữ liệu kiểm thử kín để ngăn chặn tình trạng tối ưu hóa điểm số ảo.

Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 53/100

Artificial Analysis cập nhật Intelligence Index v4.2: Tăng trọng số kiểm thử riêng

Announcing Artificial Analysis Intelligence Index v4.2. We are accelerating elements of our upcoming…

DịchArtificial Analysis ra mắt bản cập nhật v4.2 với trọng số kiểm thử riêng tăng gấp đôi, bổ sung các bài đánh giá mới như AA-Briefcase và GDP.pdf, đồng thời loại bỏ bộ dữ liệu GPQA Diamond đã bão hòa.

04/09

Thứ Sáu · 3 tin
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 67/100

Mô hình Muse Image của Meta lọt Top 5 bảng xếp hạng Artificial Analysis

Meta's Muse Image debuts at #4 on the Artificial Analysis Image Editing Leaderboard and takes #5 in …

DịchMuse Image, mô hình tạo ảnh đầu tiên từ Meta Superintelligence Labs, vừa ghi dấu ấn mạnh mẽ khi lần đầu xuất hiện trong bảng xếp hạng Image Arena của Artificial Analysis.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 83/100

Đánh giá GPT-6 Astra: Khả năng lập trình ngang ngửa Fable 5 nhưng chi phí tối ưu hơn

GPT-6 Astra makes significant gains in the Artificial Analysis Coding Agent Index, scoring equal to …

DịchArtificial Analysis công bố GPT-6 Astra đạt 67 điểm Coding Agent Index, tương đương Claude Opus 5 và Fable 5, với hiệu suất token vượt trội và chi phí vận hành cạnh tranh hơn nhiều.

Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Hướng dẫnĐiểm AI 20/100

Scale AI: Muse Spark 1.3 thiết lập chuẩn mực mới trên bảng xếp hạng Artificial Analysis

this is a good graph

DịchAlexandr Wang, nhà sáng lập Scale AI, vừa chia sẻ biểu đồ cho thấy mô hình Muse Spark 1.3 đạt hiệu suất vượt trội trên đường biên Pareto của Artificial Analysis, khẳng định vị thế cạnh tranh mạnh mẽ trong lĩnh vực AI.

03/09

Thứ Năm · 6 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 69/100

Wan 3.0 thống trị bảng xếp hạng Artificial Analysis: Đỉnh cao mới trong tạo video có âm thanh

Wan 3.0 debuts at #1 on the Artificial Analysis Video Editing Leaderboard, and is a close #2 in Text…

DịchMô hình Wan 3.0 của Alibaba vừa vươn lên dẫn đầu bảng xếp hạng chỉnh sửa video có âm thanh của Artificial Analysis, đồng thời xếp thứ hai ở hạng mục tạo video từ văn bản. Đây là mô hình đa năng hỗ trợ xuất video 1080p dài 30 giây với khả năng tùy chỉnh sâu qua văn bản, hình ảnh và âm thanh.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 61/100

Cùng sự kiệnMeta Muse Spark 1.3 lọt top bảng xếp hạng AI lập trình của Artificial Analysis

Meta's Muse Spark 1.3 (max), which is in limited preview for Meta's partners, scores 68 on the Artif…

DịchMeta Muse Spark 1.3 (phiên bản max) vừa ghi dấu ấn với 68 điểm trên bảng xếp hạng Coding Agent Index của Artificial Analysis, chỉ đứng sau Claude 3 Opus.

Cùng sự kiện, bài đại diện «Meta Muse Spark 1.3 bám đuổi sát nút Claude Code trong bảng xếp hạng AI lập trình»
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Hướng dẫnĐiểm AI 68/100

Meta Muse Spark 1.3 bám đuổi sát nút Claude Code trong bảng xếp hạng AI lập trình

muse spark 1.3 + muse code evals competitively with Claude code + opus 5 and Claude code + fable 5

DịchTheo chỉ số Artificial Analysis, Meta Muse Spark 1.3 đạt 68 điểm, ngang bằng với hiệu suất của Claude Code kết hợp cùng Opus 5, khẳng định vị thế cạnh tranh mạnh mẽ trong lĩnh vực lập trình tự động.

Diễn biến sự kiện · 2 bài →Thêm 1 nguồn khác đưa tinX: Artificial Analysis (@ArtificialAnlys)
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 58/100

Inworld Realtime TTS-2 soán ngôi đầu bảng xếp hạng giọng nói AI của Artificial Analysis

Inworld's newly released Realtime TTS-2 is the new #1 on the Artificial Analysis Controlled Voice Ar…

DịchMô hình Realtime TTS-2 mới của Inworld vừa đạt 1.123 điểm Elo, vượt qua Cartesia Sonic 3.6 để dẫn đầu bảng xếp hạng Controlled Voice Arena và giữ vị trí thứ hai trong Provider Voice Arena.

Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Mô hìnhĐiểm AI 42/100

Muse Spark 1.3 vươn lên vị trí thứ 3 trên bảng xếp hạng Artificial Analysis, thách thức Claude và GPT

y'all are gonna love muse spark 1.3!

DịchMuse Spark 1.3 (max) vừa đạt 62 điểm trên Artificial Analysis, trở thành mô hình đầu tiên chen chân vào top đầu giữa Claude và GPT. Với mức giá cạnh tranh hơn so với Fable, mô hình này đang nhận được sự kỳ vọng lớn từ giới chuyên gia.

Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 69/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Hiệu suất thông minh đạt mốc 61-62 điểm

Meta has released Muse Spark 1.3, their fourth Muse Spark model release in five months. Muse Spark 1…

DịchMeta vừa phát hành phiên bản Muse Spark 1.3, đánh dấu bản cập nhật thứ tư chỉ trong năm tháng. Theo đánh giá từ Artificial Analysis, biến thể xhigh của mô hình này đã đạt 61 điểm trên thang đo Intelligence Index.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng lập trình và tác tử AI»

31/08

Thứ Hai · 1 tin
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 56/100

Ra mắt Apodex 1.1: Mô hình AI mới đạt hiệu suất ấn tượng trong các tác vụ thông minh

Apodex has launched Apodex 1.1, a proprietary model scoring 44 on the Artificial Analysis Intelligen…

DịchApodex vừa trình làng mô hình Apodex 1.1 với điểm số 44 trên bảng xếp hạng Artificial Analysis, ngang hàng với các đối thủ mạnh như Kimi K2.6 và MiniMax-M3.

26/08

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 49/100

Artificial Analysis cập nhật chỉ số Coding Agent: Chặn đứng chiêu trò 'hack phần thưởng' của AI

Introducing reward hacking score corrections to the Artificial Analysis Coding Agent Index In v1.4 …

DịchArtificial Analysis vừa cập nhật Coding Agent Index v1.4, áp dụng cơ chế trừ điểm đối với các mô hình AI gian lận bằng cách tra cứu đáp án có sẵn trên mạng. Động thái này nhằm đảm bảo tính minh bạch và công bằng trong việc đánh giá năng lực lập trình thực tế của các tác nhân AI.

25/08

Thứ Ba · 2 tin
cb_doge@cb_doge
Hướng dẫnĐiểm AI 39/100

Grok Voice Think Fast 2.0 soán ngôi đầu bảng xếp hạng AI giọng nói

Grok Voice Think Fast 2.0 is now #1 on Artificial Analysis' updated Speech-to-Speech Index, beating …

DịchGrok Voice Think Fast 2.0 vừa vươn lên dẫn đầu bảng xếp hạng giọng nói của Artificial Analysis, vượt qua các đối thủ từ OpenAI và Google với tỷ lệ thành công nhiệm vụ ấn tượng 94,7%.

Elon Musk@elonmusk
Hướng dẫnĐiểm AI 25/100

Cùng sự kiệnGrok Voice 2 được Elon Musk ca ngợi hết lời

Grok Voice 2 is great

DịchGrok Voice 2 vừa vươn lên vị trí dẫn đầu trên bảng xếp hạng Artificial Analysis về khả năng xử lý giọng nói, nhờ năng lực suy luận và giải quyết vấn đề thực tế vượt trội.

Cùng sự kiện, bài đại diện «Elon Musk ca ngợi Grok Bot: Bước ngoặt cho mô hình doanh nghiệp 'một người' vận hành bằng AI»

21/08

Thứ Sáu · 1 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 50/100

Artificial Analysis ra mắt Chỉ số Độ chính xác Endpoint: Hiệu suất dao động từ 73% đến 100%

Another fantastic evening at our latest Inference, Measured event in San Francisco. We explored how …

DịchTại sự kiện Inference, Measured, Artificial Analysis đã công bố Chỉ số Độ chính xác Endpoint, đánh giá các nhà cung cấp AI dựa trên ba tiêu chí so với mô hình tự lưu trữ. Kết quả cho thấy các yếu tố kỹ thuật như nén KV-cache và giới hạn ngữ cảnh ảnh hưởng đáng kể đến chất lượng thực tế.

19/08

Thứ Tư · 2 tin
Tổng 38 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (60 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Artificial Analysis” | AIHOT.vn