26/08

Thứ Tư · 30 tin
Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 43/100

Qwen3.8-27B thống trị bảng xếp hạng mã nguồn mở về chuyển đổi hình ảnh sang web

#1 among open models in the Image-to-WebDev Arena, #7 overall. 🚀 Thanks for the recognition! @arena…

DịchMô hình Qwen3.8-27B của Alibaba đạt vị trí số 1 trong các mô hình mã nguồn mở tại Image-to-WebDev Arena, sở hữu hiệu năng ngang ngửa các mô hình khổng lồ với chi phí tối ưu.

Thêm 2 nguồn khác đưa tinX: Artificial Analysis (@ArtificialAnlys)X: MiniMax (@MiniMax_AI)
Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 28/100

Alibaba Cloud Qwen: Chiến lược cân bằng giữa mua sẵn và tự xây dựng AI cho doanh nghiệp

Build vs. Buy? The Enterprise AI Dilemma. The practical answer is both at once: • Buy the platform…

DịchAlibaba Cloud đề xuất mô hình kết hợp: sử dụng nền tảng có sẵn để triển khai nhanh, đồng thời tự tinh chỉnh và vận hành các mô hình Qwen mã nguồn mở để đảm bảo quyền kiểm soát và tính linh hoạt.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 45/100

Hàn Quốc khẳng định vị thế thứ 3 trong cuộc đua AI toàn cầu với loạt mô hình vượt mốc 30 điểm

South Korea has once again established a clear #3 position in the global AI race, trailing only the …

DịchNhờ đầu tư công và nhân tài nội địa, Hàn Quốc vươn lên vị trí thứ 3 thế giới về AI. Các mô hình như Motif 3 và Solar Pro 4 đang dẫn đầu bảng xếp hạng ngoài Mỹ và Trung Quốc.

Aravind Srinivas (Perplexity CEO)@AravSrinivas
Nghiên cứuĐiểm AI 33/100

Perplexity ra mắt AI Agent chạy cục bộ, nhận sự hậu thuẫn từ NVIDIA

Big thanks to @nvidia for working together with us and supporting this research on DGX Spark as well…

DịchPerplexity giới thiệu Portable Computer, AI Agent chạy trực tiếp trên thiết bị với mô hình 27B đạt hiệu suất vượt trội, đồng thời hợp tác cùng NVIDIA để thúc đẩy hệ sinh thái mô hình mã nguồn mở hiệu quả.

Every: Bài mới (Web)
Hướng dẫnĐiểm AI 22/100

Đừng quá tin vào các bài kiểm tra năng lực AI: Chúng không hiểu công việc thực tế của bạn

Các bài kiểm tra (benchmark) tiêu chuẩn thường không phản ánh chính xác hiệu suất của AI trong các tác vụ chuyên biệt. Thay vì dựa vào điểm số, hãy tự đánh giá mô hình dựa trên quy trình làm việc thực tế của chính bạn.

Kim@kimmonismus
Mô hìnhĐiểm AI 37/100

OpenAI hoàn tất huấn luyện mô hình 'Bel' với hơn 10 nghìn tỷ tham số

OpenAI has reportedly (per @synthwavedd) finished training "Bel, " a massive successor to "Doug" wit…

DịchOpenAI được cho là đã hoàn thành mô hình thế hệ mới mang mật danh 'Bel' với quy mô hơn 10T tham số, đóng vai trò nền tảng cho Astra và GPT-6 trong tương lai.

Thêm 1 nguồn khác đưa tinIT Home
Perplexity@perplexity_ai
Sản phẩmĐiểm AI 48/100

Perplexity ra mắt Portable Computer: Trợ lý AI cục bộ mạnh mẽ và bảo mật

New research: Portable Computer is a local-first agent for private and cost-effective work. With an…

DịchPerplexity giới thiệu Portable Computer, một tác nhân AI chạy cục bộ với mô hình 27B, giúp tối ưu hóa công việc tri thức với độ bảo mật cao và chi phí thấp, vượt qua các khung làm việc mã nguồn mở hiện nay.

Thêm 1 nguồn khác đưa tinIT Home

25/08

Thứ Ba · 16 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnMint-Agent: Mô hình AI tài chính từ ĐH Sư phạm Hoa Đông vượt mặt GPT-5.6, đạt doanh thu trăm triệu tệ

Mint-Agent, dòng mô hình AI chuyên biệt cho tài chính, vừa ra mắt với hiệu suất vượt trội so với các đối thủ hàng đầu nhưng chi phí vận hành chỉ bằng 1/10. Dự án đã thu hút hơn 100 triệu nhân dân tệ đơn hàng thương mại, đánh dấu bước tiến từ thử nghiệm sang ứng dụng thực tế.


Vì sao đáng đọc: Tin tức quan trọng về đột phá mô hình chuyên biệt (vertical AI) với số liệu chứng minh hiệu quả kinh tế và thương mại rõ ràng, rất có giá trị cho cộng đồng AI và tài chính.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

EXPL-FR: Giải mã mô hình nhận diện khuôn mặt thông qua sự kết hợp giữa thị giác và ngôn ngữ

EXPL-FR sử dụng bộ chuyển đổi nhẹ để liên kết mô hình ngôn ngữ thị giác với không gian nhúng của nhận diện khuôn mặt, cho phép giải thích các đặc điểm ngữ nghĩa mà mô hình dựa vào mà không cần huấn luyện lại.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 61/100

Thomson Reuters ra mắt mô hình ngôn ngữ lớn tự phát triển 'Thomson'

Thomson Reuters vừa giới thiệu mô hình AI tự phát triển với chi phí tối ưu, đạt hiệu suất ngang ngửa các mô hình hàng đầu trong việc xử lý dữ liệu chuyên sâu. Hãng cũng đã phát hành phiên bản 'small' trên Hugging Face cho mục đích nghiên cứu.

Qwen@Alibaba_Qwen
Hướng dẫnĐiểm AI 33/100

Qwen2.5-27B: Mô hình nhỏ duy nhất lọt Top 10 bảng xếp hạng Code Arena

Qwen3.8-27B at #9 overall on Code Arena, the only model in its size class in the top 10.😎 Small but…

DịchQwen2.5-27B xuất sắc giành vị trí thứ 9 trên bảng xếp hạng Code Arena: WebDev với 1595 điểm, trở thành mô hình duy nhất trong nhóm kích thước nhỏ lọt vào top 10, vượt xa các đối thủ cùng phân khúc.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 46/100

Apodex 1.1: Bước tiến mới trong khả năng thực thi tác vụ phức tạp của AI Agent

Apodex 1.1 tối ưu hóa khả năng xử lý tài liệu, lập trình và nghiên cứu thông qua cơ chế phối hợp tác tử thông minh. Với phiên bản 35B có thể chạy cục bộ, mô hình đạt hiệu suất vượt trội so với các hệ thống lớn hơn trong nhiều lĩnh vực chuyên môn.

Thêm 1 nguồn khác đưa tinX: Ma Dongxi NLP (@dongxi_nlp)
OpenRouter: Announcements
NgànhĐiểm AI 60/100

Tinh chọnNghịch lý Jevons và sức mạnh của giảm giá: Dữ liệu OpenRouter cho thấy token sử dụng tăng vọt khi hạ giá mô hình

Dữ liệu từ OpenRouter chỉ ra rằng việc giảm giá mạnh các mô hình Terra và Luna đã khiến lưu lượng sử dụng token tăng lần lượt 5,6 và 13,8 lần, minh chứng cho nghịch lý Jevons trong lĩnh vực AI.


Vì sao đáng đọc: Bài viết cung cấp dữ liệu thực tế thú vị về hành vi người dùng và kinh tế học AI, giúp các nhà phát triển hiểu rõ hơn về tác động của giá cả đối với nhu cầu sử dụng.
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 23/100

Ethan Mollick: Các phòng thí nghiệm AI nên dùng bài kiểm tra 'vẽ kỳ lân' để minh bạch hóa mô hình

Math is fine, but vague posting from labs about new models should only be allowed if the post consis…

DịchChuyên gia Ethan Mollick đề xuất rằng thay vì những tuyên bố mơ hồ, các phòng thí nghiệm AI chỉ nên được phép quảng bá mô hình mới nếu họ chứng minh được khả năng thực tế qua bài kiểm tra vẽ hình bằng TiKZ, giống như cách đã từng thử nghiệm trong báo cáo Sparks of AGI.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 47/100

Sự kết thúc của 'bữa trưa miễn phí': Khi chi phí lập trình AI trở thành bài toán sống còn

Sự ra mắt của Fable với mức giá cao đã thúc đẩy người dùng chuyển sang các mô hình tiết kiệm hơn như GLM 5.2. Xu hướng này cho thấy doanh nghiệp đang tái cấu trúc khối lượng công việc để tối ưu chi phí thay vì chỉ phụ thuộc vào các mô hình lớn nhất.

Kim@kimmonismus
Mô hìnhĐiểm AI 24/100

Ox Alpha rục rịch tung bản cập nhật lớn đầy hứa hẹn

It seems as though Ox Alpha has already received a significant update. You have no idea how excited…

DịchOx Alpha vừa hé lộ thông tin về một bản cập nhật quan trọng. Cộng đồng đang rất kỳ vọng vào những cải tiến kỹ thuật đột phá và thời điểm ra mắt chính thức của mô hình này.

24/08

Thứ Hai · 7 tin
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 28/100

Mô hình Ox Alpha đạt công suất xử lý ấn tượng gần 6 nghìn tỷ token mỗi ngày

Ox Alpha is on track to hit nearly 6 trillion tokens today. Try it now via ori in your coding agent…

DịchOpenRouter thông báo mô hình Ox Alpha hiện đã đạt lưu lượng xử lý gần 6 nghìn tỷ token/ngày. Người dùng có thể tích hợp ngay vào các tác nhân lập trình thông qua công cụ ori.

Elvis Saravia@omarsar0
Mô hìnhĐiểm AI 32/100

Ox Alpha thống trị bảng xếp hạng OpenRouter và cho phép trải nghiệm miễn phí

It's a great model. I've been having fun using it with Pi. You can test Ox Alpha with Pi or Hermes …

DịchMô hình Ox Alpha hiện đã có mặt trên OpenRouter và người dùng có thể trải nghiệm miễn phí kết hợp cùng Pi hoặc Hermes Agent ngay tại nền tảng playground của DAIR.AI.

IT Home
Mô hìnhĐiểm AI 57/100

Thomson Reuters chi 40 triệu USD phát triển mô hình AI dựa trên nền tảng Qwen của Alibaba

Thomson Reuters vừa ra mắt mô hình ngôn ngữ lớn Thomson, được xây dựng trên nền tảng Qwen3.5-397B với chi phí 40 triệu USD. Công ty chọn hướng đi này để tối ưu hóa chi phí dài hạn và tăng quyền kiểm soát tùy chỉnh so với các mô hình đóng từ bên thứ ba.

The Decoder: AI News
Mô hìnhĐiểm AI 60/100

Thomson Reuters đầu tư 40 triệu USD phát triển mô hình ngôn ngữ pháp lý riêng "Thomson"

Thomson Reuters chi 40 triệu USD phát triển mô hình "Thomson" dựa trên nền tảng Qwen, tận dụng kho dữ liệu độc quyền từ Westlaw để tối ưu hóa cho lĩnh vực pháp lý.

Thêm 3 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: X.PIN (@thexpin)IT Home

23/08

Chủ Nhật · 6 tin
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 34/100

Đã đến lúc thay đổi cách đánh giá mô hình AI: Cần các khung tiêu chuẩn tối giản

Important discussion. Measuring models against harnesses is completely broken. I prefer to test mode…

DịchCác phương pháp đánh giá mô hình truyền thống đang dần lỗi thời. Thay vào đó, ngành AI cần chuyển sang các khung tiêu chuẩn tối giản như Pi hoặc Hermes Agent, hướng tới tương lai nơi khung đánh giá có thể tự động tùy chỉnh theo từng tác vụ cụ thể.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

AutoDesign: Dùng 'giàn giáo' thông minh giúp mô hình AI yếu đạt hiệu suất tiệm cận mô hình lớn

A weak model with well-built scaffolding around it can close most of the gap to a frontier model, so…

DịchAutoDesign tự động tối ưu hóa quy trình làm việc của AI bằng cách phân tích lỗi và tinh chỉnh prompt, giúp các mô hình nhỏ đạt hiệu suất vượt trội, thu hẹp khoảng cách với các mô hình tiên tiến mà không cần nâng cấp phần cứng.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Microsoft SocialRL: Giúp mô hình 4B đàm phán vượt mặt cả GPT-4.1

New Microsoft paper shows an AI agent that negotiates for you will usually lose, because it was trai…

DịchMicrosoft phát hiện các AI hiện nay quá dễ dãi khi đàm phán. Phương pháp SocialRL mới giúp mô hình 4B đạt hiệu suất ngang ngửa GPT-4.1 trong các trò chơi thương thuyết bằng cách tập trung vào kết quả giao dịch thay vì chỉ tuân lệnh người dùng.

Kim@kimmonismus
Hướng dẫnĐiểm AI 35/100

Mô hình bí ẩn Ox Alpha đạt hiệu suất ngang ngửa GPT-5.6 Sol mid trong bài kiểm tra DeepSWE

Ox Alpha has now been fully tested against the DeepSWE set by @davis7. Overall, it's performing mor…

DịchMô hình Ox Alpha gây chú ý khi đạt 63% trong bài kiểm tra DeepSWE, cho thấy khả năng lập trình mạnh mẽ. Nếu đây thực sự là GLM-5.3 Flash, khả năng chạy cục bộ trên DGX Spark sẽ tạo ra lợi thế lớn về chi phí.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (47 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Mô hình ngôn ngữ” — Trang 12 | AIHOT.vn