09/09

Thứ Tư · 20 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 47/100

Jensen Huang: Quyền kiểm soát là giá trị cốt lõi của mô hình AI mã nguồn mở

"Closed models are cheaper. The reason you need open models is that they give you control". - Nvid…

DịchCEO Nvidia cho rằng mô hình đóng thường tiết kiệm chi phí hơn, nhưng mô hình mở lại chiếm ưu thế nhờ khả năng tùy chỉnh sâu cho các tác vụ chuyên biệt.

Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 46/100

Alibaba Cloud ra mắt Qwen3.8-Max: Mô hình 2.4T tham số với khả năng đa phương thức mạnh mẽ

Stop renting intelligence. Power your coding & multi-agent workflows with Alibaba Qwen3.8-Max's 2.4T…

DịchAlibaba Cloud chính thức phát hành Qwen3.8-Max, mô hình 2.4T tham số hỗ trợ cửa sổ ngữ cảnh 1M token và khả năng đa phương thức gốc, tối ưu cho lập trình và tác vụ đa tác nhân. Người dùng có thể nhận 70 triệu token miễn phí trên Qwen Cloud và Model Studio ngay hôm nay.

Thêm 1 nguồn khác đưa tinPandaily
Ant Ling@AntLingAGI
NgànhĐiểm AI 46/100

Mô hình Ling 3.0 Flash của Ant Group được nâng cấp khả năng thị giác

Thanks to our day0 partner @atomic_chat_hq to bring the visual intelligence to more users and creato…

DịchAntLingAGI vừa bổ sung khả năng phân tích hình ảnh cho Ling 3.0 Flash. Đối tác Atomic Chat đã phát hành phiên bản GGUF cho phép chạy mô hình cục bộ trên các thiết bị đầu cuối.

TechNode
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnDeepSeek ra mắt bản thử nghiệm giới hạn cho mô hình đa phương thức V4.1 Flash

DeepSeek vừa giới thiệu phiên bản beta của V4.1 Flash, mô hình sử dụng kiến trúc mới với khả năng xử lý đa phương thức vượt trội, tốc độ nhanh và chi phí tối ưu hơn. Người dùng hiện có thể trải nghiệm mô hình này thông qua API của hãng.

Cùng sự kiện, bài đại diện «DeepSeek V4.1 Flash chính thức mở thử nghiệm: Cấu trúc mới, tốc độ vượt trội»
smol.ai AI News
Mô hìnhĐiểm AI 85/100

DeepSeek ra mắt V4.1-Flash: Mô hình mã nguồn mở tối ưu chi phí với 763 tỷ tham số

DeepSeek vừa trình làng V4.1-Flash, mô hình flagship mới với kiến trúc encoder-decoder đột phá, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và tối ưu hóa mạnh mẽ hiệu suất suy luận ở mức chi phí thấp.

Thêm 1 nguồn khác đưa tinX: Tianyi Cui (@tianyi)
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 51/100

Ra mắt Miles v0.1: Hệ thống RL mã nguồn mở chuyên dụng cho hậu huấn luyện cấp sản xuất

Miles v0.1 là hệ thống hậu huấn luyện toàn diện, tối ưu cho môi trường sản xuất, giúp chuẩn hóa quy trình huấn luyện RL với thiết kế linh hoạt, dễ tùy chỉnh và kiểm chứng.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 40/100

NeoHorse-1: Đột phá tự cải tiến cho AI Agent thông qua khung định tuyến thông minh

NeoHorse-1 là mô hình AI Agent thế hệ mới, sử dụng cơ chế định tuyến thông minh để tự động chuyển hóa tương tác người dùng thành dữ liệu huấn luyện, tạo ra vòng lặp khép kín giúp mô hình tự đánh giá và nâng cấp hiệu suất liên tục.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 50/100

Mark Zuckerberg xác nhận Meta đang huấn luyện thế hệ mô hình AI kế nhiệm Watermelon

Mark Zuckerberg just revealed that Meta is already training post-Watermelon models. for context, Wa…

DịchZuckerberg cho biết Meta đang sử dụng siêu máy tính Prometheus với công suất 1GW để huấn luyện mô hình AI mới, được kỳ vọng mạnh gấp 10 lần so với Watermelon - mô hình lớn nhất hiện nay của hãng.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 65/100

Inception ra mắt Mercury 2.5: Mô hình ngôn ngữ khuếch tán mạnh mẽ nhất hiện nay

Inception vừa trình làng Mercury 2.5, mô hình ngôn ngữ khuếch tán lớn nhất và thông minh nhất của hãng với hiệu suất tăng 40% so với bản tiền nhiệm, sẵn sàng cạnh tranh với các đối thủ hàng đầu như GPT-5.6 Luna, Gemini 3.5 Flash-Lite và Claude Haiku 4.5.

Jason Liu@jxnlco
NgànhĐiểm AI 32/100

Cùng sự kiệnOpenAI tổ chức sự kiện ăn mừng ra mắt GPT-6 tại San Francisco

here we go again!

DịchOpenAI vừa thông báo tổ chức buổi gặp mặt cộng đồng tại San Francisco vào ngày 16/9 để ăn mừng sự kiện ra mắt mô hình GPT-6, tiếp nối truyền thống từ phiên bản GPT-5.5 trước đó.

Cùng sự kiện, bài đại diện «OpenAI tổ chức sự kiện ăn mừng ra mắt GPT-6 tại San Francisco»
Kim@kimmonismus
NgànhĐiểm AI 37/100

IFM K2 Horizon: Bước tiến mới trong việc minh bạch hóa toàn bộ quy trình huấn luyện AI

1/ Six models, from 0.9B to 375B total parameters, released as one connected fleet. @IFM_AI's K2 Ho…

DịchIFM ra mắt bộ 6 mô hình K2 Horizon với quy mô từ 0.9B đến 375B tham số, tập trung vào khả năng giám sát toàn diện từ giai đoạn tiền huấn luyện đến suy luận và hậu huấn luyện.

08/09

Thứ Ba · 13 tin
Kim@kimmonismus
NgànhĐiểm AI 38/100

Anthropic chuẩn bị ra mắt mô hình Fable thế hệ mới trước thềm IPO

GPT-6 Alpha was a new pre-training run. Now it seems to be Anthropic's turn with a new pre-training …

DịchAnthropic dự kiến trình làng phiên bản kế nhiệm của Fable 5.1 vào cuối tháng 9 hoặc đầu tháng 10. Đây là mô hình được huấn luyện hoàn toàn mới, được kỳ vọng sẽ vượt qua hiệu năng của Astra.

Nathan Lambert@natolambert
NgànhĐiểm AI 34/100

Làn sóng mô hình mã nguồn mở đang lấn lướt các tranh cãi tại các phòng thí nghiệm AI hàng đầu

While everyone is raging at me for defending OpenAI/Anthropic in one narrow area, we have got loads …

DịchChuyên gia Nathan Lambert kêu gọi cộng đồng tập trung vào sự bùng nổ của 25 mô hình mã nguồn mở mới từ 18 tổ chức lớn như Qwen, DeepSeek và Meta, thay vì sa đà vào những ồn ào nội bộ tại OpenAI hay Anthropic.

ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 34/100

Mặt Bích AI chia sẻ tầm nhìn về mô hình 2B chạy cục bộ

Thanks for testing it out and sharing these numbers! 🙌 "Run a swarm of these locally" - that's exa…

DịchMặt Bích AI khẳng định tầm nhìn về việc chạy các mô hình 2B tối ưu trên thiết bị cá nhân. Với kích thước chỉ 1.56GB sau khi lượng tử hóa, mô hình đạt tốc độ hơn 200 token/giây trên RTX 4090 mà vẫn giữ được hiệu năng tương đương các mô hình 4B.

ModelBest OpenBMB@OpenBMB
NgànhĐiểm AI 27/100

MiniCPM5-2B: Mô hình AI siêu nhẹ gây sốt cộng đồng khi chạy mượt trên MacBook

Huge thanks for trying it out and sharing the results 🙌 Can't wait to see what other creative workf…

DịchMô hình MiniCPM5-2B đang nhận được nhiều phản hồi tích cực nhờ khả năng chạy cục bộ trên MacBook 16GB với hiệu suất vượt trội hơn Qwen3.5-4B, hỗ trợ tốt các tác vụ tìm kiếm và tóm tắt thông tin thông minh.

Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 24/100

Cùng sự kiệnAlibaba Cloud mở rộng quyền truy cập API cho dòng mô hình Qwen

What happens when your picnic accidentally enters Giant Mode.. More API access: • Qwen Cloud: https…

DịchAlibaba Cloud vừa thông báo mở rộng quyền truy cập API cho các mô hình Qwen thông qua Qwen Cloud và Model Studio, giúp các nhà phát triển dễ dàng tiếp cận công nghệ AI của họ hơn.

Cùng sự kiện, bài đại diện «Alibaba Cloud trình diễn robot 'thú bông' dọn dẹp bàn làm việc, mở quyền truy cập API Qwen»
IT Home
Mô hìnhĐiểm AI 57/100

DeepSeek V4.1 Flash ra mắt bản thử nghiệm: Cấu trúc mới, hỗ trợ đa phương thức nguyên bản

DeepSeek vừa khởi động thử nghiệm phiên bản V4.1 Flash với kiến trúc mô hình cải tiến, mang lại khả năng xử lý đa phương thức mạnh mẽ hơn cùng tốc độ vượt trội và chi phí tối ưu.

Thêm 6 nguồn khác đưa tinX: X.PIN (@thexpin)X: Gabriel (@gabriel1)PandailyTechNodeX: Kim (@kimmonismus)Jiqizhixin
X.PIN@thexpin
NgànhĐiểm AI 32/100

Cùng sự kiệnDeepSeek V4.1 Flash chính thức mở bản thử nghiệm

Take a look, DeepSeek V4.1 Flash appears to be open for testing!

DịchDeepSeek vừa bất ngờ tung ra phiên bản thử nghiệm cho mô hình DeepSeek V4.1 Flash, hứa hẹn mang lại hiệu suất xử lý vượt trội.

Cùng sự kiện, bài đại diện «DeepSeek V4.1 Flash ra mắt bản thử nghiệm: Cấu trúc mới, hỗ trợ đa phương thức nguyên bản»
ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 62/100

OpenBMB ra mắt MiniCPM5: Mô hình AI chạy trên thiết bị với cửa sổ ngữ cảnh 128K

Thank you for the amazing support as always! @ModelScope2022

DịchOpenBMB vừa phát hành MiniCPM5, dòng mô hình AI tối ưu cho thiết bị di động với các phiên bản 1B và 2B, hỗ trợ cửa sổ ngữ cảnh lên tới 128K cùng khả năng lập trình và sử dụng công cụ mạnh mẽ.

ModelBest OpenBMB@OpenBMB
Mô hìnhĐiểm AI 54/100

OpenBMB ra mắt MiniCPM5-2B: Mô hình 2.6B mạnh mẽ với khả năng suy luận linh hoạt

Thank you @vllm_project for the day-0 support 🙌

DịchOpenBMB vừa trình làng MiniCPM5-2B, mô hình 2.6B hỗ trợ ngữ cảnh 131K và linh hoạt chuyển đổi giữa chế độ suy luận (Think) và phản hồi trực tiếp. Đặc biệt, mô hình đã được hỗ trợ chính thức ngay từ ngày đầu trên vLLM, giúp tối ưu hóa hiệu suất triển khai.

07/09

Thứ Hai · 7 tin
The Decoder: AI News
Mô hìnhĐiểm AI 55/100

Alibaba ra mắt Qwen-Drive 1.0: Một mô hình AI duy nhất cho cả lái xe tự động và trợ lý thông minh

Dựa trên nền tảng Qwen3.5-4B, Qwen-Drive 1.0 tích hợp khả năng nhận diện môi trường 3D và lập kế hoạch lộ trình, cho phép một mô hình duy nhất vừa điều khiển xe vừa hỗ trợ người dùng trong khoang lái.

Thêm 1 nguồn khác đưa tinPandaily
Tencent Hunyuan@TencentHunyuan
Sản phẩmĐiểm AI 62/100

Tencent Hunyuan ra mắt bản xem trước Hy4: Tối ưu hóa khả năng suy luận dài

✔️Hy4 preview just shipped an upgrade. You flagged it: long thinking + over-verification on complex …

DịchTencent đã cập nhật mô hình Hy4 preview nhằm khắc phục lỗi suy luận quá đà và xử lý tác vụ phức tạp hiệu quả hơn. Với 770B tham số, mô hình mới giúp giảm số vòng hội thoại và tiết kiệm token mà vẫn đảm bảo chất lượng phản hồi.

QbitAI
Mô hìnhĐiểm AI 88/100

Tinh chọnHuy chương Fields tham chiến AI: Sự kết hợp giữa Qwen 4B và GLM tạo đột phá tại ARC-AGI

Sự hợp tác giữa các chuyên gia toán học hàng đầu và mô hình ngôn ngữ lớn đang mở ra hướng đi mới, khi kết hợp Qwen 4B trên thiết bị di động với sức mạnh đám mây của GLM để chinh phục thử thách ARC-AGI.


Vì sao đáng đọc: Tin tức kết hợp giữa nhân vật tầm cỡ (Huy chương Fields) và công nghệ AI tiên tiến (ARC-AGI) tạo sức hút lớn, mang tính chuyên môn cao và có giá trị tham khảo cho giới nghiên cứu.
IT Home
Hướng dẫnĐiểm AI 53/100

Bảng xếp hạng AI Arena tuần 36: Mô hình nội địa Trung Quốc chiếm sóng lập trình, Alibaba Wan 3.0 lọt Top 3 video

Nền tảng Arena vừa công bố bảng xếp hạng mù các mô hình AI tuần 36 năm 2026, ghi nhận sự bứt phá mạnh mẽ của các mô hình nội địa trong lĩnh vực lập trình và sự xuất hiện ấn tượng của Wan 3.0 từ Alibaba trong mảng tạo video.

06/09

Chủ Nhật · 5 tin
Testing Catalog@testingcatalog
NgànhĐiểm AI 27/100

Cùng sự kiệnMột tuần bùng nổ: 4 ông lớn AI đồng loạt tung ra các mô hình hàng đầu

Chỉ trong một tuần, thị trường AI chứng kiến sự đổ bộ của các mô hình mới từ 4 phòng thí nghiệm hàng đầu, tiêu biểu là Gemini 3.8 Flash, đánh dấu cuộc đua khốc liệt về hiệu năng và tốc độ.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3, tích hợp vào Muse Code và Meta Model API»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (72 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “mô hình ngôn ngữ” — Trang 7 | AIHOT.vn