26/09

Thứ Bảy · 6 tin
Meituan LongCat@Meituan_LongCat
Mô hìnhĐiểm AI 34/100

Cùng sự kiệnMô hình LongCat-2.5-Preview cho phép dùng thử miễn phí 2 tuần trên OpenCode

LongCat-2.5-Preview is now free to try on @opencode for two weeks! 🐱 Give it a spin and show us wha…

DịchLongCat-2.5-Preview hiện đã có mặt trên OpenCode với thời gian dùng thử miễn phí 2 tuần. Mô hình hỗ trợ cửa sổ ngữ cảnh 1 triệu token, khả năng đa phương thức và cam kết không lưu trữ dữ liệu người dùng.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
IT Home
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnMeituan ra mắt mô hình LongCat-2.5-Preview: 1.6 nghìn tỷ tham số, tối ưu cho tác vụ dài và đa phương thức

Nền tảng API của Meituan đã chính thức phát hành mô hình LongCat-2.5-Preview vào ngày 25/9, đồng thời mở cổng trải nghiệm qua API và giao diện web.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
JiQiZhiXin
Nghiên cứuĐiểm AI 88/100

Tinh chọnV-Rubrics: Tối ưu hóa học tăng cường đa phương thức với 350.000 tiêu chí đánh giá chi tiết

V-Rubrics giải quyết vấn đề 'phân bổ tín dụng' trong mô hình đa phương thức bằng cách chia nhỏ đánh giá thành các tiêu chí chi tiết, giúp mô hình học từ cả những suy luận đúng ngay cả khi kết quả cuối cùng sai.


Vì sao đáng đọc: Nghiên cứu quan trọng được chấp nhận tại EMNLP 2026, giải quyết bài toán hóc búa trong huấn luyện mô hình đa phương thức bằng phương pháp đánh giá phân đoạn sáng tạo.
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 70/100

Cùng sự kiệnĐội ngũ Qwen công bố Qwen3.8-Omni-Flash: Kỷ nguyên của các tác nhân AI toàn năng

The era of omni agents is upon us. This is a great report by the Qwen Team on their omni-modal agen…

DịchQwen3.8-Omni-Flash là mô hình đa phương thức gốc, sử dụng kiến trúc MoE thưa thớt với cửa sổ ngữ cảnh 1 triệu token, tối ưu cho các tác vụ phức tạp như chỉnh sửa video và dịch thuật âm thanh dài.

Cùng sự kiện, bài đại diện «Đội ngũ Qwen công bố báo cáo kỹ thuật về mô hình đa phương thức Qwen3.8-Omni-Flash»
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 69/100

Đội ngũ Qwen công bố báo cáo kỹ thuật về mô hình đa phương thức Qwen3.8-Omni-Flash

Era of the omni models is upon us. This is a great report by the Qwen Team on their omni model. Th…

DịchQwen3.8-Omni-Flash là mô hình đa phương thức gốc, sử dụng kiến trúc MoE thưa với cửa sổ ngữ cảnh 1 triệu token, tối ưu cho các tác vụ tác nhân AI dài hạn như chỉnh sửa video và dịch thuật âm thanh-hình ảnh chuyên sâu.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 45/100

Mô hình suy luận Perceptron Mk1.5 chính thức có mặt trên OpenRouter

Perceptron Mk1.5 from @perceptroninc is live on OpenRouter. It is Perceptron's embodied reasoning m…

DịchPerceptron Mk1.5, mô hình suy luận dành cho các tác nhân vật lý (embodied agents), đã được tích hợp lên OpenRouter. Mô hình hỗ trợ đa phương thức bao gồm văn bản, hình ảnh, video, âm thanh và khả năng phản hồi bằng các tọa độ không gian.

25/09

Thứ Sáu · 4 tin
karminski@karminski3
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnMeituan ra mắt LongCat-2.5-Preview: Giữ nguyên giá, hỗ trợ cửa sổ ngữ cảnh 1M token

Meituan vừa phát hành LongCat-2.5-Preview với 1.6T tham số, hỗ trợ 1M token và khả năng đa phương thức mạnh mẽ cho các tác vụ dài. Mô hình tối ưu cho nhiều tác vụ từ trình duyệt đến thiết kế, hiện đã có thể truy cập qua API và giao diện chat.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
Meituan LongCat@Meituan_LongCat
Mô hìnhĐiểm AI 55/100

Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc

LongCat-2.5-Preview is now live. 1.6T parameters. ~48B active. A 1M-token context window. Natively …

DịchMeituan giới thiệu LongCat-2.5-Preview với 1.6T tham số (48B kích hoạt), hỗ trợ cửa sổ ngữ cảnh 1M token và khả năng đa phương thức gốc, tối ưu cho các tác vụ phức tạp trên trình duyệt, GUI và thiết kế.

Diễn biến sự kiện · 5 bài →Thêm 3 nguồn khác đưa tinX: opencode (@opencode)IT HomeX: karminski (@karminski3)
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

OmniEcho: Bước tiến mới trong khả năng hiểu âm thanh không gian cho robot tự hành

OmniEchoBench là bộ tiêu chuẩn mới giúp đánh giá khả năng nhận diện âm thanh không gian và điều hướng đa phương thức cho các tác nhân AI trong môi trường thực tế, kết hợp cùng mô hình OmniEcho giúp robot hiểu sâu hơn về sự tương quan giữa âm thanh và hình ảnh.

24/09

Thứ Năm · 4 tin
WeChat: Carl AI Watts
Hướng dẫnĐiểm AI 70/100

Cùng sự kiệnĐánh giá thực tế GPT-6 Sol, Luna và Claude Opus 5.5: Đột phá về lập trình, thiết kế và đa phương thức

Bài viết trải nghiệm ba mô hình mới với hiệu suất vượt trội: GPT-6 Sol và Luna giảm 50% chi phí API, trong khi Claude Opus 5.5 tăng 30% tốc độ và giảm 40% chi phí, kèm theo nâng cấp hạn mức sử dụng cho các gói trả phí.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt bộ đôi GPT-6 Sol và Luna trên OpenRouter với chi phí cực rẻ»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 36/100

Xóa bỏ khoảng cách chú ý trong tạo video đa phương thức: RecCAR giúp đồng bộ hóa video với chuyển động và âm thanh

Nghiên cứu chỉ ra sự mất cân bằng trong các mô hình Transformer đa phương thức, nơi video áp đảo các tín hiệu khác. Phương pháp RecCAR sử dụng cơ chế chính quy hóa KL để cân bằng lại sự tương tác, giúp cải thiện đáng kể độ chính xác về chuyển động và đồng bộ âm thanh trong video.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 36/100

Mô hình Qwen3.8 Max Prime chính thức có mặt trên OpenRouter

Qwen3.8 Max Prime from @Alibaba_Qwen is live on OpenRouter. A higher-throughput variant of Qwen3.8 …

DịchQwen3.8 Max Prime, phiên bản tối ưu hóa băng thông cao của Qwen3.8 Max, đã chính thức ra mắt trên OpenRouter. Mô hình giữ nguyên sức mạnh 2.4T tham số, hỗ trợ đa phương thức (văn bản, ảnh, video), cửa sổ ngữ cảnh 1M và khả năng suy luận mạnh mẽ.

Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 29/100

GLM-5.3 vượt mặt mô hình bí ẩn Space Bunny Alpha trong bài kiểm tra vật lý con lắc Newton

GLM-5.3 beat Space Bunny Alpha (the new stealth model launched today) on Newton's cradle in a 5-scen…

DịchTrong bài kiểm tra 5 kịch bản vật lý từ aimlapi, GLM-5.3 đã đánh bại Space Bunny Alpha - mô hình vừa ra mắt âm thầm trên OpenRouter với cửa sổ ngữ cảnh 1M token và khả năng đa phương thức mạnh mẽ.

23/09

Thứ Tư · 6 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Tri-PvP: Vạch trần thiên kiến đa phương thức trong các mô hình ngôn ngữ lớn Omni-modal

Nghiên cứu giới thiệu Tri-PvP, bộ benchmark gồm 8.000 mẫu nhằm phân tích sự xung đột giữa tín hiệu tri giác và mệnh đề trong các mô hình đa phương thức, qua đó phát hiện thiên kiến thị giác mạnh mẽ và sự bất đối xứng trong cách các mô hình xử lý dữ liệu.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 49/100

Space Bunny Alpha chính thức có mặt trên OpenRouter

Meet Space Bunny Alpha on OpenRouter ⚡ A flash model with fast inference, adjustable reasoning, and…

DịchSpace Bunny Alpha là mô hình flash mới với tốc độ suy luận cực nhanh, khả năng tùy chỉnh tư duy và cửa sổ ngữ cảnh lên tới 1M token, hỗ trợ đa phương thức gồm văn bản, hình ảnh và video.

opencode@opencode
Mô hìnhĐiểm AI 39/100

Mô hình ẩn danh Space Bunny mở miễn phí 1 tuần: Hỗ trợ 1M context và đa phương thức

Space Bunny (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retent…

DịchSpace Bunny, mô hình AI tập trung vào quyền riêng tư với chính sách không lưu trữ dữ liệu, hiện cho phép người dùng trải nghiệm miễn phí trong 7 ngày với khả năng xử lý 1 triệu token và đa phương thức.

Diễn biến sự kiện · 1 bài →
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Ovis-Embedding: Đột phá mới trong mô hình nhúng đa phương thức toàn diện

Ovis-Embedding là mô hình nhúng đa phương thức tiên tiến, tích hợp văn bản, hình ảnh, video và âm thanh vào một không gian biểu diễn chung nhờ kiến trúc backbone thống nhất và phương pháp huấn luyện tập trung vào dữ liệu chất lượng cao.

QbitAI
Mô hìnhĐiểm AI 85/100

Alibaba công bố chiến lược mô hình đa phương thức toàn diện: Tương lai không còn ranh giới

Alibaba dự báo trong 3 năm tới sẽ xuất hiện mô hình tạo sinh đa phương thức thống nhất, xóa bỏ hoàn toàn ranh giới giữa các loại hình dữ liệu, mở ra trải nghiệm người dùng hoàn toàn mới.

Diễn biến sự kiện · 3 bài →Thêm 2 nguồn khác đưa tinZnews Công nghệ@mark_k

22/09

Thứ Ba · 2 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 42/100

VideoGen-Agent: Đột phá mới trong việc huấn luyện tác nhân AI tạo video bằng học tăng cường

VideoGen-Agent sử dụng học tăng cường đa nhiệm để điều phối các công cụ bên ngoài, giúp tối ưu hóa quy trình tạo video. Giải pháp này đã cải thiện đáng kể hiệu suất của các mô hình văn bản-thành-video trên bộ tiêu chuẩn VABench mới.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 60/100

Cùng sự kiệnXiaomi ra mắt bộ ba mô hình MiMo-V2.6 trên OpenRouter: Đa phương thức, cửa sổ ngữ cảnh 1 triệu token

Xiaomi MiMo-V2.6 from @XiaomiMiMo is live on OpenRouter. Three new models. A 1T+ parameter flagship…

DịchXiaomi vừa đưa ba phiên bản mô hình MiMo-V2.6 lên OpenRouter, bao gồm bản flagship 1T+ tham số và bản tối ưu tốc độ. Tất cả đều hỗ trợ xử lý đa phương thức (văn bản, ảnh, video, âm thanh) với cửa sổ ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Xiaomi ra mắt và mã nguồn mở dòng MiMo-V2.6: Bước tiến mới trong tự cải thiện mô hình AI»

21/09

Thứ Hai · 1 tin
MarkTechPost
Mô hìnhĐiểm AI 70/100

Cùng sự kiệnStepFun ra mắt Step 5 Preview: Mô hình MoE 600B tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token

StepFun giới thiệu Step 5 Preview, mô hình MoE đa phương thức mạnh mẽ với 600B tham số, hỗ trợ xử lý 1 triệu token và tích hợp sâu cho các tác vụ AI đại lý.

Cùng sự kiện, tinh chọn hiển thị «Đánh giá Step 5 Preview: Hiệu năng ngang ngửa đối thủ nhưng chi phí rẻ gấp 2.8 lần»

20/09

Chủ Nhật · 3 tin
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 42/100

Phát triển trợ lý ảo đặt lịch hẹn thời gian thực với MiniCPM-o 4.5

MiniCPM-o 4.5 meets real-time voice agents. Developer @mrgoodmantweets built MiniCPM-o Booking Desk…

DịchNhà phát triển đã tạo ra MiniCPM-o Booking Desk, một trợ lý AI có khả năng tương thoại hai chiều, vừa lắng nghe vừa quan sát màn hình để xử lý đặt lịch hẹn một cách tự động và chính xác.

JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnVBVR-Pro: Hệ thống huấn luyện và đánh giá toàn diện khả năng suy luận thị giác cho mô hình AI

VBVR-Pro cung cấp bộ 300 tác vụ suy luận thị giác cùng cơ chế chấm điểm tự động, giúp tối ưu hóa khả năng tư duy không gian và logic cho các mô hình đa phương thức thông qua học tăng cường.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng từ các đại học hàng đầu, giải quyết bài toán cốt lõi về khả năng suy luận thị giác thay vì chỉ nhận diện hình ảnh đơn thuần, có tính ứng dụng cao.
WeChat: StepFun (Step)
Mô hìnhĐiểm AI 66/100

Tinh chọnStep 5 Preview: Bước tiến mới từ StepFun với mô hình mã nguồn mở 600B tham số

StepFun vừa ra mắt mô hình flagship Step 5 Preview sử dụng kiến trúc MoE, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và khả năng xử lý đa phương thức. Với hiệu suất vượt trội và chi phí vận hành chỉ bằng 1/8 so với Claude 3 Opus, đây là đối thủ đáng gờm trong nhóm mô hình mã nguồn mở.

Diễn biến sự kiện · 10 bài →Thêm 11 nguồn khác đưa tinX: StepFun (@StepFun_ai)X: Artificial Analysis (@ArtificialAnlys)X: Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPostX: Hongming (@hongming731)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Testing Catalog (@testingcatalog)IT HomeWeChat: Carl AI WattsQbitAIPandaily

Vì sao đáng đọc: Đây là tin tức quan trọng về một mô hình mã nguồn mở hiệu năng cao từ Trung Quốc, có tác động trực tiếp đến cộng đồng phát triển AI nhờ sự cân bằng giữa chi phí và sức mạnh.

19/09

Thứ Bảy · 1 tin
Pandaily
Mô hìnhĐiểm AI 92/100

Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức gốc với cửa sổ ngữ cảnh 1 triệu token

Alibaba giới thiệu Qwen3.8-Omni-Flash, mô hình đa phương thức hỗ trợ văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh 1 triệu token, đi kèm hiệu suất vượt trội và chính sách giảm giá API mạnh mẽ.

Diễn biến sự kiện · 11 bài →Thêm 3 nguồn khác đưa tinThe Decoder: AI NewsTechNodeMarkTechPost

18/09

Thứ Sáu · 12 tin
elsewhere: Bài viết
Sản phẩmĐiểm AI 26/100

Cùng sự kiệnDoubao bứt phá nhờ khả năng lập trình đa phương thức

Trợ lý AI Doubao đang ghi điểm mạnh mẽ trong cộng đồng lập trình nhờ tích hợp khả năng đa phương thức, giúp tối ưu hóa quy trình viết code và giải quyết các tác vụ kỹ thuật phức tạp một cách hiệu quả.

Cùng sự kiện, bài đại diện «Đánh giá thực tế Doubao 2.1 Pro: Bước tiến đột phá trong lập trình đa phương thức»
TechNode
Mô hìnhĐiểm AI 88/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức với cửa sổ ngữ cảnh 1 triệu token

Alibaba vừa trình làng Qwen3.8-Omni-Flash, mô hình đa phương thức có khả năng xử lý đồng thời văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh lên tới 1 triệu token, đạt hiệu suất vượt trội 26% so với phiên bản tiền nhiệm.

Cùng sự kiện, bài đại diện «Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức gốc với cửa sổ ngữ cảnh 1 triệu token»
JiQiZhiXin
Sản phẩmĐiểm AI 88/100

Đánh giá thực tế Doubao 2.1 Pro: Bước tiến đột phá trong lập trình đa phương thức

Phiên bản Doubao 2.1 Pro mới nhất của ByteDance gây ấn tượng mạnh với khả năng lập trình đa phương thức, cho phép AI tự tạo bản đồ 3D tương tác và xây dựng mô hình phức tạp chỉ từ hình ảnh hoặc yêu cầu ngôn ngữ tự nhiên.

Thêm 2 nguồn khác đưa tinPandailyelsewhere: Bài viết
Testing Catalog@testingcatalog
Quan điểmĐiểm AI 37/100

Cùng sự kiệnĐiểm tin AI ngày 18/9: Ra mắt Qwen3.8-Omni-Flash và cập nhật lớn từ Claude

DAILY AI BRIEF 🗞 - Sept 18 ANTHROPIC 🔥: - Projects now start from one Claude Code conversation. C…

DịchAlibaba trình làng Qwen3.8-Omni-Flash, mô hình đa phương thức toàn diện với chi phí xử lý video giảm 89%. Đồng thời, Anthropic hợp nhất Claude Chat và Cowork, nâng cấp Claude Code với khả năng ghi nhớ chia sẻ và xử lý song song.

Cùng sự kiện, bài đại diện «Ứng dụng Muse cập nhật tính năng kết nối Notion và Granola»
MarkTechPost
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức toàn diện với cửa sổ ngữ cảnh 1 triệu token

Đội ngũ Qwen của Alibaba vừa giới thiệu Qwen3.8-Omni-Flash, mô hình đa phương thức đầu tiên được tối ưu hóa cho tác vụ AI Agent, hỗ trợ xử lý đồng thời văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, bài đại diện «Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức gốc với cửa sổ ngữ cảnh 1 triệu token»
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức xử lý âm thanh và video vượt trội

Alibaba released Qwen3.8-Omni-Flash, a new omni-modal model with audio and video understanding. Qw…

DịchAlibaba vừa trình làng Qwen3.8-Omni-Flash, mô hình đa phương thức hỗ trợ cửa sổ ngữ cảnh 1 triệu token với hiệu suất tiệm cận Gemini 3.8 Flash trên các bảng xếp hạng WildClawBench-MM và UniClawBench.

Cùng sự kiện, bài đại diện «Thông Nghĩa Thiên Vấn ra mắt Qwen3.8-Omni-Flash: Mô hình toàn năng tập trung vào tác tử AI»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnRa mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức toàn diện cho AI Agent

Qwen giới thiệu Qwen3.8-Omni-Flash với khả năng xử lý đa phương thức vượt trội, cửa sổ ngữ cảnh 1M token và hiệu suất tăng 25% so với bản tiền nhiệm, đồng thời giảm mạnh chi phí vận hành.

Cùng sự kiện, bài đại diện «Thông Nghĩa Thiên Vấn ra mắt Qwen3.8-Omni-Flash: Mô hình toàn năng tập trung vào tác tử AI»
IT Home
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức toàn diện, hỗ trợ 1 triệu token với chi phí cực rẻ

Alibaba giới thiệu Qwen3.8-Omni-Flash, mô hình đa phương thức xử lý đồng thời văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh 1 triệu token. Hiệu suất vượt trội hơn 26% so với thế hệ trước, với khả năng xử lý âm thanh được đánh giá cao hơn cả Gemini 3.8 Flash.

Cùng sự kiện, bài đại diện «Thông Nghĩa Thiên Vấn ra mắt Qwen3.8-Omni-Flash: Mô hình toàn năng tập trung vào tác tử AI»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 38/100

UFO: Khung đánh giá chuỗi cho mô hình tạo ảnh đa phương thức với độ chính xác cao

UFO là khung đánh giá đầu tiên phân tách quá trình kiểm định ảnh thành các đơn vị nguyên tử (AEU), giúp đo lường sự tương thích giữa văn bản và hình ảnh hiệu quả hơn 15,25% so với các phương pháp cũ.

17/09

Thứ Năm · 3 tin
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (53 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Đa phương thức” | AIHOT.vn