05/09

Thứ Bảy · 1 tin

02/09

Thứ Tư · 1 tin

01/09

Thứ Ba · 1 tin

29/08

Thứ Bảy · 1 tin
Tencent Hunyuan@TencentHunyuan
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnTencent Hunyuan ra mắt bản xem trước Hy4: Mô hình MoE 770B với cửa sổ ngữ cảnh 1 triệu token

Tencent vừa công bố bản xem trước của mô hình MoE Hy4 với 770 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token và được phát hành theo giấy phép Apache 2.0. Mô hình này đạt hiệu suất vượt trội trong các bài kiểm tra thực tế so với GLM 5.3 và Kimi K3.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»

28/08

Thứ Sáu · 2 tin
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnTencent ra mắt Hy4 Preview: Mô hình MoE mã nguồn mở mạnh mẽ với 770 tỷ tham số

Tencent released Hy4 Preview, a new open weight model under Apache License 2.0! > Hy4 preview i…

DịchTencent vừa phát hành Hy4 Preview, mô hình MoE thế hệ mới với 770 tỷ tham số và cửa sổ ngữ cảnh 1 triệu token, được cấp phép theo Apache 2.0 nhằm tối ưu cho các tác vụ năng suất cao.

Cùng sự kiện, tinh chọn hiển thị «Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token»
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 66/100

Qwen3.8-Flash chính thức lên sóng GMI Cloud, hé lộ kiến trúc Qwen4

Qwen3.8-Flash is now available on @gmi_cloud - a multimodal MoE and an early preview of the Qwen4 ar…

DịchMô hình đa phương thức MoE Qwen3.8-Flash đã có mặt trên GMI Cloud, đồng thời mang đến cái nhìn sớm về kiến trúc Qwen4 thế hệ mới. Người dùng có thể trải nghiệm ngay qua API tại Model Studio và Qwen Cloud.

27/08

Thứ Năm · 3 tin
Simon Willison Blog
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnRa mắt Qwen3.8-Flash-Next: Mô hình MoE đa phương thức mã nguồn mở, hé lộ kiến trúc Qwen4

Qwen giới thiệu mô hình MoE đa phương thức Qwen3.8-Flash-Next với 125B tham số (kích hoạt 6B), mang lại hiệu suất vượt trội và là bước đệm cho kiến trúc Qwen4. Người dùng đã có thể trải nghiệm các phiên bản lượng tử hóa tối ưu trên nền tảng Unsloth.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
WeChat: Khazix
Mô hìnhĐiểm AI 78/100

Cùng sự kiệnZhipu AI ra mắt GLM-5.3-Flash: 'Siêu phẩm' ẩn danh OX Alpha chính thức lộ diện

Zhipu AI vừa trình làng GLM-5.3-Flash, chính là mô hình ẩn danh OX Alpha từng gây sốt. Đây là mô hình đa phương thức gốc với kiến trúc MoE 320B, hỗ trợ xử lý hình ảnh, video và văn bản với cửa sổ ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Zhipu ra mắt GLM-5.3-Flash: Mô hình đa phương thức mạnh mẽ với chi phí cực thấp»
MarkTechPost
Mô hìnhĐiểm AI 68/100

Cùng sự kiệnZ.ai ra mắt GLM-5.3-Flash: Mô hình MoE đa phương thức 320B, hỗ trợ cửa sổ ngữ cảnh 1 triệu token

Z.ai trình làng GLM-5.3-Flash, mô hình đa phương thức gốc với 320 tỷ tham số, hỗ trợ xử lý hình ảnh, video và cửa sổ ngữ cảnh lên tới 1 triệu token, hiện đã mở mã nguồn theo giấy phép MIT.

Cùng sự kiện, tinh chọn hiển thị «Zhipu ra mắt GLM-5.3-Flash: Mô hình đa phương thức mạnh mẽ với chi phí cực thấp»

26/08

Thứ Tư · 14 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Flash: Mô hình MoE đa phương thức hiệu năng cao với chi phí tối ưu

⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weigh…

DịchAlibaba giới thiệu Qwen3.8-Flash, mô hình MoE 125B với kiến trúc Qwen4 tiên tiến, chỉ kích hoạt 6B tham số mỗi token. Với chi phí huấn luyện bằng 1/9 bản tiền nhiệm và giá API cực rẻ, đây là bước tiến lớn về hiệu suất và khả năng xử lý ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
Elvis Saravia@omarsar0
Mô hìnhĐiểm AI 49/100

Cùng sự kiệnQwen3.8-Flash: Mô hình MoE đa phương thức hiệu năng cao, hé lộ kiến trúc Qwen4

What's better than an open-weight multimodal model release? Well, the technical report. I just love…

DịchAlibaba ra mắt Qwen3.8-Flash, mô hình MoE đa phương thức với 125B tham số (kích hoạt 6B mỗi token), hỗ trợ ngữ cảnh lên tới 1 triệu token và là phiên bản xem trước của kiến trúc Qwen4.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 84/100

Tinh chọnAlibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4

API is live on QwenCloud: https://www.qwencloud.com/models/qwen3.8-flash 🙌Let's build something!

DịchQwen3.8-Flash là mô hình đa phương thức 125B với kiến trúc MoE tối ưu, chỉ kích hoạt 6B tham số mỗi token nhưng vượt trội hoàn toàn so với bản tiền nhiệm. Đây là bước đệm cho kiến trúc Qwen4 với chi phí vận hành cực thấp và hỗ trợ ngữ cảnh lên tới 1 triệu token.

Diễn biến sự kiện · 5 bài →Thêm 15 nguồn khác đưa tinX: Alibaba Cloud (@alibaba_cloud)X: Hongming (@hongming731)PandailyX: OpenRouter (@OpenRouter)X: AI Notes (@AYi_AInotes)X: SemiAnalysis (@SemiAnalysis_)X: Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPostThe Decoder: AI NewsX: Testing Catalog (@testingcatalog)IT HomeTechNodeSimon Willison BlogJiqizhixinX: Kim (@kimmonismus)

Vì sao đáng đọc: Đây là bước tiến quan trọng về tối ưu hóa chi phí và hiệu năng cho mô hình ngôn ngữ lớn, thu hút sự quan tâm lớn từ cộng đồng phát triển AI.
MarkTechPost
Mô hìnhĐiểm AI 70/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Flash-Next: Mô hình MoE đa phương thức 125B với hiệu suất cực cao

Đội ngũ Qwen của Alibaba vừa giới thiệu Qwen3.8-Flash-Next, mô hình MoE đa phương thức 125B chỉ kích hoạt 6B tham số mỗi token, đóng vai trò là bản xem trước cho kiến trúc Qwen4 thế hệ mới.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
Kim@kimmonismus
Mô hìnhĐiểm AI 71/100

Cùng sự kiệnRa mắt GLM-5.3 Flash: Mô hình MoE 320B với hiệu suất vượt trội, chỉ kích hoạt 18B tham số

GLM-5.3 Flash ("Ox Alpha") official: Benchmarks attached. This looks exceptional for its size! GLM-…

DịchGLM-5.3 Flash (Ox Alpha) chính thức trình làng với kiến trúc MoE 320B, hỗ trợ cửa sổ ngữ cảnh 1M và khả năng đa phương thức nguyên bản. Mô hình được cấp phép MIT, tối ưu hóa mạnh mẽ với chỉ 18B tham số được kích hoạt mỗi token.

Cùng sự kiện, tinh chọn hiển thị «Zhipu ra mắt GLM-5.3-Flash: Mô hình đa phương thức mạnh mẽ với chi phí cực thấp»
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8 Flash: Mô hình đa phương thức MoE 125B mạnh mẽ

Alibaba released Qwen3.8 Flash, a new multimodal 125B-parameter MoE model. > 262K native context, …

DịchAlibaba trình làng Qwen3.8 Flash, mô hình MoE 125B hỗ trợ ngữ cảnh 262K (mở rộng tới 1M) với hiệu suất vượt trội trên các bài kiểm tra lập trình chuyên sâu, đánh dấu bước tiến quan trọng trước khi ra mắt kiến trúc Qwen4.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
LMSYS: Blog (nhóm Chatbot Arena)
Mô hìnhĐiểm AI 70/100

Cùng sự kiệnQwen ra mắt mã nguồn mở Qwen3.8-Flash-Next, hỗ trợ Day-0 từ SGLang

Đội ngũ Qwen vừa phát hành mô hình đa phương thức MoE Qwen3.8-Flash-Next, phiên bản xem trước của kiến trúc Qwen4 với 125B tham số và cơ chế định tuyến chuyên gia tối ưu hóa hiệu suất.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnQwen3.8-Flash-Next chính thức được hỗ trợ trên vLLM ngay từ ngày ra mắt

Amazing! 🥳 Thanks @vllm_project for getting Qwen3.8-Flash-Next running on NVIDIA and AMD from day 0…

DịchMô hình đa phương thức MoE Qwen3.8-Flash-Next với 125B tham số đã được vLLM hỗ trợ trên cả GPU NVIDIA và AMD. Người dùng có thể trải nghiệm ngay khả năng xử lý ngữ cảnh lên tới 1 triệu token thông qua phiên bản vLLM mới nhất.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
IT Home
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Flash: Mô hình MoE 125B với chi phí huấn luyện giảm 9 lần

Alibaba vừa trình làng Qwen3.8-Flash, mô hình MoE 125B với 6B tham số kích hoạt mỗi token, hỗ trợ cửa sổ ngữ cảnh lên tới 262K và mở rộng tối đa 1M token.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
Kim@kimmonismus
Mô hìnhĐiểm AI 51/100

Cùng sự kiệnQwen3.8-Flash-Next: Mô hình 6B tham số kích hoạt vượt mặt Claude Opus 4.6 Max

A bit more tl; dr about the model: Qwen3.8-Flash-Next combines 125B MoE parameters with 51B N-gram em…

DịchQwen3.8-Flash-Next vừa ra mắt với kiến trúc MoE siêu thưa, sở hữu tổng 125B tham số nhưng chỉ kích hoạt 6B mỗi token, mang lại hiệu suất vượt trội so với Claude Opus 4.6 Max.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
Kim@kimmonismus
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnRa mắt Qwen3.8-Flash-Next: Mô hình 6B tham số vượt mặt Claude Opus 4.6

Qwen 3.8 Flash-Next official released: A 6B-active open model just beat Claude Opus 4.6 Max across 8…

DịchQwen3.8-Flash-Next là mô hình đa phương thức mã nguồn mở dạng MoE, chỉ kích hoạt 6B tham số mỗi token nhưng đạt hiệu suất vượt trội. Mô hình hỗ trợ cửa sổ ngữ cảnh 256K, có thể mở rộng lên tới 1M.

Cùng sự kiện, bài đại diện «Qwen3.8-Flash-Next chính thức được hỗ trợ trên SGLang ngay từ ngày ra mắt»
Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 81/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Flash: Mô hình MoE đa phương thức, hé lộ kiến trúc Qwen4

⚡Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weigh…

DịchQwen3.8-Flash là mô hình MoE 125B với cơ chế kích hoạt 6B mỗi token, hỗ trợ ngữ cảnh lên tới 1 triệu token. Với chi phí huấn luyện tối ưu và hiệu suất vượt trội trong lập trình, đây được xem là bước đệm quan trọng cho kiến trúc Qwen4 sắp tới.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»
Kim@kimmonismus
Mô hìnhĐiểm AI 45/100

Cùng sự kiệnQwen3.8-Flash-Next ra mắt: Mô hình MoE đa phương thức với 6B tham số kích hoạt

Qwen may be about to drop another super interesting open-weight models of the year. A ModelScope de…

DịchQwen3.8-Flash-Next chính thức lộ diện như bản xem trước của kiến trúc Qwen4. Với cấu trúc MoE đa phương thức, mô hình sở hữu tổng 176B tham số nhưng chỉ kích hoạt 6B tham số mỗi token, hứa hẹn hiệu suất vượt trội.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt Qwen3.8-Flash: Mô hình MoE hiệu năng cao, hé lộ kiến trúc Qwen4»

25/08

Thứ Ba · 1 tin
IT Home
Mô hìnhĐiểm AI 38/100

Alibaba sắp tung ra Qwen3.8-Flash-Next: Mô hình đa phương thức MoE dựa trên kiến trúc Qwen4

Alibaba sẽ chính thức mở mã nguồn Qwen3.8-Flash-Next và phiên bản FP8 vào tối 26/8. Đây là mô hình đa phương thức MoE sử dụng kiến trúc Qwen4 thế hệ mới, giúp cộng đồng làm quen trước khi dòng Qwen4 đầy đủ ra mắt.

Thêm 9 nguồn khác đưa tinX: Kim (@kimmonismus)X: Alibaba Cloud (@alibaba_cloud)Simon Willison BlogX: SemiAnalysis (@SemiAnalysis_)X: Qwen (@Alibaba_Qwen)X: Elvis Saravia (@omarsar0, DAIR.AI)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: AI Notes (@AYi_AInotes)TechNode

24/08

Thứ Hai · 2 tin
smol.ai AI News
Mô hìnhĐiểm AI 92/100

Tinh chọnBùng nổ mô hình MoE: Z.ai, Tencent và Alibaba đồng loạt tung siêu phẩm AI mới

Thị trường AI chứng kiến sự ra mắt của loạt mô hình MoE mạnh mẽ từ Z.ai, Tencent và Alibaba với cửa sổ ngữ cảnh lên tới 1 triệu token, tập trung vào lập trình và bảo mật. Đồng thời, vLLM cũng công bố các tiêu chuẩn mới về hiệu suất suy luận cho các mô hình quy mô lớn.


Vì sao đáng đọc: Tin tức tổng hợp quan trọng về các mô hình ngôn ngữ lớn mới nhất từ các ông lớn công nghệ, có thông số kỹ thuật chi tiết và giá trị thực tiễn cao cho cộng đồng AI.

23/08

Chủ Nhật · 3 tin
Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 41/100

Mô hình Inkling của Thinking Machines đã có mặt trên DAIR.AI: Trải nghiệm miễn phí ngay

Just made this @thinkymachines Inkling model available in our harness playground. Try it for free w…

DịchDAIR.AI vừa tích hợp mô hình MoE đa phương thức Inkling vào nền tảng playground. Người dùng có thể trải nghiệm miễn phí khả năng xử lý văn bản, hình ảnh, âm thanh với cửa sổ ngữ cảnh 1 triệu token cùng các tác nhân AI như Pi hoặc Hermes.

JiQiZhiXin
Nghiên cứuĐiểm AI 95/100

Tinh chọnĐột phá: Chạy DeepSeek V4-Flash 'full lực' trên một card RTX 5090 với FreeToken

Nhóm nghiên cứu từ Berkeley và MIT vừa ra mắt FreeToken, hệ thống suy luận tối ưu cho phép chạy các mô hình MoE khổng lồ trên phần cứng tiêu dùng với tốc độ cực nhanh, xóa bỏ rào cản về hạ tầng máy chủ.


Vì sao đáng đọc: Đây là bước tiến lớn trong việc dân chủ hóa AI, cho phép người dùng cá nhân chạy các mô hình khủng mà không cần cụm máy chủ đắt đỏ. Công nghệ thực tế, có mã nguồn mở và ứng dụng cao.

22/08

Thứ Bảy · 1 tin
LMSYS: Blog (nhóm Chatbot Arena)
Nghiên cứuĐiểm AI 63/100

Tinh chọnLing-3.0-flash: Tối ưu hóa độ trễ giải mã lên 54% trên 4 GPU Blackwell

Đội ngũ Ant Group và RadixArk đã tối ưu hóa mô hình Ling-3.0-flash, giúp tăng tốc độ giải mã đơn yêu cầu từ 288 lên 606 tok/s và giảm độ trễ TPOT xuống còn 1.53 ms nhờ kiến trúc MoE cải tiến.


Vì sao đáng đọc: Đây là một bước tiến kỹ thuật quan trọng trong việc tối ưu hóa suy luận mô hình MoE trên phần cứng Blackwell, mang lại giá trị thực tiễn cao cho cộng đồng kỹ thuật.

21/08

Thứ Sáu · 1 tin
Pandaily
Mô hìnhĐiểm AI 85/100

Xiaohongshu âm thầm mã nguồn mở mô hình AI lớn: Khi nền tảng nội dung tự xây dựng nền tảng công nghệ

Xiaohongshu vừa ra mắt mô hình MoE 'dots3-note' với 280 tỷ tham số, hỗ trợ đa phương thức và cửa sổ ngữ cảnh 512K. Động thái này cho thấy nền tảng đang chuyển dịch từ việc tích hợp AI thành tính năng sang việc coi AI là nền tảng cốt lõi.

20/08

Thứ Năm · 1 tin
LMSYS: Blog (nhóm Chatbot Arena)
Nghiên cứuĐiểm AI 73/100

Tinh chọnTối ưu hóa DeepSeek-V4-Pro trên GPU H20: Đột phá hiệu năng tiệm cận chip B300

Nhóm LMSYS đã tối ưu hóa mô hình MoE 1.6 nghìn tỷ tham số DeepSeek-V4-Pro trên GPU H20, đạt tốc độ 271 tokens/s, thu hẹp đáng kể khoảng cách hiệu năng so với chip B300.


Vì sao đáng đọc: Bài viết cung cấp giải pháp kỹ thuật thực tế cho bài toán tối ưu hóa phần cứng, có giá trị cao cho cộng đồng kỹ sư AI đang sử dụng hạ tầng GPU bị hạn chế.

19/08

Thứ Tư · 3 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 50/100

MoE-ViE: Bước tiến mới cho bộ mã hóa thị giác hiệu suất cao

MoE-ViE tối ưu hóa khả năng hiểu hình ảnh và video bằng kiến trúc chuyên gia hỗn hợp (MoE), đạt hiệu suất vượt trội với độ trễ thấp hơn 24% so với các mô hình cùng kích thước, thiết lập chuẩn mực mới cho các mô hình đa phương thức.

18/08

Thứ Ba · 1 tin

14/08

Thứ Sáu · 6 tin
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 50/100

Cùng sự kiệnQwen3.8-Max chính thức ra mắt trên nền tảng Fireworks

Qwen3.8-Max is live on Fireworks, ready for agents, heavy coding, and long-context work. Fireworks …

DịchAlibaba Cloud vừa phát hành Qwen3.8-Max, mô hình MoE 2.4T tham số tối ưu cho tác vụ lập trình phức tạp và xử lý ngữ cảnh dài, đồng thời hỗ trợ ngay lập tức trên nền tảng Fireworks.

Cùng sự kiện, bài đại diện «Qwen3.8-27B sắp ra mắt: Đếm ngược đến thế hệ mô hình mới từ Alibaba»
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 50/100

Cùng sự kiệnQwen3.8-Max cập bến Together AI: Mô hình MoE 2.4 nghìn tỷ tham số với cửa sổ ngữ cảnh 1 triệu token

Qwen3.8-Max is live on Together AI. Together AI is with us as a Day 0 launch partner, and we couldn'…

DịchQwen3.8-Max chính thức có mặt trên nền tảng Together AI. Đây là mô hình MoE mạnh mẽ với 2.4 nghìn tỷ tham số tổng, 95 tỷ tham số kích hoạt, hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token cùng khả năng lập trình và vận hành tác tử (agent) vượt trội.

Cùng sự kiện, bài đại diện «Qwen 3.8-Max chính thức có mặt trên Modal với cửa sổ ngữ cảnh 1 triệu token»
Alibaba Cloud@alibaba_cloud
Mô hìnhĐiểm AI 50/100

Mô hình Qwen3.8-Max chính thức có mặt trên Fireworks, tối ưu cho AI Agent và lập trình chuyên sâu

Qwen3.8-Max is live on Fireworks, ready for agents, heavy coding, and long-context work. Fireworks …

DịchAlibaba vừa đưa mô hình MoE 2.4T tham số Qwen3.8-Max lên nền tảng Fireworks, tập trung vào khả năng xử lý của AI Agent, lập trình phức tạp và cửa sổ ngữ cảnh lớn.

Qwen@Alibaba_Qwen
Mô hìnhĐiểm AI 50/100

Cùng sự kiệnQwen3.8-Max chính thức ra mắt trên Fireworks, hỗ trợ ngay từ ngày đầu

Qwen3.8-Max is live on Fireworks, ready for agents, heavy coding, and long-context work. Fireworks …

DịchAlibaba vừa trình làng Qwen3.8-Max, mô hình MoE 2.4 nghìn tỷ tham số tối ưu cho tác vụ lập trình phức tạp và trí tuệ nhân tạo tự hành, hiện đã có sẵn trên nền tảng Fireworks.

Cùng sự kiện, bài đại diện «Qwen3.8-Max chính thức cập bến Fireworks, hỗ trợ triển khai ngay từ ngày đầu»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (65 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “MoE” — Trang 2 | AIHOT.vn