Ứng dụng Qwen tích hợp dòng mô hình Qwen3.8, cho phép kết nối dữ liệu từ thiết bị đeo thông minh để phân tích sức khỏe, theo dõi bệnh sử và chủ động nhắc nhở người dùng đạt các mục tiêu vận động cá nhân.
Qwen3.8 Max Prime from @Alibaba_Qwen is live on OpenRouter. A higher-throughput variant of Qwen3.8 …
DịchQwen3.8 Max Prime, phiên bản tối ưu hóa băng thông cao của Qwen3.8 Max, đã chính thức ra mắt trên OpenRouter. Mô hình giữ nguyên sức mạnh 2.4T tham số, hỗ trợ đa phương thức (văn bản, ảnh, video), cửa sổ ngữ cảnh 1M và khả năng suy luận mạnh mẽ.
DịchMeta-Zenith đã tự động tối ưu hóa mô hình Qwen3.8-27B, giúp tăng 63,5% lưu lượng xử lý và cải thiện tốc độ gấp 4,1 lần ở ngữ cảnh 65K mà không cần can thiệp thủ công.
Builders are shipping with Qwen3.8. Next Tuesday, they're going live to show you how. Qwen3.8 Show …
DịchAlibaba Cloud tổ chức buổi trình diễn Qwen3.8 vào ngày 1/9, giới thiệu các ứng dụng thực tế ấn tượng như trợ lý lập trình ngoại tuyến, chatbot WhatsApp thông minh và tác nhân tự hành.
Qwen3.8 Flash from @Alibaba_Qwen is now live on OpenRouter. A multimodal reasoning model for coding…
DịchAlibaba vừa ra mắt Qwen3.8 Flash trên nền tảng OpenRouter, một mô hình đa phương thức mạnh mẽ hỗ trợ lập trình, phân tích tài liệu, xử lý hình ảnh và video dài.
Beautiful visual of somebody running, qwen 3.8 27B locally on a RTX 5090 32 GB VRAM system with 115 …
DịchMột bản demo cho thấy Qwen3.8 27B đạt tốc độ ấn tượng 115 tokens/giây khi chạy local trên RTX 5090 32GB VRAM. Cần lưu ý rằng phiên bản BF16 gốc của mô hình này có dung lượng lên tới 55.6 GB.
Excited to see Qwen3.8 running at scale with TokenSpeed! 🚀 Light on latency, big on speed. Kudos to…
DịchMô hình Qwen3.8 với 2.4 nghìn tỷ tham số đã được tối ưu hóa thông qua công cụ TokenSpeed, giúp tăng tốc độ xử lý hơn 30% so với phương pháp TP16 truyền thống nhờ kỹ thuật giải mã suy đoán DSpark và tối ưu hóa CUDA graph.