Unsloth vừa giới thiệu định dạng Dynamic 3.0 GGUF, tập trung vào việc cải thiện hiệu suất và khả năng tương thích cho các mô hình ngôn ngữ lớn khi chạy trên thiết bị cá nhân.
DịchCohere chính thức giới thiệu S1-mini, mô hình AI mã nguồn mở được tối ưu hóa để người dùng có thể tự vận hành và lưu trữ ngay trên thiết bị cá nhân.
OpenAI tạm dừng huấn luyện mô hình tiên tiến để nâng cấp bảo mật, trong khi Qwen3.8-27B trở thành tâm điểm của cộng đồng mã nguồn mở nhờ khả năng chạy cục bộ mạnh mẽ. Đồng thời, GLM-5.3 vừa ra mắt với những cải tiến đáng kể về hiệu suất thông qua kỹ thuật học tăng cường mới.
Kỹ sư Yan Xin đã phát triển YRobot, robot để bàn có khả năng nghe, nhìn và trò chuyện thời gian thực nhờ mô hình MiniCPM-o 4.5 chạy cục bộ. Dự án mã nguồn mở này gây ấn tượng với hiệu suất vượt trội và khả năng xử lý đa phương thức mượt mà.
Qwen3.8-27B đang gây sốt khi vượt mặt các mô hình lớn tiền nhiệm và đạt hiệu năng ngang tầm GPT-5.6 Luna, dù chỉ yêu cầu 17GB RAM khi đã nén. Đây được cộng đồng quốc tế ví như phiên bản 'Opus 4.6' chạy cục bộ cực kỳ mạnh mẽ.
Vì sao đáng đọc: Tin tức quan trọng về bước tiến đột phá của mô hình mã nguồn mở, có tác động lớn đến cộng đồng lập trình viên và người dùng chạy AI cục bộ.
Strong enough to keep up with the frontier, light enough to run on your own laptop. Come see what it…
DịchAlibaba vừa ra mắt Qwen3.8-27B, một bước đột phá kết hợp giữa hiệu năng tiệm cận các mô hình hàng đầu thế giới và khả năng tối ưu hóa để vận hành cục bộ trên máy tính cá nhân.
Qwen3.8-27B is now part of your everyday life - from smartphones to vehicles. ⚡️🚀Appreciate your wo…
DịchAlibaba hợp tác cùng MediaTek để tối ưu hóa mô hình Qwen2.5-27B trên các dòng chip Dimensity và chip ô tô thông minh, mang trải nghiệm AI cục bộ lên cả điện thoại và xe hơi.
Laptop-size model, frontier-size leap. 🏃♀️Qwen3.8-27B is live on LM Studio. Try it! @lmstudio
DịchMô hình Qwen3.8-27B mạnh mẽ nay đã hỗ trợ trên LM Studio, cho phép người dùng dễ dàng trải nghiệm sức mạnh AI tiên tiến ngay trên máy tính cá nhân.
Ready right now! 😎Incredible to see Qwen3.8-27B fly on RTX Spark. Download, deploy and create somth…
DịchQwen2.5-27B hiện đã được tối ưu hóa để chạy mượt mà trên nền tảng RTX Spark. Người dùng có thể tải xuống và triển khai ngay để bắt đầu các dự án sáng tạo của mình.
Small models, big real-world impact. Proud to see Qwen leading local inference in the State of Open…
DịchBáo cáo từ HuggingFace cho thấy Qwen đang dẫn đầu về khả năng suy luận cục bộ. Dù các mô hình lớn liên tục ra đời, các mô hình nhỏ vẫn là lựa chọn chủ đạo cho ứng dụng thực tế, cùng với sự trỗi dậy mạnh mẽ của các AI Agent.
🎁A gift for developers: Qwen3.8-27B, running locally on AMD from day zero. Appreciate the work fro…
DịchMô hình Qwen3.8-27B mới của Alibaba đã chính thức hỗ trợ chạy cục bộ trên chip Ryzen AI Max+ và card đồ họa Radeon AI PRO R9700, giúp các nhà phát triển dễ dàng xây dựng ứng dụng thông qua LM Studio.
So yeah, you can now run Opus 4.6 max locally. Just let that sink in.
DịchQwen ra mắt mô hình đa phương thức 27B với khả năng lập trình và điều khiển máy tính vượt trội Claude Opus 4.6 Max. Hỗ trợ cửa sổ ngữ cảnh lên tới 1M token và giấy phép Apache 2.0 cho phép tự triển khai cục bộ.
The first open-weights model from @AIatMeta Superintelligence Labs, Muse Glimmer is live on OpenRout…
DịchMeta AI vừa phát hành Muse Glimmer, mô hình 30B đa phương thức (văn bản và hình ảnh) với giấy phép Apache 2.0. Được tối ưu cho các tác nhân AI cục bộ, mô hình này hiện đã sẵn sàng để trải nghiệm trên nền tảng OpenRouter.
Vì sao đáng đọc: Đây là bước tiến quan trọng của Meta trong lĩnh vực mã nguồn mở, cung cấp một mô hình mạnh mẽ cho cộng đồng phát triển ứng dụng AI cục bộ.
QNAP tích hợp VLM và LLM vào ứng dụng Qsirch, cho phép người dùng tìm kiếm tệp tin, hình ảnh và video bằng ngôn ngữ tự nhiên ngay trên NAS mà không cần tải dữ liệu lên đám mây.
NVIDIA vừa giới thiệu Nemotron 3.5 Lightning, mô hình MoE 30 tỷ tham số tối ưu cho hệ thống đa tác nhân, giúp tăng tốc độ xử lý lên gấp 4 lần và có thể chạy trực tiếp trên các thiết bị cục bộ như RTX PC.
Microsoft phát hành bản cập nhật Windows 11 26H1 mới, tập trung tối ưu hóa quản lý bộ nhớ để hỗ trợ chạy các mô hình AI cục bộ quy mô lớn trên máy tính có từ 32GB RAM trở lên, đồng thời cải tiến giao diện Widgets và tính năng bảo vệ mắt.
Today's edition of my newsletter just went out. 🔗 https://www.rohan-paul.com/p/meta-released-muse-...
DịchMeta giới thiệu Muse Glimmer 30B, mô hình tối ưu cho các tác vụ AI cục bộ trên GPU tiêu dùng, trong bối cảnh Mark Zuckerberg chia sẻ tầm nhìn về AI cho mọi người giữa làn sóng kêu gọi tạm dừng phát triển từ giới chính trị.