Portable Computer for Windows is now available on @AMD Ryzen AI Max Series processors. It makes it …
DịchPerplexity vừa phát hành ứng dụng Portable Computer dành cho Windows, tối ưu hóa trên dòng chip AMD Ryzen AI Max để chạy các AI agent cục bộ, giúp xử lý dữ liệu và tác vụ trực tiếp trên thiết bị mà không cần kết nối đám mây.
Qualcomm đang đẩy mạnh tích hợp AI Agent vào chip Snapdragon, đáp ứng nhu cầu của 70% người dùng về các trợ lý ảo có khả năng tự động thực hiện tác vụ phức tạp trên điện thoại.
Phiên bản Laya-mlx được tối ưu trên framework MLX giúp tăng tốc độ xử lý gấp 50 lần so với Jev, chỉ chiếm tối đa 1GB RAM. Mô hình này hiện có thể điều khiển game Rắn săn mồi ngay trên chip M3 Max với tốc độ 60 khung hình/giây.
Dự án Qwen-2.5-1B-RLCD sử dụng framework MLX để trích xuất JSON trong một lần truyền duy nhất, giúp giảm đáng kể độ trễ suy luận trên thiết bị. Giải pháp này tối ưu cho các tác vụ phân loại và trích xuất dữ liệu cố định.
Love this. 🙌 MiniCPM5-2B was built for exactly this: on-device, offline, download from Hugging Face…
DịchMiniCPM5-2B là mô hình AI nhỏ gọn với 2.5 tỷ tham số, hỗ trợ ngữ cảnh 128K và khả năng suy luận offline. Với cơ chế tự sửa lỗi thông minh, đây được đánh giá là mô hình mã nguồn mở mạnh nhất trong phân khúc dưới 4B tham số.
Interesting new on-device local AI agentic system - seems to be running an open-weights 4B model qua…
DịchThomas Wolf chia sẻ về một hệ thống AI Agent chạy cục bộ đầy hứa hẹn, dường như đang vận hành mô hình mã nguồn mở 4B đã được lượng tử hóa 4-bit thông qua framework MLX.
Let's go local AI! At a time when everyone is complaining about shortages of energy and compute for…
DịchDesert Ant Labs giới thiệu 18 mô hình AI đa phương thức hỗ trợ Swift, Kotlin và JS, cho phép chạy cục bộ trên thiết bị để đảm bảo quyền riêng tư và tiết kiệm chi phí vận hành.
Thanks for testing it out and sharing these numbers! 🙌 "Run a swarm of these locally" - that's exa…
DịchMặt Bích AI khẳng định tầm nhìn về việc chạy các mô hình 2B tối ưu trên thiết bị cá nhân. Với kích thước chỉ 1.56GB sau khi lượng tử hóa, mô hình đạt tốc độ hơn 200 token/giây trên RTX 4090 mà vẫn giữ được hiệu năng tương đương các mô hình 4B.
Yesterday, we open-sourced MiniCPM5-2B. Today, we're opening up the RL stack behind it. Meet Meshy, …
DịchOpenBMB vừa công bố MiniCPM5-2B, mô hình 2 tỷ tham số dẫn đầu bảng xếp hạng Artificial Analysis cho phân khúc dưới 4B. Đồng thời, hãng cũng mở mã nguồn bộ công cụ huấn luyện Meshy và JustRL II giúp tối ưu hóa khả năng suy luận cho mô hình.
Thank you for the amazing support as always! @ModelScope2022
DịchOpenBMB vừa phát hành MiniCPM5, dòng mô hình AI tối ưu cho thiết bị di động với các phiên bản 1B và 2B, hỗ trợ cửa sổ ngữ cảnh lên tới 128K cùng khả năng lập trình và sử dụng công cụ mạnh mẽ.
🚀 Meet MiniCPM5-2B, a 2B-parameter language model bringing high intelligence density to the edge, n…
DịchOpenBMB vừa ra mắt MiniCPM5-2B, mô hình ngôn ngữ nhỏ gọn nhưng dẫn đầu bảng xếp hạng Artificial Analysis cho các model dưới 4B tham số, đồng thời đạt điểm số ấn tượng 20 trong chỉ số Agentic Index.
PERPLEXITY 🔥: A new Hybrid mode is coming soon on Mac, letting local models handle some subtasks. …
DịchPerplexity chuẩn bị cập nhật chế độ Hybrid cho Mac, cho phép phân bổ tác vụ cho các mô hình cục bộ như Gemma 4 hoặc Qwen 3.6. Hệ thống tích hợp Privacy Gate giúp lọc thông tin nhạy cảm ngay trên thiết bị trước khi gửi lên đám mây.
According to Artificial Analysis, Ling-3.0-tiny sits on the mobile intelligence-speed Pareto frontie…
DịchTheo Artificial Analysis, Ling-3.0-tiny thiết lập chuẩn mực mới về tốc độ trên iPhone 17 Pro với khả năng xử lý 16K ngữ cảnh trong 5,7 giây và dẫn đầu bảng xếp hạng 64K, mang sức mạnh AI vượt trội lên các thiết bị nhỏ gọn.
Dòng mô hình MiniCPM của ModelBest vừa cán mốc 50 triệu lượt tải, đánh dấu bước tiến lớn khi được tích hợp vào các dòng flagship của Samsung và dẫn đầu bảng xếp hạng hiệu năng Artificial Analysis cho phân khúc dưới 4B tham số.
Big thanks to @nvidia for working together with us and supporting this research on DGX Spark as well…
DịchPerplexity giới thiệu Portable Computer, AI Agent chạy trực tiếp trên thiết bị với mô hình 27B đạt hiệu suất vượt trội, đồng thời hợp tác cùng NVIDIA để thúc đẩy hệ sinh thái mô hình mã nguồn mở hiệu quả.
Nice little survey on Terminal Agents. It provides good information on what exactly is a terminal a…
DịchBài viết phân tích sâu sắc về bản chất của các tác nhân AI trên thiết bị (on-device agents) và lý giải nguyên nhân khiến các bộ công cụ đánh giá thường cho ra kết quả trái ngược nhau.
Llama-Mobile giới thiệu phương pháp nén mô hình VLMs xuống định dạng 2.7-bit, cho phép chạy mượt mà trên chip Arm mà vẫn giữ vững hiệu suất, giúp đưa các mô hình lớn như Llama 3.2 11B lên smartphone.
Vì sao đáng đọc: Đây là bước tiến quan trọng cho ứng dụng AI trên thiết bị (on-device AI), giải quyết bài toán tài nguyên phần cứng vốn là rào cản lớn nhất hiện nay.
20/08
Thứ Năm · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Một nhà phát triển đã tạo ra mô hình Transformer 125M tham số, cho phép iPhone 15 tự động gợi ý nốt nhạc piano theo thời gian thực. Dự án tối ưu hóa dữ liệu MIDI và áp dụng kỹ thuật DPO để đạt hiệu suất ấn tượng, hiện đã ra mắt ứng dụng RollTab miễn phí.
DFlash 2 is very cool! Speculative decoding is such a cool technology. I'm waiting for the day we …
DịchDFlash 2 từ Z Lab và Inco AI mang đến công nghệ giải mã suy đoán (speculative decoding) mạnh mẽ, giúp tăng tốc độ xử lý mô hình AI lên gấp 4,6 lần mà vẫn giữ nguyên độ chính xác, đạt 70 tok/s trên MacBook Pro M5 Max.
WhatsApp giới thiệu tính năng Scam Alert sử dụng mô hình AI chạy cục bộ để phát hiện tin nhắn lừa đảo mà không làm lộ dữ liệu người dùng. Mọi quy trình xử lý đều diễn ra trên thiết bị, đảm bảo quyền riêng tư tuyệt đối thông qua mã hóa đầu cuối.