Super happy to release SmolDataEnvs: 5, 000 verifiable RL environment tasks for hill-climbing small m…
DịchHugging Face vừa công bố SmolDataEnvs, bộ dữ liệu gồm 5.000 tác vụ học tăng cường (RL) có thể kiểm chứng, hỗ trợ tối ưu hóa các mô hình AI nhỏ trong lĩnh vực khoa học dữ liệu và lập trình.
Kev giới thiệu bộ ba mô hình 0.8B, 4B và 9B tối ưu cho việc ra quyết định, hỗ trợ xử lý đồng thời các câu hỏi trắc nghiệm, có/không và chấm điểm với độ chính xác cao.
A 4B coding agent reached 61.5% on SWE-bench Verified without frontier-model distillation by combini…
DịchFrogNano là mô hình AI chuyên biệt cho lập trình với kích thước nhỏ gọn 4 tỷ tham số, gây ấn tượng mạnh khi đạt hiệu suất 61.5% trên bộ kiểm chuẩn SWE-bench Verified thông qua phương pháp huấn luyện tổng hợp tác vụ trực tuyến.
🏥 Bringing local agentic AI to healthcare with MiniCPM5-2B × OpenMed! @OpenMed_AI paired OpenMed w…
DịchMô hình MiniCPM5-2B kết hợp cùng OpenMed để tối ưu hóa quy trình lâm sàng, cho phép AI tự động phân tích kết quả xét nghiệm và tạo báo cáo ngay trên thiết bị mà vẫn đảm bảo bảo mật dữ liệu bệnh nhân.
Knowledgator giới thiệu GLiFormer, khung mã hóa điều kiện schema giúp thực hiện NER, phân loại và trích xuất cấu trúc JSON mà không cần tạo token, tối ưu hóa hiệu suất cho các tác vụ NLP.
On-device personal agent, running locally on a MacBook Air M2 (16GB). @PaulGugAI put MiniCPM5-2B beh…
DịchMô hình MiniCPM5-2B hỗ trợ Hermes Agent có thể vận hành cục bộ trên MacBook Air M2 với tốc độ 20-24 tok/s và cửa sổ ngữ cảnh 96k. Đây là giải pháp AI gọn nhẹ, hiệu quả cho các tác vụ cá nhân mà không cần phụ thuộc vào dịch vụ đám mây.
🏘️ What happens when AI agents get their own goals, memories, and a town to live in? Developer @ai…
DịchNhà phát triển đã xây dựng Whisper Town, một thị trấn ảo với 8 AI có trí nhớ dài hạn, khả năng cộng tác và tự học từ thất bại, vận hành hoàn toàn cục bộ nhờ sự kết hợp giữa MiniCPM5-2B và Qwen 27B.
DeepSeek R1 đã chứng minh hiệu suất vượt trội khi chưng cất tư duy vào các mô hình nhỏ như Qwen, cho thấy khả năng giải quyết vấn đề tăng vọt theo ngân sách suy luận. Bài viết cũng gợi nhắc sự kiện thú vị khi Ollama đưa các phiên bản chưng cất này đến gần hơn với người dùng cá nhân.
I feel like the data sovereignty movement for firms is going to run headlong into the challenge that…
DịchEthan Mollick cảnh báo rằng việc duy trì các mô hình AI nhỏ tự tinh chỉnh sẽ trở nên đắt đỏ và khó khăn khi các mô hình lớn đa năng ngày càng mạnh mẽ, tạo ra thách thức lớn cho xu hướng chủ quyền dữ liệu doanh nghiệp.
Super cool paper from Microsoft. They show that it's possible to build competitive small coding ag…
DịchMicrosoft giới thiệu FrogNano, mô hình lập trình 4B tham số được huấn luyện hoàn toàn bằng học tăng cường (RL) mà không cần chưng cất tri thức từ các mô hình lớn. Phương pháp này chứng minh rằng việc tập trung vào các tác vụ tự tổng hợp phù hợp với khả năng của mô hình giúp tối ưu hiệu suất vượt trội.
Banger report from Microsoft. (bookmark it) They show that it's possible to build competitive smal…
DịchMicrosoft giới thiệu FrogNano, mô hình 4B tham số tự học lập trình trên 1.500 môi trường phần mềm bằng Reinforcement Learning mà không cần chưng cất từ mô hình lớn. Điểm đột phá nằm ở quy trình tổng hợp nhiệm vụ trực tuyến giúp tối ưu hóa khả năng học tập của mô hình.
Desert Ant Labs vừa công bố 18 mô hình AI nhỏ gọn cho thiết bị di động, hỗ trợ xử lý âm thanh, hình ảnh và văn bản thông qua bộ SDK thống nhất trên Swift, Kotlin và JavaScript.
Same Q4_K_M quant, same tasks, same success rate, MiniCPM5-2B can get tasks done quicker. This makes…
DịchMô hình MiniCPM5-2B của OpenBMB vượt trội hơn Qwen3.5-4B với tốc độ xử lý nhanh hơn 34% trong các tác vụ thực tế, mở ra tiềm năng lớn cho các ứng dụng AI chạy trực tiếp trên thiết bị.
I managed to get a small local model to play 4′33′′
DịchMột người dùng đã thử nghiệm cho mô hình AI nhỏ chạy cục bộ 'biểu diễn' bản nhạc im lặng nổi tiếng 4′33″, tạo nên một cuộc thảo luận thú vị về giới hạn và tính hài hước của AI.
Mặt Bích AI vừa mã nguồn mở MiniCPM5-2B, mô hình 2 tỷ tham số sở hữu khả năng thực thi tác vụ phức tạp (Agent) ngay trên thiết bị, vượt mặt nhiều đối thủ lớn hơn về hiệu suất và khả năng suy luận.
Vì sao đáng đọc: Tin tức quan trọng về bước tiến của mô hình nhỏ (SLM) có khả năng Agent. Việc công khai cả quy trình huấn luyện và dữ liệu là điểm cộng lớn cho cộng đồng phát triển.
🚀 Meet MiniCPM5-2B, a 2B-parameter language model bringing high intelligence density to the edge, n…
DịchOpenBMB vừa ra mắt MiniCPM5-2B, mô hình ngôn ngữ nhỏ gọn nhưng dẫn đầu bảng xếp hạng Artificial Analysis cho các model dưới 4B tham số, đồng thời đạt điểm số ấn tượng 20 trong chỉ số Agentic Index.
OpenBMB's MiniCPM5-2B scores 15 on the Artificial Analysis Intelligence Index v4.2, the highest of a…
DịchArtificial Analysis đánh giá MiniCPM5-2B đạt 15 điểm trên Intelligence Index v4.2, trở thành mô hình mã nguồn mở dưới 4B tham số thông minh nhất hiện nay, chỉ xếp sau Ling 3.0 Tiny.
Nghiên cứu giới thiệu phương pháp 'Compile by Training', cho phép biên dịch các yêu cầu ngôn ngữ tự nhiên thành các adapter nhỏ gọn, có thể tái sử dụng, lưu trữ và kết hợp như phần mềm truyền thống mà không cần phụ thuộc vào mô hình lớn khi vận hành.
CEO Shopify chia sẻ về việc mô hình 0.8B được tinh chỉnh chuyên biệt đã vượt qua các siêu mô hình lớn nhờ cơ chế tự cải tiến liên tục, mở ra xu hướng doanh nghiệp tự xây dựng hệ sinh thái AI riêng để tạo lợi thế cạnh tranh.
Ant Group vừa phát hành SingProbe trên Hugging Face, một mô hình giám sát an toàn chỉ với 3,22 triệu tham số. Công cụ này giúp phát hiện rủi ro về ý định, nội dung độc hại và ảo tưởng của AI theo thời gian thực với chi phí vận hành cực thấp.
Karminski vừa thực hiện bài đánh giá toàn diện các mô hình AI nhỏ, bao gồm các phiên bản Qwen3.6, Qwen3.8 và Ornith-1.5, nhằm so sánh hiệu năng thực tế giữa các dòng model này.
Các mô hình nhỏ như gpt-5.6-luna đang tạo ra bước ngoặt về tốc độ và chi phí, cho phép xử lý khối lượng công việc lớn với giá cực rẻ. Đây là tín hiệu cho thấy các ứng dụng AI tiêu dùng và doanh nghiệp sẽ bùng nổ nhờ hiệu suất tối ưu.
Which model should you run on the iPhone 17 Pro? Announcing our new intelligence and inference test…
DịchArtificial Analysis phối hợp với Liquid AI thực hiện bài kiểm tra độc lập về hiệu năng suy luận và trí thông minh của các mô hình nhỏ (4-bit trở xuống) trên iPhone 17 Pro và Galaxy S26 Ultra.
Daedalus-150M là mô hình ngôn ngữ nhỏ được thiết kế chuyên biệt cho CPU, sử dụng kiến trúc lai giúp giảm đáng kể bộ nhớ cache mà vẫn vượt trội hơn các mô hình cùng kích thước dù được huấn luyện với ít dữ liệu hơn.
Vì sao đáng đọc: Cách tiếp cận thiết kế kiến trúc từ mục tiêu phần cứng (CPU) thay vì nén mô hình lớn là hướng đi rất thực tế và hiệu quả cho ứng dụng AI trên thiết bị cá nhân.
What can you build with small multimodal models beyond demos? Lost & Found Desk built by developer …
DịchNhà phát triển JacobLinCool đã tạo ra ứng dụng Lost & Found Desk, sử dụng MiniCPM-V 4.6 để nhận diện hình ảnh và MiniCPM-1B để xử lý ngôn ngữ, chứng minh hiệu quả thực tế của các mô hình AI nhỏ gọn.
Tabular data is so ready for disruption. Structured/tabular data is now getting its own foundation-…
DịchSynthefy giới thiệu Nori, nền tảng mô hình nền tảng cho dữ liệu số có cấu trúc. Với chỉ 30 triệu tham số, Nori-30M đạt hiệu suất tương đương mô hình TabFM 1.6B của Google trong các bài kiểm tra hồi quy, đồng thời công bố gọi vốn thành công 6,5 triệu USD.
🌱 A tiny model helping plants tell the story of soil. Developer @RightSideOfAI built AUGURY, an op…
DịchDự án mã nguồn mở AUGURY sử dụng MiniCPM5-1B để phân tích hình ảnh cỏ dại, từ đó đưa ra đánh giá về sức khỏe đất. Với dung lượng chỉ 660MB, mô hình này cho phép chạy ngoại tuyến trên điện thoại mà không bị ảo tưởng thông tin.
Small models, big real-world impact. Proud to see Qwen leading local inference in the State of Open…
DịchBáo cáo từ HuggingFace cho thấy Qwen đang dẫn đầu về khả năng suy luận cục bộ. Dù các mô hình lớn liên tục ra đời, các mô hình nhỏ vẫn là lựa chọn chủ đạo cho ứng dụng thực tế, cùng với sự trỗi dậy mạnh mẽ của các AI Agent.
🥋 Karate Wiener is an interactive 3D character experience, featuring a hotdog sensei who teaches ka…
DịchOpenBMB giới thiệu Karate Wiener, nhân vật 3D tương tác hỗ trợ trò chuyện giọng nói và tạo hành động, được vận hành bởi mô hình siêu nhẹ VoxCPM-0.5B. Dự án này chứng minh tiềm năng ứng dụng của các mô hình AI nhỏ gọn trong lĩnh vực giải trí sáng tạo.
7.9B total. 1.3B active. One DGX Spark. No cluster. Ling-3.0-tiny × ASystem AReno closes the Agentic…
DịchVới 7.9B tham số, Ling-3.0-tiny kết hợp cùng ASystem AReno cho phép thực hiện quy trình học tăng cường (RL) khép kín ngay trên một máy chủ DGX Spark, giúp tối ưu hóa việc lặp lại và huấn luyện mô hình mà không cần cụm máy chủ phức tạp.
🐺 A tiny model powering an autonomous AI trading floor. Developer @ashdebugs built Wall Street of …
DịchNhà phát triển đã sử dụng mô hình MiniCPM5-1B để tạo ra một sàn giao dịch với 4 AI Agent có tính cách khác biệt, tự đưa ra quyết định và cạnh tranh trong môi trường mô phỏng mà không cần dùng đến API đám mây.
🎭 What happens when a 1B model has only 1, 000 tokens of memory? Meet Thousand-Token Theater, an AI…
DịchNhà phát triển @jhahimanshu653 đã tạo ra Thousand-Token Theater, sử dụng mô hình MiniCPM5-1B và VoxCPM2 để trình diễn kịch ứng tác thời gian thực với giới hạn bộ nhớ chỉ 1.000 token.
Liquid AI ra mắt mô hình LFM2.5-VL-3B, tối ưu hóa khả năng xử lý thị giác cho các thiết bị biên với tốc độ vượt trội và hiệu suất cao, mở ra tiềm năng ứng dụng thực tế rộng rãi.