Hôm qua · 27/09

Chủ Nhật · 1 tin
MarkTechPost
Mô hìnhĐiểm AI 50/100

Supersonic Labs ra mắt Julia 1: Mô hình quyết định mã nguồn mở 144.3M tham số chạy mượt trên CPU

Phòng thí nghiệm Supersonic Labs (Brazil) vừa phát hành Julia 1, mô hình AI 144.3M tham số chuyên biệt cho việc ra quyết định. Với giấy phép Apache 2.0, mô hình này không tạo văn bản mà tập trung đưa ra lựa chọn và xác suất từ 2-20 phương án, tối ưu để chạy trực tiếp trên CPU thông thường.

23/09

Thứ Tư · 2 tin
X.PIN@thexpin
NgànhĐiểm AI 34/100

Hygon ra mắt dòng CPU 1000 series: Bước tiến vào lĩnh vực robot và điện toán biên công nghiệp

Hygon unveiled its 1000 series, expanding into robotics and industrial edge computing with its first…

DịchHygon vừa giới thiệu dòng CPU 1000 series, chip x86 đầu tiên của hãng tích hợp sẵn đồ họa, hướng tới các tác vụ robot và điện toán biên. Với thiết kế nhỏ gọn, dòng chip này hỗ trợ cả DDR4 và DDR5, mở đường cho lộ trình nâng cấp hiệu suất gấp đôi vào năm 2027.

22/09

Thứ Ba · 1 tin

20/09

Chủ Nhật · 2 tin
ModelBest OpenBMB@OpenBMB
Hướng dẫnĐiểm AI 32/100

Tối ưu hóa mô hình nhỏ: Quy trình chạy OpenClaw và Ollama hoàn toàn trên CPU

This is a really practical way to use a small local model. Also pretty impressive that the whole pip…

DịchKhám phá cách vận hành các mô hình AI nhỏ hiệu quả ngay trên máy tính cá nhân. Sự kết hợp giữa OpenClaw và Ollama cho phép chạy mượt mà chỉ bằng CPU, chứng minh rằng thiết kế luồng công việc thông minh có thể nâng cao đáng kể sức mạnh của các mô hình quy mô nhỏ.

19/09

Thứ Bảy · 1 tin

16/09

Thứ Tư · 2 tin

14/09

Thứ Hai · 1 tin
IT Home
NgànhĐiểm AI 85/100

Fujitsu ra mắt CPU 'MONAKA' 2nm: Bước tiến tự chủ công nghệ AI của Nhật Bản

Fujitsu chính thức công bố CPU MONAKA kiến trúc Arm, sử dụng tiến trình 2nm với khả năng xử lý AI mạnh mẽ. Sản phẩm hướng tới thị trường máy chủ tại Nhật Bản và châu Âu, nhấn mạnh tính bảo mật và khả năng vận hành hiệu quả trong môi trường hạn chế về tản nhiệt.

12/09

Thứ Bảy · 1 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 38/100

Agentic AI có thể đưa CPU trở lại vị thế trung tâm của kỷ nguyên tính toán

Agentic AI may be forcing the old computing stack with lot more focus on CPU back into the center of…

DịchCEO Cathie Wood của Ark Invest nhận định rằng khi Agentic AI phát triển, nhu cầu về lập kế hoạch, truy xuất dữ liệu và điều phối sẽ khiến CPU trở nên quan trọng không kém GPU trong các tác vụ AI.

11/09

Thứ Sáu · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 59/100

Nghiên cứu mới: LLM chạy cục bộ có thể bị rò rỉ dữ liệu qua bộ nhớ đệm CPU với tỷ lệ thành công 95,87%

A local model can keep everything off the cloud and still leak its answers through the CPU cache. s…

DịchNghiên cứu 'Detokenization Leaks' chỉ ra phương thức tấn công mới giúp khôi phục văn bản từ LLM bằng cách theo dõi hoạt động bộ nhớ đệm CPU trong quá trình giải mã token, mà không cần truy cập trực tiếp vào bộ nhớ của mô hình.

08/09

Thứ Ba · 1 tin

07/09

Thứ Hai · 1 tin

27/08

Thứ Năm · 1 tin
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 53/100

NVIDIA xác nhận chip Vera đã xuất xưởng quy mô lớn, AWS nhận lô máy chủ CPU đầu tiên

NVIDIA just officially said Vera is now shipping at scale, with AWS receiving its 1st CPU server and…

DịchNVIDIA chính thức cung ứng chip Vera chuyên dụng cho tác vụ AI với 88 nhân Olympus, đạt hiệu năng vượt trội tới 1,8 lần so với CPU x86 truyền thống. AWS là đối tác đầu tiên tiếp nhận hệ thống máy chủ trang bị dòng chip này.

26/08

Thứ Tư · 1 tin

25/08

Thứ Ba · 2 tin

24/08

Thứ Hai · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnDaedalus-150M: Mô hình ngôn ngữ lai Convolution-Attention tối ưu cho CPU

Daedalus-150M là mô hình ngôn ngữ nhỏ được thiết kế chuyên biệt cho CPU, sử dụng kiến trúc lai giúp giảm đáng kể bộ nhớ cache mà vẫn vượt trội hơn các mô hình cùng kích thước dù được huấn luyện với ít dữ liệu hơn.


Vì sao đáng đọc: Cách tiếp cận thiết kế kiến trúc từ mục tiêu phần cứng (CPU) thay vì nén mô hình lớn là hướng đi rất thực tế và hiệu quả cho ứng dụng AI trên thiết bị cá nhân.
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

ArchAgent v2: AI vượt mặt chuyên gia trong thiết kế tối ưu hóa CPU

New from Google, DeepMind and Berkeley, This is a good example of why better agent architecture mat…

DịchArchAgent v2 từ Google, DeepMind và Berkeley đã đánh bại thiết kế thủ công DPC4 trong việc tối ưu hóa bộ nhớ đệm CPU, đạt hiệu suất IPC vượt trội. Dù vẫn còn hạn chế ở môi trường đa nhân, đây là bước tiến lớn trong việc dùng AI tự động hóa thiết kế phần cứng.

22/08

Thứ Bảy · 1 tin

19/08

Thứ Tư · 1 tin

18/08

Thứ Ba · 1 tin

12/08

Thứ Tư · 1 tin
Tổng 24 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (38 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “CPU” | AIHOT.vn