25/09

Thứ Sáu · 1 tin
IT Home
Sản phẩmĐiểm AI 37/100

Cùng sự kiệnClaude Opus 5.5 lập trình trình dò tia RTX từ con số 0 chỉ trong 1 giờ

Người dùng đã sử dụng Claude Opus 5.5 để viết mã C++ và CUDA, kết hợp NVIDIA OptiX 9.1 nhằm tạo ra trình dò tia (path tracer) tăng tốc phần cứng đạt 34 FPS và 267 triệu mẫu tia mỗi giây.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»

22/09

Thứ Ba · 3 tin

18/09

Thứ Sáu · 1 tin
SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 37/100

vLLM và bài toán kiểm soát chất lượng trên hạ tầng AMD

Great blog from Kevin Lu at @vllm_project about quality control at the inference engine. Unfortunate…

DịchBài viết từ SemiAnalysis chỉ ra rằng sự thiếu hụt hạ tầng kiểm thử ổn định cho AMD khiến chất lượng phần mềm vLLM trên nền tảng này kém xa so với CUDA, gây ra tình trạng gián đoạn CI thường xuyên.

17/09

Thứ Năm · 1 tin

15/09

Thứ Ba · 1 tin

14/09

Thứ Hai · 1 tin

12/09

Thứ Bảy · 1 tin
SemiAnalysis@SemiAnalysis_
NgànhĐiểm AI 49/100

Cùng sự kiệnKhoảng cách CUDA: AMD chậm chân 2 ngày trong việc hỗ trợ DeepSeek v4.1 Flash

POWER OF CUDA MOAT ALERT🚨: 2 days after CUDA vLLM supported DeepSeekv4.1 Flash, AMD finally publicl…

DịchTrong khi vLLM trên CUDA đã hỗ trợ DeepSeek v4.1 Flash từ sớm, AMD mất thêm 2 ngày mới tung ra bản cập nhật. Dù hoạt động ổn định, hiệu năng trên mỗi USD của chip AMD vẫn thua kém đáng kể so với H200 và B200/B300 của NVIDIA.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh»

10/09

Thứ Năm · 2 tin
Kim@kimmonismus
Sản phẩmĐiểm AI 51/100

NVIDIA ra mắt CUDA 13.4 hỗ trợ Windows on Arm, đón đầu dòng laptop RTX Spark

NVIDIA is bringing CUDA to Windows on Arm ahead of RTX Spark laptops arriving in October. CUDA 13.4…

DịchNVIDIA phát hành CUDA 13.4 hỗ trợ Windows on Arm, giúp các nhà phát triển tối ưu ứng dụng cho dòng laptop RTX Spark sắp ra mắt vào tháng 10. Đây là bước tiến quan trọng để đưa các mô hình AI cục bộ và tác nhân thông minh lên thiết bị Arm.

09/09

Thứ Tư · 1 tin

08/09

Thứ Ba · 1 tin
SemiAnalysis@SemiAnalysis_
Hướng dẫnĐiểm AI 58/100

SemiAnalysis: TPU InferenceX tăng hiệu suất 50%, đe dọa vị thế độc tôn của CUDA

TPU Inference Externalization Full Steam Ahead - InferenceX, Up to 50% Better Performance per Dolla…

DịchBáo cáo từ SemiAnalysis cho thấy công nghệ InferenceX giúp tối ưu hóa chi phí TPU lên tới 50%, đồng thời đẩy nhanh quá trình phổ cập hạ tầng TPU, trực tiếp thách thức rào cản kỹ thuật của hệ sinh thái CUDA.

30/08

Chủ Nhật · 1 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 52/100

Trung Quốc chiếm 86% thị phần robot hình người: NVIDIA áp dụng chiến lược 'CUDA' để thống trị

Chinese robots hold 86% of total global humanoid shipments and Nvidia is extending its CUDA playbook…

DịchVới việc Trung Quốc nắm giữ 86% thị phần robot hình người toàn cầu, NVIDIA đang sao chép chiến lược CUDA bằng cách tích hợp sâu phần cứng và nền tảng Isaac/GR00T vào các nhà sản xuất, tạo ra hệ sinh thái phụ thuộc từ mô phỏng đến triển khai.

27/08

Thứ Năm · 1 tin
Ma Dongxi NLP@dongxi_nlp
Hướng dẫnĐiểm AI 51/100

Hướng dẫn thiết lập môi trường Machine Learning trên DGX Spark

I've put together an up-to-date, validated DGX Spark setup for ML experiments such as post-training: …

DịchHướng dẫn cấu hình tối ưu cho DGX Spark bao gồm PyTorch 2.13 trên CUDA 13, nhân huấn luyện đã kiểm chứng qua GB10 và môi trường vLLM biệt lập, giúp tăng hiệu suất cho các thử nghiệm hậu huấn luyện.

26/08

Thứ Tư · 1 tin

24/08

Thứ Hai · 1 tin
SemiAnalysis@SemiAnalysis_
Nghiên cứuĐiểm AI 64/100

Benchmark AgentX: Liệu 'hào sâu' CUDA có giữ vững vị thế trong suy luận AI Agent?

AgentX - InferenceXv3: Does CUDA Moat Hold up in Agentic Inferencing? $3 Million USD dataset open s…

DịchAgentX giới thiệu bộ dữ liệu 3 triệu USD với ngữ cảnh 1 triệu token, tối ưu hóa KVCache cho AI Agent đạt hiệu suất trên 95% trên các nền tảng phần cứng mạnh mẽ như GB300 và MI355.

23/08

Chủ Nhật · 1 tin
Clément Delangue (Hugging Face CEO)@ClementDelangue
Hướng dẫnĐiểm AI 34/100

NVIDIA đạt điểm tuyệt đối trong thử thách ARC-AGI-3 với khung lập trình tự động

NVIDIA built its own coding harness to optimize CUDA GPU kernels and achieved a 100% score on ARC-AG…

DịchNVIDIA vừa ra mắt khung lập trình giúp tối ưu hóa nhân CUDA, đạt tỷ lệ giải quyết 100% các bài toán trong ARC-AGI-3. Bước tiến này hứa hẹn sẽ hạ thấp rào cản kỹ thuật, giúp việc huấn luyện và tối ưu hóa AI trở nên dễ dàng hơn cho mọi người.

22/08

Thứ Bảy · 1 tin
LMSYS: Blog (nhóm Chatbot Arena)
Sản phẩmĐiểm AI 67/100

Cùng sự kiệnSGLang ra mắt Weight Cache Daemon: Khởi động lại engine AI chỉ trong chưa đầy 1 giây

SGLang giới thiệu Weight Cache Daemon sử dụng CUDA IPC để giảm thời gian tải trọng số từ 495 giây xuống còn 0,63 giây. Công nghệ này giúp tăng tốc khởi động hệ thống lên 785 lần, hỗ trợ chia sẻ đa thực thể và phục hồi engine tức thì.

Cùng sự kiện, tinh chọn hiển thị «AntLing ra mắt Weight Cache Daemon cho SGLang: Tăng tốc khởi động mô hình gấp 780 lần»

18/08

Thứ Ba · 2 tin

17/08

Thứ Hai · 1 tin

13/08

Thứ Năm · 1 tin
Jensen Huang@JensenHuang
Hướng dẫnĐiểm AI 28/100

Jensen Huang khẳng định: Đội ngũ GPU A100 vẫn sẽ phục vụ đến năm 2029

The mighty A100 fleet are mission-capable from 2020 through 2029. NVIDIA computing is more than chip…

DịchJensen Huang nhấn mạnh sức mạnh của NVIDIA không chỉ nằm ở chip mà còn ở hệ sinh thái CUDA, giúp các kiến trúc từ Ampere đến Blackwell duy trì tính bền bỉ và khả năng sử dụng lâu dài cho các trung tâm dữ liệu.

Tổng 23 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (39 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “CUDA” | AIHOT.vn