26/09

Thứ Bảy · 1 tin

25/09

Thứ Sáu · 1 tin
AK@_akhaliq
Sản phẩmĐiểm AI 51/100

Pruna ra mắt bộ LoRA adapter cho Qwen-Image-2.1, tăng tốc tạo ảnh lên 6,3 lần

Pruna-Qwen-Image-2.1 a set of a few-step LoRA adapters that make Qwen-Image-2.1 up to 6.3× faster f…

DịchPruna giới thiệu bộ LoRA adapter giúp Qwen-Image-2.1 tạo và chỉnh sửa ảnh chỉ với 5-8 bước thay vì 40 bước, giúp tăng tốc độ xử lý lên tới 6,3 lần mà vẫn đảm bảo chất lượng.

24/09

Thứ Năm · 2 tin
Liquid AI Mô hình và Blog kỹ thuật (Web)
Mô hìnhĐiểm AI 57/100

Cùng sự kiệnLiquid AI ra mắt LFM2.5-VL-DSpark: Tăng tốc suy luận mô hình thị giác ngôn ngữ lên tới 3,13 lần

Liquid AI giới thiệu mô hình drafter LFM2.5-VL-DSpark với 280 triệu tham số, giúp tăng tốc độ giải mã trên thiết bị biên lên 3,13 lần và trên GPU lên 2,66 lần mà chỉ tốn thêm 8,9% tài nguyên.

Cùng sự kiện, bài đại diện «Liquid AI ra mắt LFM2.5-VL-DSpark: Tăng tốc suy luận cho mô hình đa phương thức»
Boris Cherny@bcherny
Hướng dẫnĐiểm AI 56/100

Cùng sự kiệnAnthropic tăng tốc claude.ai gấp 3 lần chỉ trong 2 tuần và chia sẻ bí quyết tối ưu

If you've noticed how fast https://claude.ai and the Desktop app have become in the last few weeks, …

DịchĐội ngũ Anthropic đã cải thiện đáng kể tốc độ của claude.ai và ứng dụng Desktop. Kỹ sư Boris Cherny đã công khai quy trình sử dụng chính Claude để đo lường, gỡ lỗi và tối ưu hóa hiệu suất, cung cấp tài liệu tham khảo quý giá cho các nhà phát triển.

Cùng sự kiện, tinh chọn hiển thị «Đội ngũ Claude chia sẻ cách tăng tốc claude.ai gấp 3 lần chỉ trong hai tuần»

16/09

Thứ Tư · 1 tin
Sky Computing Lab@haoailab
NgànhĐiểm AI 48/100

FastVideo ra mắt FastH3 V2: Tăng tốc tạo video gấp 9 lần trên NVIDIA Blackwell

(1/6) Open Weight FastVideo FastH3 V2! Up to 9x speedup on @NVIDIA Blackwell. Lossless quality! 🚀 …

DịchFastVideo vừa công bố mã nguồn mở FastH3 V2, cho phép tạo video chất lượng cao với tốc độ nhanh gấp 9 lần trên kiến trúc NVIDIA Blackwell. Công nghệ này đã hỗ trợ ngay lập tức trên ComfyUI và API, hứa hẹn tối ưu hóa hiệu suất vượt trội cho các nhà sáng tạo nội dung.

09/09

Thứ Tư · 2 tin
AK@_akhaliq
NgànhĐiểm AI 30/100

Đột phá mới: Tăng tốc LLM không mất dữ liệu nhờ mô hình khuếch tán rời rạc

Unlocking Lossless Speedups in LLMs via Discrete Diffusion paper: https://huggingface.co/papers/260...

DịchNghiên cứu mới giới thiệu phương pháp sử dụng mô hình khuếch tán rời rạc (discrete diffusion) để tăng tốc độ xử lý cho các mô hình ngôn ngữ lớn mà vẫn đảm bảo độ chính xác tuyệt đối.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 54/100

Mô hình ngôn ngữ khuếch tán Mercury 2.5 của Inception đã có mặt trên OpenRouter

Mercury 2.5 from @_inception_ai is now generally available on OpenRouter. It's the fastest model on…

DịchMercury 2.5, mô hình ngôn ngữ sử dụng cơ chế khuếch tán để giải mã token song song, hiện đã khả dụng trên OpenRouter. Đây là mô hình nhanh nhất trên nền tảng này mà không yêu cầu phần cứng chuyên dụng, đặc biệt tối ưu cho các tác vụ lập trình.

08/09

Thứ Ba · 1 tin
MiniMax@MiniMax_AI
Mô hìnhĐiểm AI 63/100

NVIDIA và MiniMax ra mắt Sol-H3: Đột phá tốc độ tạo video vượt thời gian thực

New video generation acceleration for MiniMax-H3 from the NVIDIA Sol team! Faster than playback, f…

DịchĐội ngũ NVIDIA Sol hợp tác cùng MiniMax giới thiệu giải pháp tăng tốc Sol-H3, cho phép tạo video 5 giây chỉ trong 1,65 giây trên nền tảng Blackwell, nhanh gấp 15,5 lần so với phiên bản gốc.

02/09

Thứ Tư · 1 tin
JiQiZhiXin
Mô hìnhĐiểm AI 88/100

Tinh chọnCơ chế tạo văn bản từng từ đang làm chậm AI Agent của bạn: Công nghệ mới giúp tăng tốc gấp 5 lần

Mô hình ngôn ngữ khuếch tán (dLLM) đang nổi lên như giải pháp thay thế cho mô hình tự hồi quy truyền thống, cho phép tạo nội dung song song thay vì từng từ, giúp tăng tốc độ xử lý cho AI Agent lên gấp 5 lần trên thiết bị đầu cuối.


Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng giải quyết nút thắt về độ trễ của AI Agent. Thông tin mang tính thời sự cao, có tiềm năng thay đổi cách vận hành của các mô hình ngôn ngữ lớn trong tương lai.

31/08

Thứ Hai · 1 tin
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 48/100

Stanford giới thiệu Prefix Sliding: Tăng tốc suy luận cho mô hình AI lên gấp 3 lần

Banger paper from Stanford on efficient test-time scaling. If you run agents that think for a long …

DịchNghiên cứu mới từ Stanford đề xuất phương pháp Prefix Sliding giúp tối ưu bộ nhớ bằng cách lược bỏ các token trung gian trong quá trình suy luận. Kỹ thuật này tăng tốc độ xử lý gấp 3 lần mà không cần huấn luyện lại, hỗ trợ hiệu quả cho các chuỗi suy luận dài trên 100.000 token.

29/08

Thứ Bảy · 1 tin

20/08

Thứ Năm · 1 tin

19/08

Thứ Tư · 1 tin
Yuchen Jin@Yuchenj_UW
Sản phẩmĐiểm AI 25/100

DFlash 2: Bước tiến đột phá giúp tăng tốc suy luận AI cục bộ

DFlash 2 is very cool! Speculative decoding is such a cool technology. I'm waiting for the day we …

DịchDFlash 2 từ Z Lab và Inco AI mang đến công nghệ giải mã suy đoán (speculative decoding) mạnh mẽ, giúp tăng tốc độ xử lý mô hình AI lên gấp 4,6 lần mà vẫn giữ nguyên độ chính xác, đạt 70 tok/s trên MacBook Pro M5 Max.

14/08

Thứ Sáu · 1 tin
TechCrunch: AI
Sản phẩmĐiểm AI 52/100

OpenAI ra mắt chế độ Ultrafast: Đẩy tốc độ GPT-5.6 Sol nhanh gấp 14 lần

Hợp tác cùng Cerebras, OpenAI giới thiệu chế độ Ultrafast cho phép GPT-5.6 Sol đạt tốc độ 750 token/giây, nhanh gấp 14 lần so với thông thường.

Thêm 8 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)The Decoder: AI NewsX: Greg Brockman (@gdb)X: Sam Altman (@sama)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeJiqizhixinX: Tibo (@thsottiaux)
Tổng 14 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (36 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Tăng tốc AI” | AIHOT.vn