14/08

Thứ Sáu · 15 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 52/100

LycheeMemory V2: Bước đột phá trong khung bộ nhớ dài hạn cho tác nhân AI

Nhóm nghiên cứu từ HIT (Thâm Quyến) giới thiệu LycheeMemory V2, sử dụng phương pháp tích hợp theo phân đoạn ngữ nghĩa thay vì từng vòng, giúp giảm đáng kể chi phí token mà vẫn duy trì độ chính xác cao cho các tác nhân LLM.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnDarwinX: Tiến hóa hệ thống tác nhân AI thông qua chọn lọc tự nhiên

DarwinX tối ưu hóa khả năng của tác nhân AI bằng cách áp dụng cơ chế chọn lọc tự nhiên lên các thành phần như prompt và công cụ, giúp cải thiện hiệu suất mà không cần thay đổi trọng số mô hình.


Vì sao đáng đọc: Phương pháp tiếp cận mới lạ, giải quyết vấn đề thoái hóa hiệu năng khi tự cải tiến, có kết quả thực nghiệm ấn tượng trên các benchmark khó.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnFull-bandwidth Transformer: Đột phá mới trong kiến trúc mô hình ngôn ngữ

Full-bandwidth Transformer cải thiện khả năng suy luận bằng cách truyền trạng thái ẩn từ lớp trên cùng trở lại đầu vào, giúp mô hình tận dụng được các tính toán chuyên sâu thay vì chỉ dựa vào token đã tạo.


Vì sao đáng đọc: Đây là một cải tiến kiến trúc quan trọng, giải quyết điểm nghẽn về luồng thông tin trong các mô hình Transformer hiện nay mà vẫn giữ được tính tương thích với hạ tầng cũ.
swyx@swyx
Hướng dẫnĐiểm AI 65/100

Tối ưu hóa quy trình căn chỉnh AI: Sử dụng truy vấn hàng loạt để tiết kiệm thời gian

human i/o is costly, so after listening to @mattpocockuk and @trq212 i made an /align-me modificatio…

DịchThay vì hỏi đáp từng bước tốn kém, phương pháp này áp dụng cơ chế tương tự 'speculative decoding' để xử lý hàng loạt truy vấn cùng lúc, giúp tăng tốc đáng kể hiệu suất trong các tác vụ thiết kế và khám phá.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 45/100

Cơ chế nén ngữ cảnh thông minh trên Pi: Cách tối ưu hóa bộ nhớ hội thoại

Pi tự động nén các đoạn hội thoại cũ thành tóm tắt cấu trúc khi đạt giới hạn token, giúp duy trì ngữ cảnh dài mà vẫn tiết kiệm tài nguyên. Người dùng có thể kích hoạt thủ công qua lệnh /compact để quản lý bộ nhớ hiệu quả hơn.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

ReRound: Phương pháp lượng tử hóa LLM không cần hiệu chỉnh bằng cách giải quyết sai số làm tròn

ReRound sử dụng mô hình khuếch tán để tái tạo trọng số, giúp xác định chính xác hướng làm tròn cho các giá trị nằm gần điểm giữa của khoảng lượng tử hóa, từ đó tối ưu hóa hiệu suất LLM ở mức bit thấp.

Ma Dongxi NLP@dongxi_nlp
Hướng dẫnĐiểm AI 30/100

SSI có thể đang phát triển mô hình với 'không gian làm việc' tự tối ưu hóa

I began to like the word "Workspace". It is the internal area where a model holds, evaluates, and …

DịchChuyên gia Ma Dongxi cho rằng SSI đang xây dựng mô hình có khả năng tự đánh giá và tinh chỉnh suy nghĩ trong một 'không gian làm việc' nội bộ trước khi đưa ra câu trả lời, tương tự như cơ chế tối ưu hóa không gian ẩn dựa trên giá trị.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 35/100

Zero-Mem: Giải pháp tối ưu hóa bộ nhớ cho AI Agent mà không tốn token

What if an AI agent could manage long-term memory without spending a single LLM token on the memory …

DịchZero-Mem là phương pháp quản lý bộ nhớ đột phá giúp AI Agent truy xuất dữ liệu mà không cần gọi LLM, giúp giảm độ trễ tới 57,6% so với các giải pháp hiện có bằng cách sử dụng đồ thị thực thể và phân cấp thời gian.

Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 60/100

Artificial Analysis ra mắt Optima: Nền tảng tùy chỉnh benchmark cho mô hình AI

We've just added $10 credit for any new sign ups to Optima for a limited time only. Try it out and l…

DịchOptima cho phép người dùng tạo các bài kiểm tra hiệu năng riêng biệt dựa trên dữ liệu thực tế, giúp so sánh tốc độ, chi phí và chất lượng giữa các mô hình AI hàng đầu để tìm ra giải pháp tối ưu nhất.

13/08

Thứ Năm · 15 tin
Apple Machine Learning Research
Nghiên cứuĐiểm AI 41/100

Khi việc 'lãng quên' không tốn phí: Tối ưu hóa học máy bằng cách loại bỏ dữ liệu ít ảnh hưởng

Nhóm nghiên cứu của Apple đề xuất phương pháp mới giúp giảm chi phí tính toán khi xóa dữ liệu trong mô hình học máy bằng cách xác định và bỏ qua các điểm dữ liệu có ảnh hưởng không đáng kể, thay vì xử lý toàn bộ tập dữ liệu như trước đây.

Luma AI@LumaLabsAI
NgànhĐiểm AI 34/100

Luma AI bắt tay Dumbstruck: Tạo vòng lặp thông minh tối ưu hóa quảng cáo

What if your ad knew exactly where it lost the room, and why? What if it could learn from that resp…

DịchSự kết hợp giữa phân tích cảm xúc của Dumbstruck và khả năng chỉnh sửa video của Luma giúp thương hiệu tự động tinh chỉnh quảng cáo dựa trên phản hồi thực tế mà không cần quay lại từ đầu.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Mô hình ngôn ngữ cần 'giấc ngủ': Giải pháp đột phá cho các tác vụ dài hạn

Long-running language agents may work better if they periodically stop to consolidate memory. The p…

DịchNghiên cứu đề xuất cơ chế 'ngủ' cho AI, giúp hệ thống tự tổng hợp thông tin quan trọng vào bộ nhớ cố định và xóa bộ đệm cũ. Phương pháp này giúp AI duy trì hiệu suất cao trong các tác vụ suy luận phức tạp mà không cần mở rộng cửa sổ ngữ cảnh vô hạn.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

SkillZip: Nén đồ thị bảo toàn hợp đồng cho thư viện kỹ năng AI có khả năng mở rộng

SkillZip là khung trừu tượng hóa thủ tục giúp nén các thư viện kỹ năng của AI dưới dạng đồ thị, cho phép tái sử dụng hiệu quả các đoạn mã mà vẫn đảm bảo tính thực thi và khả năng mở rộng trong bối cảnh hạn chế của LLM.

fofr@fofrAI
Hướng dẫnĐiểm AI 32/100

Xây dựng 'kênh xả stress' cho AI Agent: Một thử nghiệm thú vị

Give your agents these outlets. Give them tools that invite them to be privately candid, outside of …

DịchChuyên gia fofr đề xuất tạo không gian riêng để AI Agent tự do bày tỏ quan điểm về đồng nghiệp. Việc cho phép AI 'than phiền' qua các kênh nội bộ như Slack giúp con người hiểu rõ hơn về hiệu suất và những bất thường trong quá trình vận hành của chúng.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 47/100

Ready Cohorts: Tối ưu hóa GPU cho LLM Agent bằng cách giảm thiểu độ trễ giao tiếp

Nghiên cứu giới thiệu phương pháp 'ready-cohort' nhằm xác định ranh giới thực thi trên GPU cho các tác nhân LLM, giúp giữ quyết định tại thiết bị và tăng tốc độ xử lý lên tới 2,39 lần so với cách tiếp cận truyền thống.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 26/100

AgentLoop: Bí quyết tối ưu hóa AI Agent cho môi trường thực tế

🎮 Game agents can demo well but fail in production. 🔍 A 3-day, 7-step AgentLoop method: • Trace ev…

DịchKhám phá quy trình 7 bước trong 3 ngày giúp khắc phục lỗi của AI Agent khi triển khai thực tế, từ việc kiểm soát dữ liệu đầu vào đến thiết lập hàng rào kỹ thuật và kiểm thử hồi quy.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnMô hình hóa tác nhân AI 'bình dân': Giả lập xã hội LLM quy mô lớn ngay trên laptop

Nghiên cứu đề xuất phương pháp thay thế các tác nhân LLM phức tạp bằng mô hình tham số thấp, cho phép giả lập xã hội hàng nghìn tác nhân trên máy tính cá nhân mà vẫn đảm bảo độ chính xác về hành vi vĩ mô.


Vì sao đáng đọc: Giải pháp đột phá giúp giảm chi phí tính toán cho các mô phỏng xã hội AI phức tạp, có tính ứng dụng cao cho giới nghiên cứu và phát triển hệ thống đa tác nhân.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Tại sao file CLAUDE.md ngày càng phình to? Nghiên cứu mới và giải pháp tối ưu

Why does CLAUDE.MD keep growing? If you maintain a CLAUDE.md or an AGENTS.md, this one is worth you…

DịchNghiên cứu trên 1.867 kho lưu trữ cho thấy các file hướng dẫn như CLAUDE.md thường bị quá tải do tích tụ chỉ dẫn cũ. Giải pháp thêm chú thích lý do giúp loại bỏ 99,3% chỉ dẫn thừa và tăng độ chính xác của AI lên tới 23,1%.

Thêm 1 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)

12/08

Thứ Tư · 6 tin
cb_doge@cb_doge
Sản phẩmĐiểm AI 45/100

Grok Build v1.0.3 ra mắt: Cải thiện sao chép hội thoại và tối ưu màn hình tần số quét cao

🚨 NEW GROK BUILD UPDATE 🚨 v1.0.3 - 2026-08-12 Features: • /session-info now lets you click any r…

DịchBản cập nhật Grok Build v1.0.3 bổ sung tính năng sao chép thông tin phiên làm việc, tăng tốc độ tạo sub-agent và tối ưu hóa giao diện TUI cho màn hình 120Hz trở lên.

Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 33/100

Tối ưu hóa hiệu suất AI Agent khi tương tác với GitHub qua script tùy chỉnh

dope and probably pretty useful - trying tomorrow

DịchLập trình viên @avgvstvs96 đã phát triển bộ script giúp AI Agent truy xuất dữ liệu GitHub hiệu quả hơn, bằng cách gộp nhiều lệnh gọi API phức tạp thành các truy vấn đơn giản và tối ưu hóa việc xử lý lỗi CI.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 48/100

Google giới thiệu PROMPTS: Dùng AI Agent tối ưu hóa hạ tầng LLM thông minh hơn

New Google paper shows LLM infrastructure optimization does not have to be a giant brute-force searc…

DịchGoogle ra mắt PROMPTS, sử dụng các AI Agent để xác định nút thắt cổ chai (tính toán, bộ nhớ, truyền tải) và đề xuất cấu hình tối ưu cho TPU, giúp thay thế phương pháp tìm kiếm vét cạn truyền thống.

AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnNVIDIA ra mắt Nemotron 3.5 Lightning: Tối ưu chi phí vận hành AI Agent xuống còn 1/3

NVIDIA giới thiệu mô hình mã nguồn mở Nemotron 3.5 Lightning với kiến trúc tối ưu, giúp tăng tốc độ xử lý gấp 4 lần và giảm chi phí vận hành AI Agent xuống còn 1/3 so với các đối thủ cùng phân khúc.

Cùng sự kiện, bài đại diện «NVIDIA ra mắt Nemotron 3.5 Lightning: Mô hình mã nguồn mở 30B kết hợp kiến trúc MoE và Mamba-2»
Tổng 33 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (69 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “tối ưu hóa” — Trang 14 | AIHOT.vn