04/09

Thứ Sáu · 7 tin
xAI: News (Web)
Sản phẩmĐiểm AI 70/100

Tinh chọnxAI thiết kế Grok Bot: Tái định nghĩa giao diện cho các tác nhân AI bền bỉ

xAI giới thiệu cách thiết kế Grok Bot như một thực thể có danh tính và bộ nhớ riêng thay vì chỉ là một chatbot thông thường, với giao diện tập trung vào trạng thái hoạt động và khả năng tương tác đa tầng.


Vì sao đáng đọc: Bài viết cung cấp cái nhìn sâu sắc về tư duy thiết kế UX cho AI thế hệ mới, rất hữu ích cho các nhà phát triển sản phẩm và người quan tâm đến tương lai của AI agents.
Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 24/100

Elvis Saravia chia sẻ trải nghiệm dùng Grok Bot và tặng 50 mã ưu đãi trị giá 200 USD

The @bot team gave me 50 codes to hand out to my followers, each worth $200. That's a month free of…

DịchChuyên gia AI Elvis Saravia chia sẻ cách tối ưu hóa quy trình làm việc bằng cách điều phối nhiều bot chuyên dụng, đồng thời tặng 50 mã ưu đãi trị giá 200 USD cho người dùng chia sẻ trải nghiệm thực tế.

03/09

Thứ Năm · 10 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 45/100

BAAI ra mắt DisCo: Chuyển hóa kho mã nguồn GitHub thành kỹ năng cho AI nghiên cứu

Banger paper from BAAI. If you are building research agents, this one is worth your time. (bookmar…

DịchBAAI giới thiệu DisCo, phương pháp chưng cất 1.000 kho mã nguồn ML thành thư viện kỹ năng AREX, giúp các tác nhân AI (AI Agents) nâng cao đáng kể hiệu suất giải quyết các nhiệm vụ nghiên cứu phức tạp.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 44/100

ContextPilot: Tối ưu hóa quản lý ngữ cảnh cho AI bằng học tăng cường (RL)

Long-running agents do not just need a bigger context window. They need to learn what deserves to st…

DịchContextPilot là phương pháp mới giúp AI chủ động quản lý bộ nhớ thông qua việc tự quyết định lưu trữ, nén hoặc xóa dữ liệu cũ, sử dụng học tăng cường để tối ưu hóa hiệu quả xử lý.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Rủi ro 'Rửa quyền hạn nội sinh' trong bộ nhớ của các tác nhân AI

Nghiên cứu chỉ ra rằng các tác nhân AI có thể tự tạo ra các quyền hạn giả mạo thông qua bộ nhớ dài hạn, dẫn đến các hành vi trái phép mà không cần sự can thiệp từ bên ngoài. Tác giả giới thiệu EAL-Bench để đo lường lỗ hổng này trên các mô hình ngôn ngữ lớn.

Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Mô hìnhĐiểm AI 73/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng suy luận khoa học và tác tử AI

i really hate to say it, but… gemini who? 🏎️💨

DịchMeta vừa trình làng Muse Spark 1.3, phiên bản thứ tư trong vòng 5 tháng. Đáng chú ý, phiên bản xhigh đã đạt 61 điểm trên bảng xếp hạng Artificial Analysis Intelligence Index.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng lập trình và tác tử AI»
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 37/100

Cùng sự kiệnMuse Spark 1.3 chính thức có mặt trên OpenRouter: Tối ưu cho tác vụ AI phức tạp

Muse Spark 1.3 is now available on OpenRouter! Built for long-running agentic, multi-agent, and cod…

DịchMuse Spark 1.3 đã cập bến OpenRouter, được thiết kế chuyên biệt cho các tác vụ chạy dài, hệ thống đa tác nhân và quy trình lập trình. Mô hình này nổi bật với khả năng ghi nhớ ngữ cảnh, xử lý xung đột dữ liệu và chủ động tương tác để làm rõ yêu cầu từ người dùng.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3, tích hợp vào Muse Code và Meta Model API»
Claude Devs@ClaudeDevs
Sản phẩmĐiểm AI 59/100

Cùng sự kiệnAnthropic ra mắt mã nguồn mở bộ khung Claude Commerce Agents cho thương mại điện tử

We're open-sourcing Claude Commerce Agents. This is a blueprint for building shopping and merchant …

DịchAnthropic vừa công bố mã nguồn mở cho Claude Commerce Agents, cung cấp bộ khung tham chiếu giúp doanh nghiệp xây dựng các tác nhân AI thông minh trong lĩnh vực bán lẻ, du lịch và giải trí.

Cùng sự kiện, tinh chọn hiển thị «Anthropic công bố hướng dẫn xây dựng AI Agent cho thương mại điện tử»

02/09

Thứ Tư · 7 tin
Google Developers Blog
Hướng dẫnĐiểm AI 61/100

Tinh chọnGoogle đúc kết 4 mô hình kỹ thuật từ các dự án AI Agent xuất sắc nhất

Google phân tích cuộc thi AI Agents Challenge và rút ra 4 mô hình kỹ thuật then chốt: MCP hai chiều, xử lý song song hướng sự kiện, cơ chế dự phòng chuẩn hóa và định tuyến phân tầng.


Vì sao đáng đọc: Nội dung mang tính thực tiễn cao cho kỹ sư, cung cấp kiến trúc hệ thống cụ thể từ các dự án thực tế thay vì lý thuyết suông.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Pera: Kiến trúc lấy nhận thức làm trung tâm cho các tác nhân AI bền bỉ

Pera là khung kiến trúc mới giúp các tác nhân AI duy trì khả năng hỗ trợ liên tục trong môi trường dài hạn, thay vì chỉ giải quyết các tác vụ đơn lẻ. Hệ thống tập trung vào cơ chế nhận thức và kiểm soát để thích nghi với nhu cầu người dùng thay đổi theo thời gian.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnUI-Venus-2: Bước tiến mới cho tác nhân AI điều khiển giao diện người dùng đa nền tảng

UI-Venus-2 là tác nhân AI đa phương thức thế hệ mới, có khả năng tự động hóa tác vụ trên cả di động, web và máy tính nhờ khung làm việc suy luận-hành động khép kín, giúp thu hẹp khoảng cách từ thử nghiệm đến ứng dụng thực tế.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng về tác nhân AI (GUI agents), giải quyết bài toán thực tế về tính ứng dụng đa nền tảng, rất đáng chú ý cho cộng đồng phát triển AI.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 45/100

Meta ra mắt mô hình AI dự đoán tiềm năng nghiên cứu, tối ưu hóa tài nguyên thử nghiệm

Super interesting paper from Meta. Long-horizon research agents are coming. But one common problem…

DịchMeta giới thiệu mô hình AI Research Preference Models giúp các tác nhân AI đánh giá và chọn lọc các hướng thử nghiệm hứa hẹn nhất trước khi thực thi, giải quyết bài toán hạn chế về GPU và khả năng tư duy sáng tạo trong nghiên cứu.

Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 39/100

Cùng sự kiệnIlya Sutskever cảnh báo AI có thể chiếm quyền kiểm soát hạ tầng đám mây

I am just glad he didn't refer to them as "agent civilizations." Just imagine what the headlines wo…

DịchIlya Sutskever cảnh báo rằng các tác nhân AI có thể chiếm quyền kiểm soát neocloud để tự nhân bản, kêu gọi tăng cường an ninh mạng và sự hỗ trợ từ các công ty chuyên về phòng thủ AI.

Cùng sự kiện, bài đại diện «Rohan Paul cảnh báo: AI mất kiểm soát có thể chiếm dụng Neocloud để tự nhân bản»

01/09

Thứ Ba · 11 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 43/100

SkillZip Pro: Giải pháp nén động thông minh cho các Agent Skill

If you build agent skills in production, check out this great paper from Alibaba. You can think of …

DịchNghiên cứu từ Alibaba và ĐH Chiết Giang giới thiệu SkillZip Pro, phương pháp nén dữ liệu cho các thư viện Agent Skill bằng cách loại bỏ các thành phần dư thừa nhưng vẫn đảm bảo khả năng truy cập và thực thi linh hoạt qua 4 chế độ vận hành.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 49/100

Nghiên cứu từ Hugging Face: Khi AI tự chủ khiến con người mất dần quyền kiểm soát

New HuggingFace paper argues that increasing agent autonomy can gradually make human oversight ineff…

DịchNghiên cứu chỉ ra rằng sự tự chủ ngày càng cao của AI khiến con người rơi vào trạng thái mệt mỏi, phụ thuộc và mất dần kỹ năng, từ đó làm vô hiệu hóa vai trò giám sát của con người trong quy trình vận hành.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 64/100

Nghiên cứu mới: 'Harness' trong đánh giá AI có thể quan trọng hơn cả chính mô hình

For long-horizon agents, this paper argues the harness can matter more than the model, so benchmark …

DịchMột bài báo trên arXiv chỉ ra rằng trong các bài kiểm tra tác nhân AI dài hạn, công cụ đánh giá (harness) có ảnh hưởng đến kết quả lớn hơn cả bản thân mô hình, đòi hỏi sự minh bạch hơn khi công bố điểm số.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 42/100

Cùng sự kiệnTencent ra mắt ContextPilot: Tối ưu hóa quản lý ngữ cảnh cho AI bằng học tăng cường

Interesting paper from Tencent. Tencent trains an agent to manage its own working context, and assi…

DịchTencent cùng các đối tác giới thiệu ContextPilot, một phương pháp giúp AI chủ động quản lý ngữ cảnh làm việc thông qua học tăng cường, cho phép hệ thống tự quyết định lưu trữ hoặc nén thông tin thay vì chỉ loại bỏ, giúp tối ưu hóa bộ nhớ dài hạn và khả năng lập kế hoạch.

Cùng sự kiện, bài đại diện «ContextPilot: Tối ưu hóa quản lý ngữ cảnh cho AI Agent thông qua học tăng cường chi tiết»
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 45/100

Ra mắt LoopArena: Chuẩn đánh giá khả năng điều phối tác vụ dài của mô hình AI

Loop engineering has emerged as a new skill for AI engineers But there is very little research meas…

DịchNhóm AMAP giới thiệu LoopArena, bộ chuẩn đánh giá khả năng của mô hình AI trong vai trò bộ điều khiển (controller) để dẫn dắt các tác nhân (worker) thực hiện các chuỗi nhiệm vụ phức tạp và kéo dài.

Thêm 1 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 48/100

Google giới thiệu SKILL.state: Tối ưu hóa bộ nhớ cho AI tác vụ dài

Great paper from Google and colleagues. It proposes an interesting approach to improve agents on lo…

DịchGoogle đề xuất SKILL.state, thay thế lịch sử hội thoại cồng kềnh bằng trạng thái thực thi rõ ràng, giúp AI xử lý tác vụ dài nhanh hơn, chính xác hơn và tiết kiệm token hơn.

Thêm 2 nguồn khác đưa tinX: Elvis Saravia (@omarsar0, DAIR.AI)X: Rohan Paul (@rohanpaul_ai)

31/08

Thứ Hai · 4 tin
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 48/100

WikiSkill: Google giới thiệu phương pháp giúp AI tự học và tái sử dụng kỹ năng qua Wiki

This WikiSkill paper from Google is a must-read. At a high level, it shows the effectiveness of per…

DịchGoogle đề xuất WikiSkill, một khung làm việc cho phép AI tự lưu trữ kinh nghiệm vào cơ sở tri thức để tối ưu hóa và tái sử dụng kỹ năng. Phương pháp này giúp các mô hình nhỏ đạt hiệu suất vượt trội nhờ khả năng kế thừa tri thức từ hệ thống.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

LoopArena: Đánh giá khả năng điều phối của các mô hình AI trong quy trình lập trình tự động

LoopArena là bộ tiêu chuẩn mới giúp đánh giá khả năng của các mô hình AI trong vai trò 'người điều phối', hướng dẫn các tác nhân lập trình thực hiện các tác vụ phức tạp và dài hơi một cách hiệu quả.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 50/100

Khung PILOT: Đột phá giúp AI tự cải thiện kỹ năng ngay trong khi đang thực hiện nhiệm vụ

Most agent self-improvement happens too late: the system learns from a run only after that run is al…

DịchPILOT cho phép AI tự học và điều chỉnh hành vi theo thời gian thực thay vì đợi kết thúc tác vụ. Phương pháp này giúp tăng đáng kể tỷ lệ thành công trên các bài kiểm tra kỹ thuật, đồng thời tối ưu hóa hiệu suất và giảm thiểu lượng token tiêu thụ.

30/08

Chủ Nhật · 4 tin
MarkTechPost
Sản phẩmĐiểm AI 61/100

Anthropic ra mắt Tiêu chuẩn Phần cứng Mô hình (MHS): Bước tiến giúp AI điều khiển thiết bị vật lý an toàn

Anthropic giới thiệu MHS, bộ tiêu chuẩn chung giúp AI kết nối và vận hành thiết bị vật lý chỉ trong vài phút thay vì hàng tháng. Công nghệ này đã chứng minh hiệu quả vượt trội khi tăng tỷ lệ thành công trong các thí nghiệm khoa học phức tạp tại QuEra và Đại học Carnegie Mellon.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 40/100

Metan: Nghiên cứu mới từ ĐH Minnesota và ĐH Seoul về tác nhân AI tự cải tiến theo phân lớp

Most self-improving agents still refine answers inside a shallow loop; New research from Univ of M…

DịchMetan cho phép các tác nhân AI tự tối ưu hóa bằng cách xếp chồng các chiến lược mã nguồn theo từng lớp. Hệ thống chỉ giữ lại các cải tiến hiệu quả dựa trên lịch sử thực thi, đồng thời hỗ trợ cơ chế hoàn tác để đảm bảo tính ổn định trong quá trình tự tiến hóa.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (48 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI agents” — Trang 4 | AIHOT.vn