Agent / Tác nhân
Mô hình tự lập kế hoạch, gọi công cụ và thực thi nhiều bước: Từ Claude Code, Manus đến các framework Agent.
3.820 bài thu thập302 tinh chọncập nhật đến 28/09 01:39
- PandailyT6 · 14/08 · 09:30
DeepSeek ra mắt 'Black Whale': Công bố mã nguồn mở DeepSeek Harness theo chuẩn MIT
DeepSeek vừa phát hành mô hình V4 Pro và bản xem trước DeepSeek Harness. Hệ thống này sử dụng kiến trúc plugin linh hoạt, cho phép theo dõi toàn bộ quá trình hoạt động của AI thông qua nhật ký phiên làm việc.
- WeChat: KhazixT6 · 14/08 · 07:01
Tăng tốc làm chủ DeepSeek Harness: Nền tảng Agent với triết lý 'Mọi thứ là Plugin'
DeepSeek Harness giới thiệu kiến trúc Cordis đột phá, cho phép thay đổi plugin linh hoạt mà không làm gián đoạn trạng thái Agent. Với 4 chế độ vận hành và khả năng tự nâng cấp, đây là công cụ mạnh mẽ cho các nhà phát triển đang tìm kiếm giải pháp Agent tùy biến cao.
- Boris ChernyT6 · 14/08 · 04:52
Thực nghiệm: Claude tự động xử lý 388 yêu cầu thay đổi mã nguồn (PR) cho ứng dụng
Boris Cherny đã để Claude đảm nhận việc bảo trì ứng dụng, từ sửa lỗi đến dọn dẹp mã thừa. Kết quả là 388 PR được tạo ra trong vài tuần, với gần một nửa được hợp nhất thành công sau khi kiểm duyệt, cho thấy tiềm năng lớn của AI trong việc tự động hóa quy trình kỹ thuật.
- JiQiZhiXinT6 · 14/08 · 02:45
DeepSeek Harness chính thức mở mã nguồn: Khung làm việc AI dạng plugin đầy đột phá
DeepSeek vừa ra mắt DeepSeek Harness, khung làm việc AI dạng plugin cho phép xây dựng ứng dụng phức tạp như game 3D hay hoạt họa chỉ từ mô tả văn bản. Dự án gây ấn tượng mạnh nhờ khả năng tối ưu hóa hiệu suất vượt trội so với các mô hình lớn hơn.
- Cursor BlogT6 · 14/08 · 01:23
Cursor ra mắt tính năng Builds: Tăng tốc khởi động AI Agent lên gấp 3 lần
Cursor vừa giới thiệu tính năng Builds giúp duy trì sẵn môi trường phát triển ở chế độ nền, cho phép AI Agent khởi động tức thì mà không cần thiết lập lại từ đầu, giúp tăng tốc độ phản hồi lên gấp 3 lần.
- OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)T6 · 14/08 · 01:19
Hướng dẫn xây dựng với GPT-5.6: Tối ưu chi phí cho hiệu năng AI Agent vượt trội
Dòng model GPT-5.6 mang đến khả năng suy luận bền bỉ và điều phối đa tác nhân với chi phí thấp hơn đáng kể. Đặc biệt, model Luna đạt hiệu suất ngang ngửa bản 5.5 nhưng giảm chi phí vận hành tới 25 lần.
- DeepSeekT5 · 13/08 · 20:21
DeepSeek ra mắt bản xem trước DeepSeek Harness v0.1: Khung phát triển AI dạng module
DeepSeek vừa phát hành DeepSeek Harness v0.1 dưới giấy phép MIT. Đây là khung làm việc cho AI agent với thiết kế 'mọi thứ là plugin', cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng.
- PandailyT5 · 13/08 · 15:15
WeChat ra mắt trợ lý AI Xiaowei, vận hành trên mô hình WeLM 617 tỷ tham số
WeChat đang thử nghiệm trợ lý AI Xiaowei tích hợp sâu, sử dụng kiến trúc MoE với 617 tỷ tham số nhưng chỉ kích hoạt 23 tỷ mỗi token, đồng thời tiên phong kỹ thuật Hidden Decoding mới.
- PandailyT5 · 13/08 · 15:15
Cú hích 'DeepSeek' cho robot AI: X Square vượt mặt Figure 03 với chi phí rẻ hơn 70%
Hệ thống robot hai tay X Square đạt hiệu suất phân loại 1.816 kiện hàng/giờ, vượt xa Figure 03 nhờ mô hình hợp nhất WALL-B tối ưu hóa phần cứng giá rẻ. Đây là bước ngoặt cho thấy sức mạnh phần mềm có thể thay thế phần cứng đắt đỏ trong ngành robot.
- Hugging Face Daily PapersT5 · 13/08 · 14:45
Mô hình hóa tác nhân AI 'bình dân': Giả lập xã hội LLM quy mô lớn ngay trên laptop
Nghiên cứu đề xuất phương pháp thay thế các tác nhân LLM phức tạp bằng mô hình tham số thấp, cho phép giả lập xã hội hàng nghìn tác nhân trên máy tính cá nhân mà vẫn đảm bảo độ chính xác về hành vi vĩ mô.
- WeChat: KhazixT5 · 13/08 · 11:41
WorkBuddy ra mắt tính năng điều khiển từ xa: Trải nghiệm làm việc với AI mượt mà nhất
WorkBuddy cập nhật tính năng điều khiển từ xa, cho phép đồng bộ hóa liền mạch giữa PC và di động mà không cần quét mã. Bản cập nhật còn bổ sung kho tài liệu dùng chung, chỉnh sửa Markdown thời gian thực và chế độ duyệt nội dung AI chuyên nghiệp.
- Hugging Face Daily PapersT5 · 13/08 · 11:30
OpenART: Nâng tầm kiểm thử bảo mật AI thông qua môi trường tiến hóa mở
OpenART là nền tảng kiểm thử bảo mật (red teaming) quy mô lớn, sử dụng hơn 10.000 kịch bản trạng thái phức tạp để đánh giá khả năng ứng biến của các tác nhân AI trong môi trường dài hạn, khắc phục hạn chế của các bài kiểm tra tĩnh hiện nay.
- Hugging Face Daily PapersT5 · 13/08 · 09:00
An toàn cho AI Agent: Tại sao cần chuyển dịch sang cơ chế kiểm soát thời gian thực?
Thay vì chỉ dựa vào huấn luyện mô hình, bài viết đề xuất an toàn cho AI Agent cần được thực thi thông qua các hợp đồng thời gian thực, bao gồm cơ chế ngăn chặn hành vi nguy hiểm và yêu cầu bằng chứng xác thực cho mọi tác vụ.
- GitHub BlogT5 · 13/08 · 01:59
AutoGPT quản lý các Pull Request từ AI như thế nào thông qua AGENTS.md và kiểm soát kỹ năng
AutoGPT tối ưu hóa quy trình đóng góp của AI bằng cách đặt hướng dẫn trực tiếp vào tệp AGENTS.md và áp dụng các cổng kiểm soát nghiêm ngặt như CLA để phân biệt giữa người dùng và tác nhân AI.
- OpenRouter: AnnouncementsT4 · 12/08 · 22:45
OpenRouter ra mắt chuẩn đánh giá tìm kiếm web thời gian thực cho AI Agent
OpenRouter công bố bảng xếp hạng hiệu suất tìm kiếm, cho thấy việc tăng độ sâu tìm kiếm giúp cải thiện đáng kể kết quả, đồng thời khẳng định chọn đúng mô hình quan trọng hơn công cụ tìm kiếm.
- QbitAIT4 · 12/08 · 21:00
Robot nội địa Trung Quốc lập kỷ lục thế giới: Hiệu suất vượt Figure AI với chi phí chỉ bằng 30%
Mẫu robot tích hợp trí tuệ nhân tạo mới của Trung Quốc đã gây ấn tượng khi xử lý 1.816 kiện hàng có hình dạng phức tạp chỉ trong một giờ, đạt hiệu suất vượt trội so với đối thủ Figure AI với chi phí tối ưu hơn.
- OpenRouterT4 · 12/08 · 19:02
Meta ra mắt Muse Glimmer: Mô hình AI mã nguồn mở 30B đã có mặt trên OpenRouter
Meta AI vừa phát hành Muse Glimmer, mô hình 30B đa phương thức (văn bản và hình ảnh) với giấy phép Apache 2.0. Được tối ưu cho các tác nhân AI cục bộ, mô hình này hiện đã sẵn sàng để trải nghiệm trên nền tảng OpenRouter.
- JiQiZhiXinT4 · 12/08 · 16:45
Libra: Hệ thống tối ưu hóa tài nguyên cho Agentic RL, tăng tốc độ huấn luyện gấp 3 lần
Nhóm nghiên cứu từ CUHK và HSU giới thiệu Libra, hệ thống quản lý tài nguyên đột phá giúp giải quyết tình trạng mất cân bằng tải trong huấn luyện Agentic RL, tăng hiệu suất lên gấp 3 lần so với các phương pháp truyền thống.
- JiQiZhiXinT4 · 12/08 · 15:15
Cựu lãnh đạo kỹ thuật Qwen của Alibaba chính thức khởi nghiệp với Pragmatik Labs, định giá 2 tỷ USD
Lâm Tuấn Dương, cựu lãnh đạo kỹ thuật Qwen, vừa công bố thành lập Pragmatik Labs với mục tiêu phát triển các tác nhân AI (Agent) kết hợp giữa thế giới số và vật lý, thu hút vốn đầu tư khủng từ Sequoia China và Hillhouse.
- Hugging Face Daily PapersT4 · 12/08 · 10:15
Đồng tiến hóa trong hệ thống tác tử: Hướng tới khả năng tự tiến hóa vượt xa thiết kế của con người
Nghiên cứu đề xuất khung phân loại ba giai đoạn về sự đồng tiến hóa giữa các tác tử và môi trường, giúp hệ thống AI tự thích nghi và phát triển mà không cần sự can thiệp liên tục từ con người.