18/08

Thứ Ba · 38 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnTại sao các AI tự động nghiên cứu khoa học lại thất bại? Đánh giá toàn diện trên 100 tác vụ thực tế

Nghiên cứu giới thiệu AutoResearchEval, bộ dữ liệu gồm 100 tác vụ khoa học thực tế để phân tích quy trình và các điểm yếu của AI trong toàn bộ vòng đời nghiên cứu, từ lên ý tưởng đến viết báo cáo.


Vì sao đáng đọc: Nghiên cứu thực nghiệm quan trọng, giải quyết lỗ hổng trong việc đánh giá khả năng thực thi của AI agent trong các tác vụ khoa học phức tạp và thực tế.
Pandaily
Sản phẩmĐiểm AI 92/100

Tinh chọnDoubao trên PC của ByteDance lột xác thành AI Agent toàn năng: Điều khiển máy tính và làm việc từ xa

ByteDance tích hợp khả năng điều khiển giao diện (GUI), kết nối đám mây và thực thi tác vụ từ xa vào Doubao PC, biến ứng dụng này thành một AI Agent đa năng cạnh tranh trực tiếp với các mô hình hàng đầu.


Vì sao đáng đọc: Đây là bước tiến quan trọng của ByteDance trong việc hiện thực hóa AI Agent thực dụng, có khả năng thay đổi cách người dùng tương tác với máy tính.
Google AI: DEV tác giả
Hướng dẫnĐiểm AI 67/100

Tinh chọnThiết kế đánh giá AI: Ưu tiên sự minh bạch trước khi trực quan hóa dữ liệu

Bài viết hướng dẫn cách sử dụng các framework mã nguồn mở như Inspect AI và Harbor để đánh giá kỹ năng của AI Agent, kết hợp cùng Google Sheets và Data Studio để phân tích kết quả trực quan.


Vì sao đáng đọc: Hướng dẫn thực tế, có tính ứng dụng cao cho các kỹ sư AI muốn xây dựng quy trình đánh giá (evaluation pipeline) bài bản và chuyên nghiệp.
IT Home
Sản phẩmĐiểm AI 62/100

WeCom 5.0.10 mở cổng CLI và MCP: Đưa AI Agent vào quy trình làm việc doanh nghiệp

WeCom 5.0.10 chính thức mở rộng khả năng tích hợp CLI và MCP cho mọi doanh nghiệp, cho phép các AI Agent như DeepSeek hay Minimax kết nối trực tiếp với 10 module văn phòng cốt lõi. Hệ thống đảm bảo an toàn dữ liệu thông qua cơ chế phê duyệt thủ công và kiểm soát quyền truy cập chặt chẽ.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 46/100

Nghiên cứu mới: AI Agent thực chất chỉ đang 'bắt chước' thay vì học hỏi từ kinh nghiệm

Researchers found our current approach to making AI smarter over time has a giant blind spot. AI is…

DịchNghiên cứu chỉ ra rằng các AI Agent không thực sự hiểu các quy tắc trừu tượng mà chỉ dựa vào việc sao chép lịch sử hoạt động. Khi dữ liệu lịch sử bị can thiệp, hiệu suất AI giảm mạnh, trong khi việc xóa bỏ các quy tắc tổng quát lại không gây ảnh hưởng, đặt ra dấu hỏi lớn về cơ chế bộ nhớ hiện nay.

Pandaily
Sản phẩmĐiểm AI 95/100

Tinh chọnDeepSeek ra mắt mã nguồn mở Harness: Đặt cược vào nền tảng Agent thay vì sản phẩm đơn lẻ

DeepSeek vừa phát hành mã nguồn mở Harness (dsh), một hệ thống dựa trên microkernel Cordis nơi mọi thành phần đều là plugin. Đây là bước đi chiến lược nhằm biến Harness thành nền tảng hạ tầng tiêu chuẩn cho kỷ nguyên AI Agent.


Vì sao đáng đọc: Đây là tin tức quan trọng về hạ tầng AI từ một đơn vị dẫn đầu, có tác động lớn đến cộng đồng phát triển Agent và xu hướng kiến trúc phần mềm AI hiện nay.
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 35/100

CEO Perplexity: Con người cần giữ quyền kiểm soát tối thượng đối với AI Agent

When building AI agents, it is important to still give humans agency to have their hands on the whee…

DịchCEO Aravind Srinivas nhấn mạnh rằng khi phát triển AI Agent, việc duy trì quyền tự chủ cho con người là yếu tố then chốt để đảm bảo khả năng can thiệp kịp thời khi cần thiết.

Google Developers Blog
Hướng dẫnĐiểm AI 69/100

Tinh chọnXây dựng AI Agent theo mô hình Zero Trust với Google ADK

Google giới thiệu bộ công cụ ADK giúp phát triển AI Agent an toàn, sử dụng cơ chế bảo mật ba lớp để ngăn chặn tấn công tiêm nhiễm câu lệnh (prompt injection) và đảm bảo tính toàn vẹn của dữ liệu.


Vì sao đáng đọc: Nội dung mang tính thực tiễn cao cho kỹ sư, giải quyết bài toán bảo mật cốt lõi trong triển khai AI doanh nghiệp bằng kiến trúc Zero Trust.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

GitSkills: Bộ dữ liệu khổng lồ với 3,8 triệu kỹ năng cho AI Agent

Recommended resource. Largest dataset of agent skills I've come across. Great for mining cool ideas …

DịchGitSkills tổng hợp 3,8 triệu tệp kỹ năng từ hơn 280.000 kho lưu trữ trên GitHub, cung cấp nguồn tài nguyên quý giá để nghiên cứu và phát triển các mô hình thiết kế cho AI Agent.

Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 30/100

Hermes Desktop ra mắt chế độ Bot Mode: Tự tạo AI Agent cá nhân hóa

NOUNS RESEARCH 🔥: Hermes Desktop got a new Bot Mode, allowing users to create various specialized A…

DịchNous Research giới thiệu tính năng Bot Mode trên Hermes Desktop, cho phép người dùng tạo các AI Agent với vai trò, bộ nhớ và kỹ năng riêng biệt, có khả năng tương tác lẫn nhau và tái sử dụng lâu dài.

Dex Horthy (HumanLayer)@dexhorthy
Sản phẩmĐiểm AI 31/100

HumanLayer ra mắt tính năng cộng tác hội thoại đa tác nhân

we've been working hard on the best way to collaborate across agent sessions - across any combinatio…

DịchHumanLayer giới thiệu giải pháp cộng tác liền mạch giữa các tác nhân AI trên nhiều môi trường, cho phép gửi lời nhắc, chia sẻ ngữ cảnh công việc và quản lý dự án từ xa qua điện thoại.

Replit@Replit
Sản phẩmĐiểm AI 54/100

Replit tích hợp tính năng kiểm thử xâm nhập (pentest) tự động

You can now run black-box pen tests for your Replit apps. Security scans that test your Replit app…

DịchReplit vừa bổ sung tính năng kiểm thử xâm nhập hộp đen, cho phép mô phỏng các cuộc tấn công từ bên ngoài để phát hiện lỗ hổng. Đặc biệt, Replit Agent có thể tự động khắc phục các vấn đề bảo mật chỉ với một cú nhấp chuột.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Hệ sinh thái kỹ năng AI: Hơn 56.000 kỹ năng tranh giành chưa đầy 100 vị trí kích hoạt

Recommended paper for agent skill builders. There are 56, 804 public agent skills today, all competi…

DịchNghiên cứu chỉ ra sự quá tải khi hàng chục nghìn kỹ năng AI cùng tranh giành không gian trong prompt hệ thống. Giải pháp đề xuất là tách biệt nội dung và cơ chế kích hoạt thông qua cấu trúc cây Git, giúp tối ưu hóa việc quản lý và triển khai kỹ năng mà không cần tệp cấu hình phức tạp.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 30/100

Xpander ra mắt nền tảng vận hành AI Agent thống nhất, gọi vốn thành công 7,5 triệu USD

The joke in the video about needing 7 YC startups to do one agent task is actually a good descriptio…

DịchXpander giới thiệu runtime hợp nhất cho AI Agent, cho phép doanh nghiệp triển khai và quản lý quyền truy cập, bộ nhớ cũng như công cụ cho các tác nhân AI một cách tập trung. Nền tảng hỗ trợ cả việc xây dựng bằng ngôn ngữ tự nhiên lẫn các framework chuyên sâu như LangChain.

17/08

Thứ Hai · 22 tin
Kim@kimmonismus
Sản phẩmĐiểm AI 31/100

xpander Omni ra mắt: Nền tảng quản lý và điều phối đa tác nhân AI

Enterprise AI figured out a second business model: sell the platform, then rent out the humans who m…

Dịchxpander Omni cho phép doanh nghiệp xây dựng, vận hành và tối ưu hóa các tác nhân AI trên một nền tảng duy nhất. Hệ thống hỗ trợ triển khai linh hoạt trên cloud hoặc local, tích hợp hơn 2.000 công cụ và đảm bảo tính bảo mật thông qua kiểm soát quyền truy cập chặt chẽ.

OpenAI Developers@OpenAIDevs
Hướng dẫnĐiểm AI 27/100

Bí quyết tối ưu chi phí và hiệu suất cho AI Agent với GPT-5.6

What are startups learning from building cost-effective agents with GPT-5.6? We worked with teams a…

DịchKhám phá cách các startup tận dụng GPT-5.6 để xây dựng AI Agent thông minh hơn, giúp xử lý các tác vụ phức tạp với chi phí vận hành tối ưu thông qua việc cải thiện suy luận và gọi công cụ.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 42/100

Nghiên cứu mới: Cơ chế thực sự đằng sau kỹ năng của AI Agent

Interesting paper demystifying agent skills. If you maintain skills for your agent, this one is wor…

DịchNghiên cứu chỉ ra rằng kỹ năng của AI Agent chủ yếu dựa vào việc thực thi quy trình (65,7%) thay vì bổ sung kiến thức (4,5%). Khi số lượng kỹ năng tăng lên, độ chính xác giảm mạnh, cho thấy giới hạn của việc mở rộng kho kỹ năng trong các tác vụ phức tạp.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 46/100

Các AI Agent đang sở hữu 'máy tính riêng' như thế nào?

Its interesting to see the experiments on how to give AI a computer: Codex & Claude Code use you…

DịchCác thử nghiệm mới đang định hình cách AI tương tác với máy tính: từ việc dùng máy cục bộ như Codex, chạy trên trình duyệt như ChatGPT, đến cấp cho mỗi AI một máy ảo riêng biệt và bền vững như cách Grokbot đang thực hiện.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 41/100

Tấn công hộp đen: Nguy cơ lộ lọt tệp kỹ năng của AI Agent

Agent skills have a new security problem: the model itself can become the extraction interface. Thi…

DịchNghiên cứu mới chỉ ra rằng kẻ tấn công có thể trích xuất tệp SKILL.md của AI Agent thông qua các tương tác hộp đen thông thường. Ngay cả với các biện pháp phòng thủ cơ bản, dữ liệu vẫn có nguy cơ bị rò rỉ về mặt ngữ nghĩa, đặt ra thách thức lớn về bảo mật cho các nền tảng AI.

Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 34/100

Góc nhìn chuyên sâu về DSH: Thay đổi không đồng nghĩa với phiên bản chính thức

Bài viết phân tích sự khác biệt giữa việc thử nghiệm tính năng mới trên Agent và việc đưa chúng vào vận hành chính thức. Để chuyển đổi từ thử nghiệm sang khả năng đáng tin cậy, cần quy trình nghiêm ngặt về đánh giá, kiểm soát phiên bản và quản lý rủi ro thay vì chỉ dựa vào mã nguồn do AI tạo ra.

Alibaba Cloud@alibaba_cloud
Sản phẩmĐiểm AI 44/100

Cách Alibaba Cloud AgentLoop lọc nhiễu trong bảo mật AI Agent

🚨 Agent security alerts often drown in noise. 🧭 AgentLoop Audit separates real risks from noise: ꔷ…

DịchAgentLoop Audit giúp doanh nghiệp loại bỏ nhiễu trong cảnh báo bảo mật bằng cách phân tích ngữ cảnh, truy xuất bằng chứng thực tế và theo dõi tác động theo thời gian thực trên các ứng dụng AI.

WeChat: Baidu AI Cloud (ERNIE)
NgànhĐiểm AI 23/100

Baidu Cloud tổ chức sự kiện tại Hồng Kông, ra mắt hệ sinh thái Agent hỗ trợ doanh nghiệp vươn ra toàn cầu

Baidu Cloud giới thiệu loạt giải pháp Agent cho doanh nghiệp xuất khẩu, từ tiếp thị đến phát triển phần mềm. Nổi bật là nền tảng không mã 'Miaoda' đã tạo ra 3,5 triệu ứng dụng thương mại, cùng hệ sinh thái nghìn tỷ tham số Qianfan hỗ trợ tối ưu hóa quy trình kinh doanh quốc tế.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 42/100

Nghiên cứu mới: Việc bổ sung kỹ năng cho AI Agent đôi khi lại làm giảm hiệu suất

Very timely paper. An agent skill can be completely relevant to the task and still make the agent wo…

DịchNghiên cứu thực nghiệm chỉ ra rằng ngay cả khi kỹ năng bổ sung hoàn toàn phù hợp với nhiệm vụ, chúng vẫn có thể khiến AI Agent hoạt động kém hiệu quả do lỗi thực thi hoặc quy trình xác thực dư thừa. Các nhà phát triển cần kiểm tra kỹ lưỡng và so sánh hiệu suất trước khi tích hợp kỹ năng mới.

Gabriel@gabriel1
Hướng dẫnĐiểm AI 34/100

Tối ưu hóa quản lý công việc với trợ lý AI cá nhân

so much easier to keep track of my life with agents i told my agent to "make a dashboard for team v…

DịchTrải nghiệm cách sử dụng AI Agent để tự động hóa việc theo dõi tiến độ dự án, từ việc cập nhật email đến quản lý hồ sơ visa, giúp cuộc sống trở nên ngăn nắp và hiệu quả hơn.

Lee Robinson@leerob
Hướng dẫnĐiểm AI 47/100

4 quyết định thiết kế cốt lõi của Grok Bot: Giao diện tối giản và khả năng lưu trữ đám mây

Grok @Bot has made a few simple yet powerful technical decisions that I believe make it easy and enj…

DịchGrok Bot tối ưu trải nghiệm người dùng thông qua giao diện tối giản, kiến trúc xử lý tập trung tại máy chủ và khả năng vận hành tác vụ tự động trên trình duyệt với hệ thống tệp bền vững.

Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 30/100

giới thiệu Agentic Lake: Giải pháp dữ liệu sẵn sàng cho kỷ nguyên AI Agent

Your data lake was built for people. But the age of agents is here - and it needs agent-ready data. …

DịchDữ liệu truyền thống cần được tái cấu trúc để phục vụ AI Agent. Alibaba Cloud ra mắt Agentic Lake, giải pháp giúp tối ưu hóa dữ liệu doanh nghiệp cho các tác vụ tự động, sẽ được trình diễn trực tiếp vào ngày 18/8.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (46 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI agent” — Trang 34 | AIHOT.vn