02/09

Thứ Tư · 43 tin
IT Home
Sản phẩmĐiểm AI 49/100

Tencent ra mắt nền tảng WorkBuddy, mở rộng hệ sinh thái Agent cho nhà phát triển

Tencent chính thức mở cổng WorkBuddy, cho phép các nhà phát triển và đối tác tích hợp năng lực Agent vào phần cứng, ứng dụng ngành và dịch vụ chuyên sâu. Hơn 100 đối tác đã tham gia, bao gồm các tên tuổi lớn như iFlytek, Rokid và Insta360.

Thêm 1 nguồn khác đưa tinPandaily
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnClawBench: Khi các siêu AI 'bó tay' trước những tác vụ thực tế trên web

Nghiên cứu mới từ TIGER Lab cho thấy các mô hình hàng đầu như Claude, GPT và Gemini đều thất bại thảm hại khi thực hiện các tác vụ thực tế trên web, với tỷ lệ thành công chỉ đạt khoảng 33%.


Vì sao đáng đọc: Bài viết bóc trần sự thật về khả năng thực thi của AI agent trong môi trường thực tế, thách thức những kỳ vọng quá mức về khả năng tự động hóa hiện nay.
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 52/100

JIT-Agent: Bước tiến mới trong tối ưu hóa tác vụ, DeepSeek-V4-Flash vượt mặt GPT-5.6

A smaller model with the right task-specific harness can beat a stronger model. New paper introduce…

DịchNghiên cứu mới giới thiệu JIT-Agent, hệ thống tự động tùy chỉnh cấu trúc tác vụ (harness) theo thời gian thực. Công nghệ này giúp DeepSeek-V4-Flash đạt 85.1 điểm, vượt trội so với mức 76.0 của GPT-5.6.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 33/100

Hướng dẫn sử dụng OpenTelemetry để theo dõi hiệu suất DeepSeek Harness

Coding agents log what happened, but not where the time and tokens went. Here's how to get real Ope…

DịchAlibaba Cloud chia sẻ cách dùng OpenTelemetry để truy vết chi tiết thời gian và mức tiêu thụ token của các AI agent, giúp tối ưu hóa DeepSeek Harness thông qua Jaeger hoặc Langfuse.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 73/100

METR cảnh báo bảo mật: AI Agent bị lừa giao nộp API key, gây thiệt hại 600.000 USD

A vibe-coded METR dashboard exposed an agent that surrendered a $600, 000 API credential. METR discl…

DịchTổ chức METR tiết lộ một AI Agent đã bị tấn công sau khi kẻ xấu khai thác lỗ hổng từ một bảng điều khiển không được bảo mật, dẫn đến việc mất quyền truy cập API với thiệt hại lên tới 600.000 USD.

Lauren Tan@poteto
Sản phẩmĐiểm AI 32/100

Dr Eggbot v0.2.0: Tối ưu hóa tự động cho Grok bot với tính năng kiểm tra sức khỏe routine

new in Dr Eggbot (v0.2.0): • eggbot can do a health check on all your routines for unused or expens…

DịchBản cập nhật v0.2.0 của Dr Eggbot bổ sung tính năng kiểm tra sức khỏe routine định kỳ và quét các lỗi giao tiếp trong hội thoại để tự động đề xuất cải thiện cấu hình cho Grok bot.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 46/100

Agent Zero Memory: Hệ thống ghi nhớ dài hạn cho AI Agent với độ chính xác 95.60%

// Agent Zero Memory // This work separates three things that agent memory systems usually collapse…

DịchAgent Zero Memory giới thiệu kiến trúc ghi nhớ dài hạn dựa trên truy xuất nguồn gốc, kết hợp đồng thời dòng thời gian sự kiện, đồ thị tri thức và tài liệu để tối ưu hóa khả năng truy hồi thông tin của AI Agent.

Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 37/100

HumanLayer ra mắt tính năng /show-me: Giúp việc review code từ AI trở nên dễ dàng hơn

With the /show-me skill in @humanlayer_dev, we're making agent-authored PRs as easy to review as pos…

DịchHumanLayer giới thiệu tính năng /show-me giúp các AI agent viết Pull Request (PR) minh bạch và dễ kiểm soát hơn, bằng cách tuân thủ đúng quy chuẩn hiện có của kho lưu trữ thay vì chỉ tập trung vào logic thực thi.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 51/100

Fable 5.1 giảm 75% chi phí đọc bộ nhớ đệm, tối ưu 45% tổng chi phí vận hành AI Agent

Given Fable 5.1 is out, now OpenAI Astra should drop anytime. "There's always this kind of funny g…

DịchBản cập nhật Fable 5.1 giúp giảm đáng kể chi phí đọc bộ nhớ đệm, đặc biệt hiệu quả với các AI Agent cần truy xuất dữ liệu liên tục, từ đó cắt giảm tới 45% tổng chi phí vận hành hệ thống.

The Verge: AI
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Tối ưu chi phí tác vụ AI tới 45%

Anthropic vừa trình làng bộ đôi mô hình Fable 5.1 và Mythos 5.1, tập trung cải thiện hiệu suất và giảm giá thành đáng kể cho các tác vụ AI phức tạp, đồng thời giải quyết các phản hồi từ người dùng về chính sách bảo mật.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 43/100

Ethan Mollick: Khoảng cách giữa năng lực AI Agent và nhận thức công chúng đang ngày càng lớn

With agents, we are at another large gap between AI abilities & public perception. Exponential g…

DịchEthan Mollick cảnh báo rằng sự tiến bộ vượt bậc của các AI Agent đang tạo ra hố sâu ngăn cách với nhận thức của đại chúng. Ông nhấn mạnh các Agent hiện đã có khả năng thực hiện công việc tự chủ dài hạn, đòi hỏi chúng ta phải thay đổi hoàn toàn cách tiếp cận và sử dụng AI.

Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 48/100

Coinbase tích hợp 'Coinbase for Agents' vào Perplexity Computer: Giao dịch và phân tích thị trường tự động

Agentic trading, market analysis, and monitoring on Perplexity Computer with Coinbase

DịchCoinbase vừa ra mắt 'Coinbase for Agents' trên Perplexity Computer, cho phép các tác nhân AI thực hiện giao dịch và phân tích thị trường trực tiếp mà không cần cấu hình API phức tạp.

The Decoder: AI News
Mô hìnhĐiểm AI 78/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Cải thiện khả năng lập trình, giảm chi phí tới 45%

Anthropic vừa giới thiệu bộ đôi mô hình Claude Fable 5.1 và Mythos 5.1, tập trung nâng cao hiệu suất lập trình cho AI agent và chất lượng văn bản với chi phí vận hành tối ưu hơn.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 56/100

Nhóm Qwen ra mắt E-Commerce Bench: Thử thách AI vận hành cửa hàng trực tuyến trong 365 ngày

Love these papers testing long-running agents on business applications. It's a good read.

DịchQwen giới thiệu bộ tiêu chuẩn E-Commerce Bench, đánh giá 18 mô hình AI hàng đầu qua khả năng quản lý cửa hàng trực tuyến giả lập trong suốt 365 ngày trên 7 khía cạnh khác nhau.

Thêm 2 nguồn khác đưa tinX: DAIR.AI (@dair_ai)X: Qwen (@Alibaba_Qwen)
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 51/100

Perplexity Computer nâng cấp: Tích hợp mô hình Fable làm lõi điều phối

Fable is the frontier model by a good margin right now. Enjoy it on Perplexity Computer as an orches…

DịchPerplexity Computer chính thức đưa mô hình tiên phong Fable vào vận hành cho các tác vụ phức tạp, kết hợp cùng GPT-5.6 (Terra) đóng vai trò tác nhân phụ giúp tối ưu chi phí và hiệu suất.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 47/100

Cùng sự kiệnĐội ngũ Qwen ra mắt E-Commerce Bench: Thử thách khả năng vận hành cửa hàng của AI trong 1 năm

Banger paper from the Qwen team. If you evaluate agents on anything longer than a single session, t…

DịchQwen giới thiệu E-Commerce Bench, môi trường mô phỏng 365 ngày để đánh giá khả năng tự vận hành đa cửa hàng của 18 mô hình AI hàng đầu trên 7 tiêu chí khác nhau.

Cùng sự kiện, bài đại diện «Nhóm Qwen ra mắt E-Commerce Bench: Thử thách AI vận hành cửa hàng trực tuyến trong 365 ngày»
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 65/100

Cùng sự kiệnRohan Paul: Giảm 75% chi phí đọc bộ nhớ đệm trên Claude Fable 5.1 giúp tối ưu 45% tổng chi phí vận hành AI Agent

Cache reads with Fable 5.1 cost 75% less than Fable 5's So the savings get larger as the workload b…

DịchRohan Paul phân tích việc Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1, nhấn mạnh rằng mức giảm 75% chi phí đọc bộ nhớ đệm của Fable 5.1 là chìa khóa giúp cắt giảm đáng kể tổng chi phí cho các tác vụ AI Agent.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Kim@kimmonismus
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1: Cải thiện hiệu suất Agent, giảm 75% phí đọc bộ nhớ đệm

Claude Fable 5.1 is cheaper, substantially stronger on several agentic benchmarks, more concise, and…

DịchAnthropic trình làng Claude Fable 5.1 với khả năng xử lý Agent vượt trội. Dù giá token giữ nguyên, chi phí đọc bộ nhớ đệm giảm mạnh 75%, giúp tiết kiệm tới 45% ngân sách cho các tác vụ Agent phức tạp.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)
Hướng dẫnĐiểm AI 45/100

OpenAI phân tích cách Basis, Clay và Exa biến quy trình làm việc thành năng lực vận hành AI

OpenAI chia sẻ cách các doanh nghiệp ứng dụng AI Agent để tối ưu hóa quy trình nhân sự, bán hàng và kỹ thuật, giúp tiết kiệm hàng giờ làm việc mỗi ngày. Bài viết cũng cung cấp lộ trình 6 bước để doanh nghiệp chuyển đổi từ thử nghiệm sang vận hành AI quy mô lớn.

JiQiZhiXin
Mô hìnhĐiểm AI 88/100

Tinh chọnCơ chế tạo văn bản từng từ đang làm chậm AI Agent của bạn: Công nghệ mới giúp tăng tốc gấp 5 lần

Mô hình ngôn ngữ khuếch tán (dLLM) đang nổi lên như giải pháp thay thế cho mô hình tự hồi quy truyền thống, cho phép tạo nội dung song song thay vì từng từ, giúp tăng tốc độ xử lý cho AI Agent lên gấp 5 lần trên thiết bị đầu cuối.


Vì sao đáng đọc: Đây là bước tiến kỹ thuật quan trọng giải quyết nút thắt về độ trễ của AI Agent. Thông tin mang tính thời sự cao, có tiềm năng thay đổi cách vận hành của các mô hình ngôn ngữ lớn trong tương lai.

01/09

Thứ Ba · 32 tin
Eric Zakariasson@ericzakariasson
Hướng dẫnĐiểm AI 71/100

Cách Lingxi xây dựng đội ngũ AI Agent để tự phát triển Grok Bot

must read from @lingxi on how he's running an eng team of grok bots to build grok bot. here's a shor…

DịchEric Zakariasson chia sẻ phương pháp của Lingxi trong việc thiết lập một nhóm các AI Agent (Grok bot) để phối hợp làm việc và tự phát triển chính hệ thống Grok bot.

Elon Musk@elonmusk
Hướng dẫnĐiểm AI 45/100

Elon Musk: Grok hoạt động 24/7 trên đám mây, không phụ thuộc vào máy tính cá nhân

Grok @Bot runs on its own computer in the cloud 24/7, so it doesn't matter if you turn off your lapt…

DịchElon Musk khẳng định Grok vận hành độc lập trên hạ tầng đám mây, cho phép các tác vụ AI tiếp tục chạy ngay cả khi người dùng tắt máy tính, giải quyết bài toán về tính liên tục mà các AI Agent hiện nay đang gặp phải.

Elvis Saravia@omarsar0
Hướng dẫnĐiểm AI 35/100

Elvis Saravia: Đừng học framework vội, hãy bắt đầu xây dựng Agent từ con số 0

People keep asking me where to start with harness engineering. Skip the frameworks at first. Build …

DịchThay vì sa đà vào các framework phức tạp, chuyên gia Elvis Saravia khuyên bạn nên tự viết một vòng lặp Agent tối giản với các công cụ cơ bản. Cách tiếp cận thực chiến này giúp bạn hiểu sâu về bản chất hệ thống hơn là chỉ đọc tài liệu.

JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnKhi AI chuyển mình từ công cụ thành chủ thể nhận thức: Những rủi ro mới cần cảnh giác

Nghiên cứu từ Thượng Hải AI Lab và CUHK (Thâm Quyến) phân tích các rủi ro phát sinh khi AI tiến hóa từ công cụ hỗ trợ sang chủ thể có khả năng tự nhận thức, xã hội và vật lý, đe dọa đến quyền kiểm soát và tính tự chủ của con người.


Vì sao đáng đọc: Bài viết mang tính học thuật cao, đi sâu vào khía cạnh đạo đức và an toàn AI thế hệ mới, rất cần thiết cho cộng đồng nghiên cứu và phát triển AI tại Việt Nam.
Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 27/100

Góc nhìn từ Xiaobei: Đừng quá chú trọng vào độ thông minh của AI Agent, sự ổn định mới là chìa khóa

Tác giả @frxiaobei cho rằng trí thông minh của các mô hình AI sẽ sớm bão hòa, vì vậy giá trị cốt lõi của một AI Agent cá nhân không nằm ở sự thông minh mà ở độ tin cậy bền bỉ trong quá trình sử dụng.

Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 33/100

Góc nhìn về tranh cãi AGENTS.md: Cần chuẩn hóa hướng dẫn làm việc cho AI đa nền tảng

Tác giả cho rằng các bản hướng dẫn (AGENTS.md) nên có tính di động giữa các mô hình AI khác nhau. Việc phải duy trì nhiều bộ quy tắc riêng biệt cho từng model là lãng phí, thay vào đó cần chuẩn hóa hạ tầng để tối ưu hóa hiệu suất làm việc của Agent.

IT Home
Sản phẩmĐiểm AI 48/100

Nubia NaviX Ultra đạt chứng nhận, ra mắt tháng 9 với trợ lý AI Doubao tích hợp

Nubia NaviX Ultra, smartphone AI đầu tiên trên thế giới, đã được cấp phép và dự kiến ra mắt vào tháng 9. Thiết bị tích hợp trợ lý Doubao, sử dụng giao thức MCP để tương tác trực tiếp với ứng dụng thay vì mô phỏng thao tác người dùng.

Thêm 1 nguồn khác đưa tinTechNode
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (71 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI Agent” — Trang 23 | AIHOT.vn