03/09

Thứ Năm · 44 tin
TechNode
Sản phẩmĐiểm AI 85/100

Cùng sự kiệnTencent mở nền tảng WorkBuddy cho bên thứ ba với hơn 100 đối tác tham gia

Tencent chính thức mở nền tảng WorkBuddy, cho phép các nhà phát triển và đối tác phần cứng tích hợp khả năng của AI agent vào hệ sinh thái của họ. Hiện đã có hơn 100 đối tác, bao gồm các tên tuổi lớn như iFlytek và Rokid, tham gia vào giai đoạn đầu.

Cùng sự kiện, bài đại diện «Tencent ra mắt nền tảng WorkBuddy, kết nối hơn 100 đối tác trong hệ sinh thái AI Agent»
Boris Cherny@bcherny
Sản phẩmĐiểm AI 71/100

Cùng sự kiệnClaude Cowork và Claude Code giờ đây có thể điều khiển máy tính ở chế độ nền

Background computer use is underrated

DịchClaude hiện có khả năng tự động thao tác trên máy tính như click chuột, nhập liệu và mở ứng dụng ở chế độ nền, cho phép người dùng tiếp tục làm việc khác mà không bị gián đoạn.

Cùng sự kiện, tinh chọn hiển thị «Claude Cowork và Claude Code giờ đây có thể tự động thao tác máy tính ở chế độ nền»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 52/100

Nghiên cứu DuMateBench: Khung Agent quyết định tới 27% hiệu suất của cùng một mô hình AI

New Stanford and other top research lab paper shows that the framework around an LLM can change agen…

DịchDuMateBench giới thiệu bộ tiêu chuẩn đánh giá AI Agent qua 200 tác vụ thực tế phức tạp, từ lập trình đến sáng tạo nội dung, giúp đo lường khả năng xử lý lỗi và môi trường thực tế của các mô hình.

IT Home
Sản phẩmĐiểm AI 64/100

Cùng sự kiệnAnthropic nâng cấp Claude Cowork và Claude Code: Hỗ trợ điều khiển máy Mac chạy ngầm

Anthropic vừa cập nhật tính năng điều khiển máy tính cho Claude, cho phép AI thực hiện các thao tác như nhấp chuột, nhập liệu và điều hướng trên macOS ngay cả khi chạy ngầm, giúp người dùng tối ưu hóa hiệu suất làm việc.

Cùng sự kiện, tinh chọn hiển thị «Claude Cowork và Claude Code giờ đây có thể tự động thao tác máy tính ở chế độ nền»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 44/100

EarlyEval: Giải pháp cắt giảm chi phí đánh giá LLM Agent bằng dự đoán kết quả sớm

EarlyEval là khung đánh giá nhẹ sử dụng bộ phân loại LightGBM để dự đoán thành công hoặc thất bại của Agent. Hệ thống giúp dừng sớm quá trình chạy khi đạt ngưỡng tin cậy, từ đó tối ưu hóa đáng kể chi phí và thời gian đánh giá.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 45/100

DisCo: Đột phá biến 1.000 kho lưu trữ ML thành thư viện 5.000+ kỹ năng cho AI Agent

Nghiên cứu giới thiệu phương pháp Repo-To-Skill giúp chắt lọc kiến thức từ GitHub thành thư viện kỹ năng AREX, cho phép AI Agent thực thi tác vụ hiệu quả hơn thông qua các kỹ năng đã được kiểm chứng.

OpenClaw@openclaw
Hướng dẫnĐiểm AI 49/100

Podcast OpenClaw tập 9: Đội ngũ sáng lập chia sẻ về bước tiến OpenClaw 2.0

Inside OpenClaw 2.0 🦞 OpenClaw founder @steipete joins @Pat_Erichsen, @hrudolph and @jlehman_ to d…

DịchTrong tập podcast mới nhất, đội ngũ sáng lập OpenClaw thảo luận chi tiết về phiên bản 2.0, bao gồm cải tiến giao diện điều khiển, tính năng cộng tác nhóm, tối ưu hóa độ ổn định và các nâng cấp về kỹ năng, bộ nhớ cho worker.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 60/100

Nghiên cứu Daydreaming từ UC Berkeley: Đánh cắp kỹ năng ẩn của AI Agent qua tương tác hộp đen

New UC Berkeley paper Daydreaming shows a harder agent-security problem: legitimate task outputs alo…

DịchCác nhà nghiên cứu tại UC Berkeley giới thiệu phương pháp Daydreaming, cho phép đánh cắp kỹ năng ẩn của AI Agent chỉ bằng cách quan sát kết quả đầu ra, mà không cần truy cập vào prompt hay tệp tin hệ thống.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 45/100

Kiến trúc AI Agent độc lập với môi trường: Giải pháp cho khả năng di chuyển linh hoạt

What a super interesting paper this one is. They propose an architecture for agents that outlive th…

DịchNghiên cứu mới trên arXiv đề xuất kiến trúc AI Agent tách biệt danh tính, bộ nhớ và mã nguồn khỏi mô hình hay máy chủ, cho phép chuyển đổi linh hoạt giữa các nền tảng mà không làm gián đoạn quá trình vận hành.

IT Home
Mô hìnhĐiểm AI 66/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Bước tiến đột phá trong lập trình và tác vụ AI dài hạn

Meta vừa trình làng Muse Spark 1.3, mô hình AI tối ưu cho quy trình làm việc phức tạp và khả năng lập trình vượt trội, được đánh giá ngang hàng với Claude Fable 5.1.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng lập trình và tác tử AI»
Meta Engineering Blog
Hướng dẫnĐiểm AI 52/100

Meta xây dựng 'bộ não thứ hai' cho doanh nghiệp: AI Agent tự học hỏi từ chuyên gia

Meta phát triển AI Agent trong lĩnh vực tuân thủ, sử dụng hệ thống tri thức cấu trúc để mô phỏng tư duy chuyên gia. Giải pháp này giúp rút ngắn thời gian đánh giá từ vài ngày xuống vài phút mà không cần huấn luyện lại mô hình.

Claude@claudeai
Sản phẩmĐiểm AI 72/100

Tinh chọnClaude Cowork và Claude Code giờ đây có thể tự động thao tác máy tính ở chế độ nền

Claude can now use your computer in the background in Claude Cowork and Claude Code. Give it someth...

DịchAnthropic vừa cập nhật khả năng cho phép Claude Cowork và Claude Code tự động điều khiển máy tính ở chế độ nền. AI có thể thực hiện các thao tác như click chuột, nhập liệu và mở ứng dụng, giúp người dùng rảnh tay làm việc khác.

Diễn biến sự kiện · 3 bài →Thêm 4 nguồn khác đưa tinX: Boris Cherny (@bcherny)IT HomeX: Thariq (@trq212)X: Claude Devs (@ClaudeDevs)

Vì sao đáng đọc: Thông báo chính thức về khả năng điều khiển máy tính ở chế độ nền của Claude giúp người dùng đánh giá tính ứng dụng của công cụ này vào quy trình làm việc cá nhân.
Claude Devs@ClaudeDevs
Sản phẩmĐiểm AI 54/100

Claude Code cập nhật tính năng Computer Use: Hỗ trợ chạy ngầm trên macOS

Computer use in the Claude Code desktop app now runs in the background. Claude works in the apps yo…

DịchỨng dụng Claude Code trên macOS hiện cho phép tính năng Computer Use chạy ngầm, giúp AI thực hiện tác vụ trong khi người dùng vẫn tiếp tục làm việc. Tính năng này hiện đang ở giai đoạn beta dành cho người dùng gói Pro và Max.

Diễn biến sự kiện · 2 bài →
Cursor Blog
Sản phẩmĐiểm AI 68/100

Tinh chọnCursor ra mắt Self-Hosted Machines: Đưa AI Agent vào hạ tầng nội bộ doanh nghiệp

Cursor giới thiệu tính năng Self-Hosted Machines, cho phép các AI Agent thực thi tác vụ trên máy chủ riêng của doanh nghiệp thay vì cloud, giúp đảm bảo bảo mật dữ liệu mà vẫn tận dụng được khả năng suy luận mạnh mẽ từ Cursor.

Diễn biến sự kiện · 1 bài →

Vì sao đáng đọc: Đây là bước tiến quan trọng giúp giải quyết rào cản lớn nhất của AI Agent trong doanh nghiệp là bảo mật dữ liệu, rất đáng chú ý cho cộng đồng lập trình viên.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnTối ưu hóa chi phí cho AI Agent thông qua cấu trúc dữ liệu thích ứng

Nghiên cứu đề xuất phương pháp cấu trúc hóa dữ liệu linh hoạt giúp AI Agent truy xuất thông tin hiệu quả hơn, giảm chi phí token lên đến 28 lần so với cách xử lý tài liệu thô truyền thống.


Vì sao đáng đọc: Giải quyết bài toán chi phí thực tế cho doanh nghiệp khi triển khai AI Agent trên dữ liệu phi cấu trúc, có tính ứng dụng cao và tiềm năng tối ưu hóa tài nguyên lớn.
Claude: Blog (Web)
Hướng dẫnĐiểm AI 79/100

Tinh chọnAnthropic công bố hướng dẫn xây dựng AI Agent cho thương mại điện tử

Anthropic chia sẻ lộ trình tối ưu hóa kiến trúc, chi phí và vận hành cho AI Agent trong ngành thương mại điện tử, kèm mã nguồn mở giúp doanh nghiệp tăng hiệu suất vận hành và trải nghiệm mua sắm.

Diễn biến sự kiện · 3 bài →Thêm 2 nguồn khác đưa tinX: Claude Devs (@ClaudeDevs)MarkTechPost

Vì sao đáng đọc: Nội dung mang tính thực tiễn cao, cung cấp giải pháp kỹ thuật cụ thể và mã nguồn mở cho bài toán kinh doanh thực tế, rất hữu ích cho các nhà phát triển và doanh nghiệp.

02/09

Thứ Tư · 43 tin
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 34/100

Resona: Biến tài liệu thành AI Agent dẫn dắt nội dung livestream chuyên nghiệp

This AI makes a useful distinction between knowledge and delivery. @MeetResona is treating the docu…

DịchResona giúp người sáng tạo biến tài liệu tĩnh thành các buổi livestream tương tác, nơi AI chủ động dẫn dắt cuộc hội thoại thay vì chỉ trả lời thụ động theo câu hỏi của người dùng.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle DeepMind ra mắt Gemini 3.8 Flash: Nâng cấp mạnh mẽ cho lập trình và tác vụ AI Agent

Google DeepMind vừa công bố Gemini 3.8 Flash, phiên bản kế nhiệm của 3.7 Flash với hiệu suất vượt trội trong kỹ thuật phần mềm và quy trình làm việc của AI Agent, đồng thời tối ưu hóa linh hoạt giữa chất lượng, chi phí và độ trễ.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
IT Home
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnGoogle âm thầm ra mắt Gemini 3.8 Flash, tối ưu cho kỹ thuật phần mềm và tác vụ AI Agent

Google vừa lặng lẽ cập nhật mô hình Gemini 3.8 Flash trên nền tảng DeepMind. Phiên bản này được nâng cấp từ Gemini 3.7 Flash, tập trung cải thiện hiệu suất cho các tác vụ lập trình và vận hành AI Agent.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
Google AI@GoogleAI
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Flash: Bước tiến mới cho tác vụ đa bước và AI Agent

We're introducing Gemini 3.8 Flash ⚡️ built to tackle complex agentic and multi-step tasks with even…

DịchGoogle giới thiệu Gemini 3.8 Flash với khả năng suy luận vượt trội, tối ưu cho các tác vụ phức tạp và AI Agent. Mô hình cho phép kiểm soát nỗ lực tính toán linh hoạt, hỗ trợ tự động hóa từ viết code đến xây dựng và tinh chỉnh game 3D thông qua khả năng hiểu video và lập trình chuyên sâu.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
Google AI: DEV tác giả
Hướng dẫnĐiểm AI 69/100

Tinh chọnHarness Engineering là gì? Google trình diễn khả năng tự sửa lỗi code với ADK 2.0 và Antigravity SDK

Google giới thiệu kỹ thuật 'harness engineering' giúp bao bọc LLM bằng các thành phần xác thực, cho phép AI tự động tạo và sửa lỗi code trong môi trường sandbox an toàn mà không cần con người can thiệp.


Vì sao đáng đọc: Bài viết giải thích cấu trúc của harness engineering kèm ví dụ thực tế về sandbox và vòng lặp tự sửa lỗi, giúp người dùng dễ dàng áp dụng vào quy trình làm việc với AI Agent của riêng mình.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 48/100

ByteDance giới thiệu HarnessDev: Bước tiến mới giúp LLM tự tạo và tối ưu hóa môi trường kiểm thử Agent

Banger paper from ByteDance Seed. If you are curious about self-evolving agent harnesses, this one …

DịchByteDance Seed công bố HarnessDev, một chuẩn đánh giá mới chuyển dịch từ việc kiểm tra kết quả sang tạo lập và tiến hóa môi trường thực thi (harness) cho AI Agent, giúp tối ưu hóa hiệu suất và chi phí vận hành.

Runway@runwayml
Sản phẩmĐiểm AI 36/100

Runway ra mắt Dev MCP: Tích hợp nền tảng phát triển trực tiếp vào AI Coding Agent

Introducing Runway Dev MCP. Connect to the Runway developer platform from inside your coding agent …

DịchRunway giới thiệu Dev MCP, cho phép lập trình viên kết nối, xây dựng và quản lý các dự án Runway ngay trong môi trường AI Coding Agent mà không cần chuyển đổi tab.

Thêm 1 nguồn khác đưa tinRunway: News (Web)
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 56/100

Cohub: Hệ điều hành mã nguồn mở cung cấp không gian làm việc bền vững cho AI Agent

this new open-source github repo gives agents a persistent workspace beyond the conversation, built …

DịchCohub là hệ điều hành mã nguồn mở giúp AI Agent quản lý tệp tin, công cụ và ngữ cảnh ngoài các phiên trò chuyện. Dự án nổi bật với mô hình bộ nhớ hai lớp, cho phép lưu trữ trạng thái làm việc chi tiết trong từng dự án và chọn lọc kiến thức quan trọng để chia sẻ.

Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 40/100

Catch AI ra mắt trợ lý điều hành thông minh dành riêng cho giới lãnh đạo

There is a huge market for proactive agents that get real work done. Catch is a great example of pr…

DịchCatch AI là trợ lý ảo thế hệ mới được thiết kế để thực hiện trực tiếp các tác vụ hành chính phức tạp như quản lý lịch trình, email và công tác phí thay vì chỉ dừng lại ở mức gợi ý. Hệ thống này có khả năng ghi nhớ sở thích cá nhân và chủ động xử lý công việc trước khi người dùng yêu cầu.

AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 51/100

Điểm yếu chí mạng trong kiến trúc Multi-Bot: Rủi ro bảo mật và hạn chế phân quyền

Chuyên gia chỉ ra rằng các Bot dùng chung tài khoản hiện nay chia sẻ chung môi trường vận hành và quyền truy cập, khiến việc phân quyền trở nên bất khả thi. Mọi thao tác nhạy cảm như thanh toán hay thay đổi hệ thống vẫn cần con người phê duyệt để đảm bảo an toàn.

Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 37/100

Meta thử nghiệm Ava: Trợ lý AI mới với khả năng điều khiển máy tính trực tiếp

META 🔥: A new model named Ava with computer-use capabilities is undergoing closed testing in the Me…

DịchMeta đang thử nghiệm nội bộ mô hình Ava trên ứng dụng desktop, cho phép AI tương tác trực tiếp với các ứng dụng thông qua thao tác nhấp chuột, nhập liệu và cuộn trang trong phạm vi cửa sổ được cấp quyền.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (78 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI Agent” — Trang 22 | AIHOT.vn