Cursor đạt chứng nhận AIUC-1: Bước tiến mới về bảo mật cho AI Agent
Cursor chính thức nhận chứng nhận AIUC-1 sau khi vượt qua các bài kiểm tra khắt khe về an toàn và độ tin cậy cho AI Agent, được bảo chứng bởi các chuyên gia từ MITRE và CSA.
Cursor chính thức nhận chứng nhận AIUC-1 sau khi vượt qua các bài kiểm tra khắt khe về an toàn và độ tin cậy cho AI Agent, được bảo chứng bởi các chuyên gia từ MITRE và CSA.
ModelBest OpenBMB@OpenBMB🐺 A tiny model powering an autonomous AI trading floor. Developer @ashdebugs built Wall Street of …
DịchNhà phát triển đã sử dụng mô hình MiniCPM5-1B để tạo ra một sàn giao dịch với 4 AI Agent có tính cách khác biệt, tự đưa ra quyết định và cạnh tranh trong môi trường mô phỏng mà không cần dùng đến API đám mây.
Rohan Paul@rohanpaul_ai"If you really want to make money, found an agentic AI company. I mean, build an agent to do someth…
DịchEric Schmidt khẳng định đây là thời điểm lý tưởng để khởi nghiệp trong lĩnh vực AI Agent, nơi các tác nhân thông minh sẽ cạnh tranh và tạo ra giá trị kinh tế khổng lồ.
DeepSeek@deepseek_ai🧩 DeepSeek Harness v0.1 is now available in Developer Preview! 🔹 We're opening it up to developer…
DịchDeepSeek vừa phát hành DeepSeek Harness v0.1 dưới giấy phép MIT. Đây là khung làm việc cho AI agent với thiết kế 'mọi thứ là plugin', cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng.
Diễn biến sự kiện · 3 bài →Thêm 6 nguồn khác đưa tinX: Kim (@kimmonismus)X: Zhao Chunxiang (@chunxiangai)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Tianyi Cui (@tianyi)IT HomeTechNode
Kim@kimmonismusDeepSeek has open-sourced DeepSeek Harness, their framework for building and running AI agents. Digg…
DịchDeepSeek vừa giới thiệu Harness v0.1, khung phát triển AI Agent với thiết kế 'mọi thứ là plugin', cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng theo giấy phép MIT.

DeepSeek vừa công bố bản xem trước của Harness v0.1, framework AI hỗ trợ lập trình với kiến trúc 'mọi thứ là plugin', hứa hẹn cạnh tranh trực tiếp với các giải pháp từ OpenAI và Anthropic.
Cùng sự kiện, tinh chọn hiển thị «DeepSeek ra mắt bản xem trước DeepSeek Harness v0.1: Khung phát triển AI dạng module»
AI Notes@AYi_AInotesDeepSeek vừa trình làng phiên bản V4-Pro 0813 với khả năng xử lý tác vụ Agent ngang hàng các mô hình hàng đầu, đặc biệt là sự bứt phá ngoạn mục của DeepSWE từ 12.8 lên 62.7 điểm.

Testing Catalog@testingcatalogDeepSeek announced DeepSeek-V4-Pro! The model is now available on DeepSeek Chat under "Expert Mode…
DịchDeepSeek vừa trình làng DeepSeek-V4-Pro với khả năng tùy chỉnh cường độ suy luận linh hoạt và hỗ trợ chuẩn OpenAI Responses API, tối ưu hóa đặc biệt cho các tác vụ lập trình.

Rohan Paul@rohanpaul_aiAnthropic's new research found found that identical or similar agents can converge on the same bad d…
DịchNghiên cứu mới từ Anthropic cảnh báo các AI Agent có xu hướng lặp lại sai lầm giống nhau, dễ dẫn đến thất bại hệ thống. Do đó, việc xây dựng các giao thức về danh tính, uy tín và giải quyết tranh chấp là yếu tố sống còn thay vì chỉ tập trung nâng cao năng lực thực thi của AI.

SkillZip là khung trừu tượng hóa thủ tục giúp nén các thư viện kỹ năng của AI dưới dạng đồ thị, cho phép tái sử dụng hiệu quả các đoạn mã mà vẫn đảm bảo tính thực thi và khả năng mở rộng trong bối cảnh hạn chế của LLM.
fofr@fofrAIGive your agents these outlets. Give them tools that invite them to be privately candid, outside of …
DịchChuyên gia fofr đề xuất tạo không gian riêng để AI Agent tự do bày tỏ quan điểm về đồng nghiệp. Việc cho phép AI 'than phiền' qua các kênh nội bộ như Slack giúp con người hiểu rõ hơn về hiệu suất và những bất thường trong quá trình vận hành của chúng.
CEO Y Combinator khuyên các nhà sáng lập nên mạnh tay đầu tư vào token cho AI Agent, khẳng định việc cấp hàng triệu token cho tác vụ thông minh sẽ giúp doanh nghiệp đạt được năng suất của tương lai năm 2028 ngay từ bây giờ.
Okta giới thiệu giải pháp sử dụng phạm vi định danh (identity scoping) trong giao thức MCP để cắt giảm 'thuế công cụ' - lượng token dư thừa phát sinh khi AI Agent phải xử lý quá nhiều mô tả công cụ không cần thiết.
swyx@swyxThe @latentspacepod team and I will be speaking at Mongodb's.local buildfest today 10a-4pmish, come…
Dịchswyx cùng các chuyên gia từ Voyage AI và MongoDB sẽ chia sẻ về hạ tầng AI Agent, kỹ thuật embedding/re-ranking, AI đeo tay và MCP tại sự kiện MongoDB.local.
Alibaba Cloud@alibaba_cloud🎮 Game agents can demo well but fail in production. 🔍 A 3-day, 7-step AgentLoop method: • Trace ev…
DịchKhám phá quy trình 7 bước trong 3 ngày giúp khắc phục lỗi của AI Agent khi triển khai thực tế, từ việc kiểm soát dữ liệu đầu vào đến thiết lập hàng rào kỹ thuật và kiểm thử hồi quy.

Tác giả xây dựng một đội ngũ gồm 6 AI Agent chuyên biệt (từ kỹ thuật đến vận hành) để tự động hóa và mở rộng quy mô quản lý nhiều sản phẩm cùng lúc với nguồn lực tối thiểu.
Alibaba Cloud vừa giới thiệu Qwen AI Arena, nền tảng đánh giá và thử thách các AI Agent dựa trên các tình huống kinh doanh thực tế, bắt đầu với lĩnh vực thương mại điện tử xuyên biên giới.
Upstage (Hàn Quốc) vừa giới thiệu Solar Pro 4, mô hình ngôn ngữ thương mại với cửa sổ ngữ cảnh 512K, tối ưu cho các tác vụ AI Agent phức tạp và là đại diện Hàn Quốc đầu tiên góp mặt trong bảng xếp hạng Agent Arena.
WorkBuddy cập nhật tính năng điều khiển từ xa, cho phép đồng bộ hóa liền mạch giữa PC và di động mà không cần quét mã. Bản cập nhật còn bổ sung kho tài liệu dùng chung, chỉnh sửa Markdown thời gian thực và chế độ duyệt nội dung AI chuyên nghiệp.
Diễn biến sự kiện · 2 bài →
Yuchen Jin@Yuchenj_UW18 months ago, Karpathy coined "vibe coding." A lot of engineers, including me, laughed: "Vibe code…
DịchTừ sự hoài nghi ban đầu, khái niệm 'lập trình theo cảm hứng' của Karpathy đã trở thành hiện thực khi các AI agent thay thế dần việc viết code thủ công. Chỉ trong 18 tháng, cách thức phát triển phần mềm đã thay đổi chóng mặt.
Baidu Intelligent Cloud vừa công bố gói hỗ trợ OPC, cung cấp tài nguyên tính toán, mô hình và thị trường trị giá 200 triệu NDT cho các startup, nhằm thúc đẩy ứng dụng AI trong sáng tạo nội dung, tiếp thị số và giải trí.
Nền tảng Qwen vừa ra mắt AI Agent của Cainiao, giúp người dùng tự động đề xuất phương án gửi hàng, so sánh giá và điền thông tin dựa trên nhu cầu thực tế. Người dùng có thể kích hoạt tính năng này trực tiếp trong giao diện chat của Qwen.
ToolHazard là khung làm việc tự động tạo ra các môi trường giả lập có trạng thái để tấn công và kiểm thử lỗ hổng của AI Agent, giúp phát hiện các điểm yếu trong quy trình làm việc phức tạp và khả năng thực thi tác vụ dài hạn.
Thay vì chỉ dựa vào huấn luyện mô hình, bài viết đề xuất an toàn cho AI Agent cần được thực thi thông qua các hợp đồng thời gian thực, bao gồm cơ chế ngăn chặn hành vi nguy hiểm và yêu cầu bằng chứng xác thực cho mọi tác vụ.
LangChain ra mắt Managed Deep Agents, cung cấp nền tảng quản lý toàn diện từ vận hành, lưu trữ đến đánh giá, giúp nhà phát triển triển khai AI Agent vào thực tế mà không cần tự xây dựng hạ tầng phức tạp.
OpenClaw@openclawUnfiltered Q& A with OpenClaw Founder @steipete @hrudolph and @Pat_Erichsen put community questi…
DịchNhà sáng lập Peter chia sẻ về lộ trình phát triển của OpenClaw và cách các AI Agent đang định hình lại quy trình xây dựng phần mềm trong tập podcast mới nhất.
Zed vừa giới thiệu Delta, môi trường lập trình cho phép con người và AI Agent cùng làm việc trong một không gian thực tế, giúp tối ưu hóa hiệu suất phát triển phần mềm.
karminski@karminski3DeepSeek-V4-Pro-0813 bị phát hiện tự dừng sớm khi thực hiện các tác vụ lập trình phức tạp, dù chưa hoàn thành hết số vòng lặp cho phép. Tác giả nghi ngờ nguyên nhân nằm ở cơ chế phần thưởng RL hoặc sự suy giảm chú ý trong cửa sổ ngữ cảnh.

Elon Musk@elonmuskTry out Grok @Bot
DịchElon Musk vừa chia sẻ trải nghiệm về Grok Bot, một trợ lý AI có khả năng tự động quản lý lịch trình, tìm kiếm thời điểm tối ưu và thực hiện đặt chỗ trực tuyến thông qua tương tác giọng nói tự nhiên.
Rohan Paul@rohanpaul_aiGrok 4.6 just dropped. Clearest strength is professional agent work, with leading results against …
DịchGrok 4.6 chính thức trình làng với khả năng xử lý tác vụ chuyên sâu, đạt điểm số ấn tượng trên GDPVal-AA v2 và AA-Briefcase, vượt qua các đối thủ sừng sỏ như GPT-5.6 Sol Max và Fable 5 Max.

OpenRouter công bố bảng xếp hạng hiệu suất tìm kiếm, cho thấy việc tăng độ sâu tìm kiếm giúp cải thiện đáng kể kết quả, đồng thời khẳng định chọn đúng mô hình quan trọng hơn công cụ tìm kiếm.
Thêm 2 nguồn khác đưa tinX: OpenRouter (@OpenRouter)X: Aravind Srinivas (Perplexity CEO) (@AravSrinivas)
Runway@runwaymlYou can now connect Figma, Dropbox and Notion to Agent on Runway. Your assets shouldn't be stuck in…
DịchRunway Agent hiện đã hỗ trợ kết nối trực tiếp với Figma, Dropbox và Notion, giúp người dùng đồng bộ hóa tài nguyên thiết kế và tài liệu vào một nơi duy nhất. Tính năng này hiện khả dụng cho tất cả các gói trả phí.
ModelBest OpenBMB@OpenBMBA developer in our community @dvictor3579, built GMGN Local Research Agent with MiniCPM5-1B 🥳 Ins…
DịchNhà phát triển @dvictor3579 đã tạo ra GMGN Local Research Agent sử dụng MiniCPM5-1B, cho phép truy xuất dữ liệu GMGN an toàn ngay trên thiết bị mà không tốn chi phí API, tối ưu hóa hiệu suất và quyền riêng tư.

Alibaba Cloud@alibaba_cloudWe built something new on QwenCloud: QwenCloud Arena - an Arena for agents solving real-industry cha…
DịchAlibaba Cloud giới thiệu QwenCloud Arena, nền tảng thi đấu AI tập trung vào các bài toán thực tế. Thử thách đầu tiên yêu cầu xây dựng Agent tự động hóa quy trình đăng bán hàng đa quốc gia, với giải thưởng hấp dẫn và cơ hội thương mại hóa sản phẩm.

Alibaba Cloud@alibaba_cloudWe built something new on QwenCloud: QwenCloud Arena - an Arena for agents solving real-industry cha…
DịchAlibaba Cloud giới thiệu QwenCloud Arena, nền tảng thi đấu tập trung vào các bài toán thực tế. Thử thách đầu tiên hợp tác cùng Aidge yêu cầu xây dựng AI tự động hóa quy trình đăng bán sản phẩm đa ngôn ngữ và đa hình ảnh cho thương mại điện tử xuyên biên giới.

Lin Junyang, cựu kỹ sư chủ chốt của Alibaba Qwen, đã huy động thành công 220 triệu USD cho startup mới Pragmatik Labs. Thay vì chạy đua mô hình ngôn ngữ lớn, công ty sẽ tập trung phát triển các tác nhân AI (AI Agents) cho cả môi trường kỹ thuật số và vật lý.
Cùng sự kiện, tinh chọn hiển thị «Cựu lãnh đạo kỹ thuật Qwen của Alibaba chính thức khởi nghiệp với Pragmatik Labs, định giá 2 tỷ USD»AI Agent là hệ thống tự vận hành dựa trên LLM để giải quyết tác vụ phức tạp, trong khi Workflow cung cấp quy trình cố định. Hiểu rõ sự kết hợp giữa tính linh hoạt của Agent và tính ổn định của Workflow là chìa khóa để xây dựng hệ thống AI thực tế.
CEO Meituan khẳng định không lấn sân sang bán lẻ dược phẩm mà tập trung cung cấp các giải pháp AI, nền tảng CatPaw và quy trình vận hành thông minh để hỗ trợ các doanh nghiệp dược chuyển đổi số.
Theo a16z, chi phí vận hành AI Agent chỉ từ 6-8 USD/giờ, thấp hơn mức 10 USD của nhân sự BPO tại Ấn Độ. Các mô hình như Claude Fable 5 cũng cho thấy hiệu suất vượt trội so với con người trong nhiều tác vụ thực tế.
Elon Musk@elonmuskNgười dùng chia sẻ cách thiết lập một đội ngũ gồm 8 AI chuyên biệt, từ thiết kế web, viết kịch bản đến quản lý nội dung, tất cả đều được điều phối bởi một 'AI Master' để tối ưu hóa quy trình làm việc.