14/08

Thứ Sáu · 38 tin
Nathan Lambert@natolambert
Mô hìnhĐiểm AI 39/100

Cùng sự kiệnGoogle ra mắt Gemini 3.7 Flash: Bước tiến vượt bậc cho lập trình và AI Agent

Good on Google for shipping this. Looks like a solid model, and the only way past the haters is thro…

DịchGoogle vừa trình làng Gemini 3.7 Flash với hiệu suất lập trình và tự động hóa tăng vọt, đồng thời có mức giá cực kỳ cạnh tranh chỉ bằng một nửa so với phiên bản tiền nhiệm.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Cursor Blog
Sản phẩmĐiểm AI 65/100

Tinh chọnCursor ra mắt tính năng Builds: Tăng tốc khởi động AI Agent lên gấp 3 lần

Cursor vừa giới thiệu tính năng Builds giúp duy trì sẵn môi trường phát triển ở chế độ nền, cho phép AI Agent khởi động tức thì mà không cần thiết lập lại từ đầu, giúp tăng tốc độ phản hồi lên gấp 3 lần.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng cải thiện đáng kể trải nghiệm người dùng cho công cụ lập trình AI phổ biến nhất hiện nay, có tính ứng dụng thực tế cao.
OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)
Hướng dẫnĐiểm AI 80/100

Tinh chọnHướng dẫn xây dựng với GPT-5.6: Đạt hiệu suất AI Agent đỉnh cao với chi phí tối ưu

Dòng mô hình GPT-5.6 mang đến khả năng suy luận bền bỉ và điều phối đa tác nhân, giúp tăng vọt điểm số trên ARC-AGI-3 trong khi giảm 6 lần lượng token đầu ra. Đặc biệt, mô hình Luna đạt hiệu suất tương đương GPT-5.5 nhưng với chi phí rẻ hơn đáng kể.

Thêm 1 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)

Vì sao đáng đọc: Thay đổi quan trọng nhất nằm ở các nguyên hàm API, giúp cùng một mô hình đạt điểm số cao gấp ba lần trên ARC-AGI-3 với lượng token đầu ra chỉ bằng 1/6, thay đổi hoàn toàn cách lập trình viên tối ưu chi phí suy luận và kiến trúc ngữ cảnh.
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Harness-IF: Phương pháp định lượng mức độ tuân thủ quy tắc của AI Agent

If you write rules in an AGENTS.md, this one is worth your time. When a coding agent follows your r…

DịchHarness-IF đánh giá khả năng tuân thủ các quy tắc trong AGENTS.md của AI Agent bằng cách loại bỏ các yếu tố ngẫu nhiên. Kết quả cho thấy độ chính xác thực tế thấp hơn dự đoán, đồng thời khẳng định hệ thống và chỉ dẫn người dùng luôn được ưu tiên hơn mô tả công cụ.

Google AI@GoogleAI
Mô hìnhĐiểm AI 72/100

Cùng sự kiệnGoogle ra mắt Gemini 3.7 Flash: Bước tiến mới cho lập trình và tác vụ AI Agent

Our most intelligent workhorse model yet for coding and agents has arrived ⚡ Meet Gemini 3.7 Flash. …

DịchGoogle giới thiệu Gemini 3.7 Flash, mô hình chuyên dụng cho lập trình và tự động hóa tác vụ phức tạp trên hệ sinh thái Google Workspace. Người dùng hiện có thể trải nghiệm qua tính năng Spark với mức giá ưu đãi giảm 50% đến cuối năm.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Google AI for Developers@googleaidevs
Mô hìnhĐiểm AI 66/100

Cùng sự kiệnGoogle ra mắt Gemini 3.7 Flash: Tối ưu cho lập trình và tác vụ AI Agent

As our most intelligent workhorse model yet for coding and agents, Gemini 3.7 Flash brings higher in…

DịchGoogle giới thiệu Gemini 3.7 Flash, mô hình hiệu năng cao tập trung vào khả năng lập trình và thực thi tác vụ tự động. Phiên bản này cải thiện đáng kể độ chính xác của mã nguồn và khả năng điều khiển AI Agent trong các dự án phức tạp.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Google DeepMind: Blog
Mô hìnhĐiểm AI 72/100

Tinh chọnGoogle DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent

Chỉ ba tuần sau bản 3.6, Google giới thiệu Gemini 3.7 Flash với hiệu suất lập trình vượt trội và chi phí sử dụng giảm một nửa, tối ưu hóa mạnh mẽ cho các hệ thống AI tự hành.

Diễn biến sự kiện · 17 bài →Thêm 28 nguồn khác đưa tinX: Google AI (@GoogleAI)X: Gemini (@GeminiApp)CafeF Kinh tế sốLatent SpaceThanh Niên Chuyển đổi sốIT HomeX: opencode (@opencode)X: Josh Woodward (@joshwoodward, Google Labs VP)X: Rohan Paul (@rohanpaul_ai)X: Ammaar Reshi (@ammaar)X: fofr (@fofrAI)X: Artificial Analysis (@ArtificialAnlys)The Decoder: AI NewsX: Nathan Lambert (@natolambert)X: Hongming (@hongming731)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Kim (@kimmonismus)MarkTechPostX: Google AI for Developers (@googleaidevs)X: Aravind Srinivas (Perplexity CEO) (@AravSrinivas)X: Demis Hassabis (@demishassabis)X: Testing Catalog (@testingcatalog)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Sundar Pichai (@sundarpichai)X: Logan Kilpatrick (@OfficialLoganK)GenK AIX: Google DeepMind (@GoogleDeepMind)Ars Technica: AI

Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ Google với cải tiến lớn về hiệu năng và giá thành, tác động trực tiếp đến cộng đồng lập trình viên và phát triển ứng dụng AI.
Gemini@GeminiApp
Sản phẩmĐiểm AI 38/100

Gemini Spark nâng cấp lên mô hình Gemini 3.7 Flash

Gemini Spark now runs on Gemini 3.7 Flash.⚡️ Whether you're using Spark to compile vendors into She…

DịchGemini Spark nay đã tích hợp Gemini 3.7 Flash, giúp cải thiện khả năng gọi công cụ trong Google Workspace để xử lý dữ liệu và soạn thảo email chính xác, hiệu quả hơn.

13/08

Thứ Năm · 16 tin
The Decoder: AI News
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnDeepSeek ra mắt bản nâng cấp V4-Pro, mở mã nguồn phần mềm AI Agent và tăng giá API

DeepSeek chính thức đưa V4-Pro ra khỏi giai đoạn thử nghiệm với hiệu suất vượt trội trên các bài kiểm tra kỹ thuật, đồng thời công bố mở mã nguồn phần mềm AI Agent và điều chỉnh tăng giá API.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Nghiên cứu mới từ Microsoft: Thư viện kỹ năng 'rác' đang làm suy yếu AI Agent như thế nào?

Very interesting new paper from Microsoft and colleagues. (bookmark it) Skill libraries are used i…

DịchNghiên cứu của Microsoft chỉ ra rằng các kỹ năng không cần thiết trong thư viện khiến AI Agent dễ mắc lỗi hoặc giảm hiệu suất do quá trình xác thực dư thừa và quy trình thực thi phức tạp.

Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 38/100

Cùng sự kiệnDeepSeek ra mắt bản xem trước DeepSeek Harness v0.1: Khung làm việc cho AI Agent

Recommended to check out. It's a good start to see that DeepSeek Harness focuses on making everyth…

DịchDeepSeek Harness v0.1 là khung làm việc cho AI Agent mã nguồn mở theo giấy phép MIT, nổi bật với thiết kế dạng module "mọi thứ là plugin", cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng.

Cùng sự kiện, bài đại diện «DeepSeek ra mắt Harness v0.1: Khung làm việc Agent cấp sản xuất»
ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 38/100

MiniCPM5-1B: Khi các AI Agent 'đấu trí' trên sàn giao dịch chứng khoán ảo

🐺 A tiny model powering an autonomous AI trading floor. Developer @ashdebugs built Wall Street of …

DịchNhà phát triển đã sử dụng mô hình MiniCPM5-1B để tạo ra một sàn giao dịch với 4 AI Agent có tính cách khác biệt, tự đưa ra quyết định và cạnh tranh trong môi trường mô phỏng mà không cần dùng đến API đám mây.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 35/100

Cựu CEO Google Eric Schmidt: Kỷ nguyên AI Agent là cơ hội vàng để làm giàu

"If you really want to make money, found an agentic AI company. I mean, build an agent to do someth…

DịchEric Schmidt khẳng định đây là thời điểm lý tưởng để khởi nghiệp trong lĩnh vực AI Agent, nơi các tác nhân thông minh sẽ cạnh tranh và tạo ra giá trị kinh tế khổng lồ.

DeepSeek@deepseek_ai
Sản phẩmĐiểm AI 66/100

Tinh chọnDeepSeek Harness v0.1: Ra mắt bản xem trước dành cho nhà phát triển

🧩 DeepSeek Harness v0.1 is now available in Developer Preview! 🔹 We’re opening it up to developer...

DịchDeepSeek Harness v0.1 chính thức ra mắt dưới dạng mã nguồn mở MIT. Đây là khung làm việc cho AI Agent với thiết kế "mọi thứ là plugin", cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng.

Diễn biến sự kiện · 3 bài →Thêm 6 nguồn khác đưa tinX: Kim (@kimmonismus)X: Zhao Chunxiang (@chunxiangai)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Tianyi Cui (@tianyi)IT HomeTechNode

Vì sao đáng đọc: Thiết kế dạng plugin giúp tách biệt mô hình, công cụ và hội thoại thành các đơn vị độc lập. Điều này cho phép nhà phát triển chọn lọc từng thành phần thay vì phụ thuộc vào một khung làm việc cố định, giảm chi phí chuyển đổi.
Kim@kimmonismus
Sản phẩmĐiểm AI 38/100

Cùng sự kiệnDeepSeek ra mắt Harness v0.1: Khung phát triển AI Agent dạng module linh hoạt

DeepSeek has open-sourced DeepSeek Harness, their framework for building and running AI agents. Digg…

DịchDeepSeek vừa giới thiệu Harness v0.1, khung phát triển AI Agent với thiết kế 'mọi thứ là plugin', cho phép tùy biến linh hoạt từ mô hình, công cụ đến giao diện người dùng theo giấy phép MIT.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek Harness v0.1: Ra mắt bản xem trước dành cho nhà phát triển»
IT Home
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnDeepSeek ra mắt Harness: Framework lập trình AI mã nguồn mở, thách thức Claude Cowork

DeepSeek vừa công bố bản xem trước của Harness v0.1, framework AI hỗ trợ lập trình với kiến trúc 'mọi thứ là plugin', hứa hẹn cạnh tranh trực tiếp với các giải pháp từ OpenAI và Anthropic.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek Harness v0.1: Ra mắt bản xem trước dành cho nhà phát triển»
AI Notes@AYi_AInotes
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnDeepSeek-V4-Pro ra mắt: Hiệu năng đỉnh cao với chi phí vận hành cực thấp

DeepSeek vừa trình làng phiên bản V4-Pro 0813 với khả năng xử lý tác vụ Agent ngang hàng các mô hình hàng đầu, đặc biệt là sự bứt phá ngoạn mục của DeepSWE từ 12.8 lên 62.7 điểm.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnDeepSeek-V4-Pro ra mắt: Nâng cấp mạnh mẽ cho tác vụ Agent

DeepSeek announced DeepSeek-V4-Pro! The model is now available on DeepSeek Chat under "Expert Mode…

DịchDeepSeek vừa trình làng DeepSeek-V4-Pro với khả năng tùy chỉnh cường độ suy luận linh hoạt và hỗ trợ chuẩn OpenAI Responses API, tối ưu hóa đặc biệt cho các tác vụ lập trình.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Nghiên cứu của Anthropic: AI Agent cần cơ chế quản trị để tránh rủi ro hệ thống

Anthropic's new research found found that identical or similar agents can converge on the same bad d…

DịchNghiên cứu mới từ Anthropic cảnh báo các AI Agent có xu hướng lặp lại sai lầm giống nhau, dễ dẫn đến thất bại hệ thống. Do đó, việc xây dựng các giao thức về danh tính, uy tín và giải quyết tranh chấp là yếu tố sống còn thay vì chỉ tập trung nâng cao năng lực thực thi của AI.

fofr@fofrAI
Hướng dẫnĐiểm AI 32/100

Xây dựng 'kênh xả stress' cho AI Agent: Một thử nghiệm thú vị

Give your agents these outlets. Give them tools that invite them to be privately candid, outside of …

DịchChuyên gia fofr đề xuất tạo không gian riêng để AI Agent tự do bày tỏ quan điểm về đồng nghiệp. Việc cho phép AI 'than phiền' qua các kênh nội bộ như Slack giúp con người hiểu rõ hơn về hiệu suất và những bất thường trong quá trình vận hành của chúng.

Tổng 27 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (51 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI Agent” — Trang 39 | AIHOT.vn