Elon Musk@elonmuskGrok 4.6 được đánh giá ngang tầm Kimi K3 về hiệu suất xử lý
Grok 4.6 gây ấn tượng mạnh khi đạt hiệu suất tương đương Kimi K3 trong các tác vụ lập trình và modding, đồng thời tối ưu hóa tốc độ và tiêu thụ token hiệu quả hơn.
Elon Musk@elonmuskGrok 4.6 gây ấn tượng mạnh khi đạt hiệu suất tương đương Kimi K3 trong các tác vụ lập trình và modding, đồng thời tối ưu hóa tốc độ và tiêu thụ token hiệu quả hơn.
Eric Zakariasson@ericzakariassonhere are some interesting things from the ranking code (excluding the weight table) that grok bot fo…
DịchNgười dùng Eric Zakariasson đã sử dụng Grok để phân tích và phát hiện các chi tiết đáng chú ý trong mã nguồn xếp hạng, ngoại trừ bảng trọng số.
karminski@karminski3Chuyên gia đang chạy thử nghiệm với 100 triệu token để xác định nguyên nhân lỗi trên phiên bản DeepSeek-V4-Pro-0813, hứa hẹn sẽ sớm có video phân tích chuyên sâu.

Tibo@thsottiauxComputer history is here.
DịchChatGPT phiên bản desktop vừa bổ sung tính năng ghi nhớ hoạt động trên các ứng dụng và trang web, giúp cá nhân hóa trải nghiệm và giảm bớt thao tác giải thích cho người dùng.
Thêm 3 nguồn khác đưa tinIT HomeX: Rohan Paul (@rohanpaul_ai)X: Testing Catalog (@testingcatalog)
Boris Cherny@bchernyA weird experiment I've been trying the last few weeks is having Claude take over day-to-day mainten…
DịchBoris Cherny đã để Claude đảm nhận việc bảo trì ứng dụng, từ sửa lỗi đến dọn dẹp mã thừa. Kết quả là 388 PR được tạo ra trong vài tuần, với gần một nửa được hợp nhất thành công sau khi kiểm duyệt, cho thấy tiềm năng lớn của AI trong việc tự động hóa quy trình kỹ thuật.

Rohan Paul@rohanpaul_aiX just open sourced its ranking algorithm, under the Apache v2 license. This is the source code for…
DịchX vừa mở mã nguồn thuật toán xếp hạng dòng thời gian theo giấy phép Apache v2. Hệ thống này ưu tiên tương tác thực tế như thời gian xem và phản hồi thay vì chỉ đếm lượt thích, đồng thời áp dụng các bộ lọc chống spam và hỗ trợ tài khoản mới.

Josh Woodward@joshwoodward3.7 Flash: Fast, 50% cheaper, happened in ~3 weeks
DịchGemini 3.7 Flash chính thức trình làng với tốc độ xử lý nhanh hơn, thông minh hơn và mức giá giảm 50% đến cuối năm. Người dùng hiện đã có thể trải nghiệm mô hình này qua API, AI Studio và các nền tảng hỗ trợ.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Rohan Paul@rohanpaul_aiThe new Computer History in ChatGPT can now remember what you did on your Mac, without screenshots. …
DịchChatGPT cho macOS vừa bổ sung tính năng ghi lại các thao tác như click chuột, nhập liệu và phím tắt trên ứng dụng để tạo bộ nhớ thông minh. Dữ liệu được lưu cục bộ dưới dạng Markdown, tuy nhiên OpenAI cảnh báo người dùng về rủi ro bảo mật liên quan đến tấn công tiêm nhiễm (prompt injection).

cb_doge@cb_doge🚨 NEW GROK BUILD UPDATE 🚨 1.0.4 - 2026-08-13 Features: • New StopCancelled hook event now report…
DịchBản cập nhật Grok 1.0.4 mang đến khả năng quản lý tác vụ linh hoạt hơn, cho phép tùy chỉnh tìm kiếm web và cải thiện độ ổn định của hệ thống thông qua việc sửa lỗi treo phiên làm việc.

Kim@kimmonismus"A new timeline view gives you the ability to look back on your work and build skills from your freq…
DịchChatGPT trên desktop vừa bổ sung tính năng ghi lại hoạt động trên các ứng dụng và trình duyệt, giúp người dùng xem lại tiến trình công việc và cá nhân hóa trải nghiệm tương lai một cách thông minh hơn.
Bài viết giải thích hiện tượng AI tự tin đưa ra thông tin sai lệch, đồng thời hướng dẫn các kỹ thuật như RAG, tinh chỉnh mô hình và tối ưu hóa prompt để giảm thiểu rủi ro này cho nhà phát triển.
Deedy Das@deedydasThis article goes down as one of the most batshit insane things I've read in AI world. "We're back …
DịchMột báo cáo gây sốc tiết lộ mạng lưới kinh doanh xám tại Trung Quốc, nơi các 'trạm trung chuyển' buôn lậu token mô hình AI cao cấp, tráo đổi bằng mô hình rẻ tiền và khai thác dữ liệu người dùng để huấn luyện AI trái phép.

Rohan Paul@rohanpaul_aifrom a DeepSeek reddit channel after their dramatic price increase
DịchNgười dùng trên Reddit đang tranh luận sôi nổi về việc DeepSeek điều chỉnh tăng giá dịch vụ đáng kể, gây ra nhiều phản ứng trái chiều trong cộng đồng công nghệ.

Kim@kimmonismusA few days changed the entire game: - DeepSeek V4 Pro's cache-hit input price will rise from $0.003…
DịchDeepSeek V4 Pro bất ngờ tăng giá hơn 1.100% trong giờ cao điểm, trong khi Gemini 3.7 Flash giảm giá sâu và Grok 4.6 nổi lên như một đối thủ đáng gờm về hiệu năng trên chi phí.

PGE là mô hình end-to-end đột phá cho phép xác định đối tượng mà con người đang nhìn vào thông qua các câu lệnh văn bản hoặc hình ảnh linh hoạt, loại bỏ sự phụ thuộc vào các bước tiền xử lý phức tạp.
Noah Zweben@noahzwebenGreat research went into making Claude proactive. Our data is showing unprompted messages are down ~…
DịchClaude Tag cải thiện khả năng nhận diện ngữ cảnh, giúp giảm 45% các thông báo không cần thiết và cung cấp tính năng giám sát hoàn toàn miễn phí.
Ammaar Reshi@ammaarGemini 3.7 Flash is here 🔥 It's 50% cheaper than 3.6 Flash for the year, has made significant imp…
DịchGemini 3.7 Flash chính thức trình làng với mức giá rẻ hơn một nửa so với bản 3.6, đồng thời cải thiện mạnh mẽ khả năng tuân thủ chỉ dẫn, lập trình web và phát triển game.
cb_doge@cb_dogeGrok 4.6 wins again. 🏆 Grok 4.6 is #1 on micro1's Realm Tax benchmark with a 57.9% Best@3 score, b…
DịchGrok 4.6 vừa thiết lập cột mốc mới khi dẫn đầu bài kiểm tra Realm Tax (micro1) với điểm số Best@3 đạt 57.9%, vượt qua hàng loạt đối thủ sừng sỏ như Claude, GPT và Gemini.

Elon Musk@elonmuskGrok 4.6 của xAI vừa vượt qua Claude Opus 5 trên bảng xếp hạng RareBench với chi phí vận hành tối ưu hơn đáng kể. Trong khi đó, DeepSeek v4-pro-0813 và GLM5.2 gây thất vọng khi không đạt kỳ vọng trong các bài kiểm tra hiệu năng.
Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»Các ông lớn công nghệ đã ký cam kết tuân thủ quy định của EU về minh bạch AI, bắt đầu triển khai gắn watermark ẩn vào văn bản và siêu dữ liệu cho hình ảnh để nhận diện nội dung do máy tạo ra.
Artificial Analysis@ArtificialAnlysWe've just added $10 credit for any new sign ups to Optima for a limited time only. Try it out and l…
DịchOptima cho phép người dùng tạo các bài kiểm tra hiệu năng riêng biệt dựa trên dữ liệu thực tế, giúp so sánh tốc độ, chi phí và chất lượng giữa các mô hình AI hàng đầu để tìm ra giải pháp tối ưu nhất.
Artificial Analysis@ArtificialAnlysGoogle has released Gemini 3.7 Flash, improving 4 points over Gemini 3.6 Flash and reaching the Inte…
DịchGoogle vừa trình làng Gemini 3.7 Flash, đạt 56 điểm trên bảng xếp hạng Artificial Analysis. Phiên bản này thiết lập chuẩn mực mới khi cân bằng hoàn hảo giữa sức mạnh trí tuệ và tốc độ phản hồi siêu nhanh.

Mistral vừa phát hành phiên bản OCR 4.1 và cập nhật tài liệu hướng dẫn trên trang chủ. Dù các chi tiết kỹ thuật cụ thể chưa được công bố, bản cập nhật này đang thu hút sự chú ý lớn từ cộng đồng công nghệ.
Chỉ ba tuần sau bản 3.6, Google tung ra Gemini 3.7 Flash với khả năng lập trình vượt trội, đánh bại các đối thủ sừng sỏ như Claude Sonnet 5 và GPT-5.6 Terra trong khi giảm giá thành xuống một nửa.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Perplexity@perplexity_aiGrok 4.6 is now available in Perplexity and Perplexity Computer. On WANDR, it sits on the Pareto fr…
DịchGrok 4.6 đã chính thức có mặt trên Perplexity và Perplexity Computer. Mô hình này đạt hiệu suất vượt trội trên WANDR, mang lại kết quả tương đương Fable 5 với chi phí thấp hơn 40%.

cb_doge@cb_dogeSpaceXAI has reset usage limits to help everyone keep building during the Grok 4.6 launch. Here's h…
DịchSpaceXAI vừa thiết lập lại giới hạn sử dụng cho Grok 4.6, tạo điều kiện thuận lợi cho người dùng tiếp tục trải nghiệm và xây dựng ứng dụng trên nền tảng này.
Elon Musk@elonmuskTry Grok 4.6
DịchGrok 4.6 vừa thiết lập kỷ lục mới với 94,9% điểm số trên bài kiểm tra GPQA Diamond, vượt qua hàng loạt đối thủ sừng sỏ như GPT-5.6, Gemini 3.1 Pro và Claude Opus 5.
Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Aravind Srinivas (Perplexity CEO)@AravSrinivasCongrats to @SpaceXAI on one more amazing model: Grok 4.6. We benchmarked it as an orchestrator on o…
DịchPerplexity vừa tích hợp mô hình Grok 4.6 vào nền tảng của mình. Kết quả đánh giá cho thấy đây là lựa chọn tối ưu, mang lại hiệu suất vượt trội với chi phí hợp lý cho người dùng Pro và Max.
Phương pháp Latent Dynamics Reasoning (LDR) cải thiện độ chính xác vật lý cho mô hình video bằng cách tích hợp các quy luật chuyển động thay vì chỉ khớp pixel, giúp dự đoán các kịch bản ngoài phân phối tốt hơn.
Grok has reset usage limits to help everyone keep building during the Grok 4.6 launch. Here's how t…
DịchGrok vừa cập nhật phiên bản 4.6 và thực hiện reset hạn mức sử dụng cho người dùng. Bạn có thể kiểm tra hướng dẫn chi tiết để tiếp tục trải nghiệm các tính năng mới ngay bây giờ.
Cùng sự kiện, bài đại diện «Grok 4.6 chính thức ra mắt: Tặng gấp đôi giới hạn token trong 7 ngày»Google vừa công bố phiên bản Gemini 3.7 Flash trên nền tảng dành cho nhà phát triển. Thông tin này đang thu hút sự chú ý lớn từ cộng đồng công nghệ trên Hacker News.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»Code retrieval for coding agents has a new option on OpenRouter. Voyage Code 4 from Voyage AI by Mo…
DịchOpenRouter vừa bổ sung Voyage Code 4 từ Voyage AI, hỗ trợ các vector nhúng Matryoshka linh hoạt với nhiều tùy chọn chiều và định dạng lượng tử hóa, tối ưu hóa hiệu suất cho các tác nhân lập trình AI.
Testing Catalog@testingcatalogGOOGLE 🔥: Gemini 3.7 Flash is rolling out on Gemini Spark and comes with improved tool use when it …
DịchGoogle đưa Gemini 3.7 Flash vào nền tảng Spark, tối ưu hóa khả năng tương tác với các ứng dụng Google Workspace. Đây được xem là mô hình mạnh mẽ nhất hiện nay dành cho lập trình và các tác vụ tự động hóa.
Google Sheets giới thiệu tính năng Sheets canvas, cho phép người dùng sử dụng câu lệnh tự nhiên để chuyển đổi dữ liệu bảng tính thành các ứng dụng tương tác như bảng điều khiển, trình theo dõi học tập hay sơ đồ chỗ ngồi.
Google giới thiệu Gemini 3.7 Flash, bản nâng cấp thuật toán từ 3.6 Flash, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và đầu ra lên đến 64K token.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
cb_doge@cb_dogeGrok 4.6 wins again. 👑 Grok 4.6 takes the #1 spot on GPQA Diamond with a score of 94.9%, beating G…
DịchGrok 4.6 vừa thiết lập cột mốc mới với 94,9% điểm số trên GPQA Diamond, vượt qua hàng loạt đối thủ sừng sỏ như GPT-5.6, Gemini 3.1 Pro và Claude Opus 5 để dẫn đầu thị trường.
Demis Hassabis@demishassabisGemini 3.7 Flash brings major upgrades for software engineering, web dev & knowledge work. And i…
DịchGemini 3.7 Flash mang đến những cải tiến mạnh mẽ cho lập trình và xử lý tri thức, đồng thời giảm giá thành xuống còn 50% so với phiên bản 3.6 Flash tiền nhiệm.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»
Aidan McLaughlin@aidan_mclauexcited to join later!
DịchAidan McLaughlin sẽ livestream thảo luận về công việc nghiên cứu, cùng các chủ đề nổi bật như vòng gọi vốn 5 tỷ USD của Databricks, nghiên cứu tác tử của Anthropic và chiến lược giá của DeepSeek V4.
Sundar Pichai@sundarpichaiOur Flash models are workhorses that offer performance at a great price. So, we're shipping updates …
DịchChỉ 3 tuần sau bản 3.6, Google tung ra Gemini 3.7 Flash với khả năng lập trình và xử lý tác vụ thông minh vượt trội, đồng thời giảm 50% chi phí sử dụng cho người dùng.
Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.7 Flash: Bước tiến đột phá cho lập trình và tác vụ AI Agent»Video khám phá cách các mô hình AI thu thập, xử lý dữ liệu cá nhân và những rủi ro tiềm ẩn về quyền riêng tư mà người dùng thường bỏ qua trong kỷ nguyên số.