13/08

Thứ Năm · 45 tin
AK@_akhaliq
Nghiên cứuĐiểm AI 35/100

BDH-CQ: Đột phá học tập ngữ cảnh thông qua suy luận tiềm ẩn tuần hoàn

BDH-CQ In-Context Learning with Recurrent Latent Reasoning paper: https://huggingface.co/papers/26...

DịchNghiên cứu giới thiệu BDH-CQ, một phương pháp mới tối ưu hóa khả năng học tập ngữ cảnh (In-Context Learning) bằng cách áp dụng cơ chế suy luận tiềm ẩn tuần hoàn, giúp mô hình xử lý thông tin hiệu quả hơn.

cb_doge@cb_doge
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnGrok 4.6 soán ngôi đầu bảng ARI Bench, vượt mặt cả Claude và GPT

Grok 4.6 takes the #1 spot on ARI Bench - the benchmark for recursive AI improvement. 🥇 It signifi…

DịchGrok 4.6 vừa thiết lập cột mốc mới trên ARI Bench - thước đo khả năng tự cải tiến đệ quy của AI. Phiên bản này không chỉ bỏ xa người tiền nhiệm Grok 4.5 mà còn vượt qua các đối thủ sừng sỏ như Claude Opus 5 và GPT-5.6.

Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 31/100

Mô hình AI không thể sử dụng là vô giá trị: Tranh cãi về sự suy giảm năng lực

models that are not usable by humans are not useful i don't think it is constructive to say that "o…

DịchDex Horthy cho rằng các mô hình AI hiện nay chỉ có 'năng lực' chứ không có 'trí tuệ' thực sự, đồng thời chỉ trích việc các mô hình ngày càng khó sử dụng và có dấu hiệu suy giảm hiệu suất.

12/08

Thứ Tư · 37 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 39/100

Cùng sự kiệnRa mắt mô hình mã nguồn mở Qwen3.8-2.4T-A95B với 2,4 nghìn tỷ tham số

Alibaba vừa phát hành Qwen3.8-2.4T-A95B, mô hình mã nguồn mở khổng lồ với 2,4 nghìn tỷ tham số tổng và 95 tỷ tham số kích hoạt, hiện đã có mặt trên Hugging Face.

Cùng sự kiện, bài đại diện «Qwen3.8-27B sắp ra mắt: Đếm ngược đến thế hệ mô hình mới từ Alibaba»
X.PIN@thexpin
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Bài viết cung cấp cái nhìn tổng quan về các kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
IT Home
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnAlibaba công bố mã nguồn mở Qwen3.8-2.4T-A95B: Mô hình MoE 2.4 nghìn tỷ tham số, hỗ trợ ngữ cảnh 256K

Alibaba chính thức mở mã nguồn mô hình Qwen-Max với 2.4 nghìn tỷ tham số, kích hoạt 95 tỷ tham số mỗi token và hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt mô hình mã nguồn mở Qwen3.8-2.4T-A95B, SiliconFlow hỗ trợ ngay lập tức»
Yuchen Jin@Yuchenj_UW
Mô hìnhĐiểm AI 50/100

Qwen3.8-Max chính thức lộ diện: Mô hình 2.4 nghìn tỷ tham số với 95 tỷ tham số kích hoạt

Qwen3.8-Max weights just dropped on Hugging Face! 2.4T total parameters, with 95B activated. A goo…

DịchAlibaba vừa phát hành trọng số của Qwen3.8-Max trên Hugging Face. Với quy mô khổng lồ 2.4 nghìn tỷ tham số, đây là bước tiến lớn tiếp theo cho cộng đồng AI mã nguồn mở.

Thêm 1 nguồn khác đưa tinX: Qwen (@Alibaba_Qwen)
X.PIN@thexpin
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Hãy cùng điểm qua những kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Elon Musk@elonmusk
Hướng dẫnĐiểm AI 34/100

Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA

Grok 4.6 reaches 1753 ELO

DịchMô hình Grok 4.6 vừa thiết lập cột mốc ấn tượng với 1753 điểm ELO, vươn lên vị trí dẫn đầu trên bảng xếp hạng GDPVal-AA.

Thêm 3 nguồn khác đưa tinX: cb_doge (@cb_doge)X: MiniMax (@MiniMax_AI)X: Artificial Analysis (@ArtificialAnlys)
cb_doge@cb_doge
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnGrok 4.6 chính thức ra mắt: Thiết lập hàng loạt kỷ lục mới trên các bảng xếp hạng AI

Grok 4.6 is a massive upgrade 🚀 It beats Grok 4.5 High across every benchmark listed and now ranks…

DịchGrok 4.6 mang đến bước tiến lớn khi vượt qua phiên bản tiền nhiệm ở mọi bài kiểm tra, đồng thời đạt điểm số ngang bằng với GPT-5.6 Sol Max trên bảng xếp hạng Artificial Analysis. Người dùng hiện đã có thể trải nghiệm mô hình này thông qua Cursor và Grok Build.

Cùng sự kiện, tinh chọn hiển thị «Grok 4.6 chính thức ra mắt: Thông minh, tốc độ vượt trội và tối ưu chi phí»
cb_doge@cb_doge
Hướng dẫnĐiểm AI 39/100

Cùng sự kiệnGrok 4.6 chính thức soán ngôi đầu bảng xếp hạng GDPVal-AA

BREAKING: Grok 4.6 takes the #1 spot on the GDPVal-AA benchmark 🏆 • Grok 4.6 - 1, 753 Elo • Fable 5…

DịchGrok 4.6 vừa thiết lập cột mốc mới khi dẫn đầu bảng xếp hạng GDPVal-AA với 1.753 điểm Elo, vượt qua các đối thủ mạnh như Fable 5 Max và GPT-5.6 Sol Max.

Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Kim@kimmonismus
Mô hìnhĐiểm AI 49/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt, API Grok 4.6 bất ngờ lộ diện

DeepSeek v4 Pro GA is rolling out! Grok 4.6 API spotted as well! Really excited! After the most rec…

DịchDeepSeek V4 Pro đã chính thức phát hành cùng với sự xuất hiện của API Grok 4.6. Đây là bước tiến lớn tiếp theo sau phiên bản Flash, hứa hẹn mang đến nhiều cải tiến mạnh mẽ cho cộng đồng AI.

Cùng sự kiện, bài đại diện «DeepSeek bất ngờ ra mắt phiên bản chính thức V4 Pro: Hiệu năng ngang ngửa các model hàng đầu»
JiQiZhiXin
Nghiên cứuĐiểm AI 95/100

Tinh chọnChấn động giới AI: Nghiên cứu 116 trang tiết lộ cách 'trích xuất' tư duy ẩn của Claude và GPT

Một nghiên cứu mới chỉ ra lỗ hổng bảo mật nghiêm trọng trên các API mô hình lớn, cho phép kẻ xấu trích xuất toàn bộ chuỗi tư duy (reasoning traces) vốn được các hãng như OpenAI hay Anthropic mã hóa để bảo mật.


Vì sao đáng đọc: Đây là phát hiện bảo mật quan trọng ảnh hưởng trực tiếp đến các mô hình AI hàng đầu, có giá trị chuyên môn cao và đang thu hút sự quan tâm lớn từ cộng đồng công nghệ.
Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 29/100

Viết sách giáo khoa AI: Liệu các mô hình ngôn ngữ có đang 'bất lực'?

My latest piece is a little verbose, but I think it is really a nice example digging into a sort of …

DịchTác giả Nathan Lambert chia sẻ trải nghiệm thực tế khi viết sách giáo khoa về AI, qua đó chỉ ra rằng các mô hình hiện nay vẫn chưa đủ khả năng để thay thế con người trong việc tổng hợp và trình bày kiến thức chuyên sâu.

Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 52/100

Nathan Lambert cảnh báo: Năng lực viết văn bản dài của AI đang chững lại

A few years ago, when I started my AI textbook, I would've guessed AI models would've maybe made it …

DịchSau khi tự viết sách giáo khoa AI, Nathan Lambert nhận thấy các mô hình hiện nay vẫn gặp khó khăn trong việc viết và tổ chức tư duy cho các nội dung kỹ thuật dài. Ông lo ngại điều này sẽ cản trở tiềm năng của AI trong việc thúc đẩy nghiên cứu khoa học mở.

Nathan Lambert: Interconnects
Hướng dẫnĐiểm AI 62/100

Tinh chọnTôi đã viết một cuốn sách giáo khoa về AI: Liệu AI còn bao lâu nữa mới có thể viết lách tốt hơn?

Tác giả nhận thấy dù AI đã đạt trình độ siêu việt trong lập trình và toán học, khả năng viết văn bản dài và phi hư cấu vẫn dậm chân tại chỗ, gây cản trở việc tự chủ giải quyết các vấn đề khoa học phức tạp.


Vì sao đáng đọc: Góc nhìn thực tế từ người trong cuộc về giới hạn của LLM hiện tại, giúp độc giả có cái nhìn khách quan hơn về sự phát triển của AI thay vì chỉ chạy theo các con số kỹ thuật.
Deedy Das@deedydas
Hướng dẫnĐiểm AI 41/100

Tấn công truy vết suy luận mã hóa không ảnh hưởng đến mô hình Fable

Objectively one of the coolest papers in LLM jailbreak world but most people didn't read the actual …

DịchChuyên gia Deedy Das làm rõ rằng các cuộc tấn công khai thác lỗ hổng API để trích xuất suy luận ẩn không hiệu quả với mô hình Fable, bác bỏ các tuyên bố trước đó về việc giải mã quá trình chưng cất mô hình này.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 56/100

LLM thực sự giỏi loại toán nào?

Dù OpenAI đã giải được nhiều bài toán hóc búa, LLM vẫn mạnh về tìm phản ví dụ hơn là chứng minh lý thuyết. Bài viết phân tích lý do tại sao mô hình ngôn ngữ lại có ưu thế đặc biệt trong việc phát hiện các trường hợp ngoại lệ này.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Power Law Graph Attention: Bước tiến mới thay thế cơ chế Scaled Dot-Product Attention truyền thống

Nghiên cứu giới thiệu Power Law Graph Attention (PLGA), một cơ chế chú ý mới thay thế tích vô hướng truyền thống bằng toán tử song tuyến tính học được, giúp tối ưu hóa khả năng biểu diễn và suy luận của các mô hình ngôn ngữ lớn.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 39/100

llama.cpp: Giải pháp mã nguồn mở đưa AI tiên tiến chạy hoàn toàn trên máy tính cá nhân

llama.cpp cho phép chạy các mô hình AI mạnh mẽ ngay trên thiết bị cá nhân mà không cần API hay kết nối internet, đảm bảo quyền riêng tư tuyệt đối. Công cụ này tối ưu hóa hiệu suất trên nhiều loại phần cứng, hỗ trợ các model mới nhất như Qwen 3.6 và Gemma 4.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Decoding-Level Taboo: Kiểm tra khả năng chịu tải của LLM bằng phương pháp can thiệp logit

Nghiên cứu giới thiệu bài kiểm tra 'Taboo' giúp đánh giá độ bền của LLM bằng cách ép mô hình đi chệch khỏi lộ trình tạo văn bản thông thường, từ đó bộc lộ những hạn chế thực tế mà các bài benchmark truyền thống thường bỏ qua.

LangChain: Blog
Hướng dẫnĐiểm AI 54/100

Giải mã LangChain: AI Agent là gì và cách vận hành?

AI Agent là hệ thống tự vận hành dựa trên LLM để giải quyết tác vụ phức tạp, trong khi Workflow cung cấp quy trình cố định. Hiểu rõ sự kết hợp giữa tính linh hoạt của Agent và tính ổn định của Workflow là chìa khóa để xây dựng hệ thống AI thực tế.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 34/100

Model Studio ra mắt tính năng bộ nhớ đệm ngữ cảnh giúp tối ưu chi phí API

You're paying for the same tokens twice. Every API call reloads the same context: system prompts, do…

DịchTính năng bộ nhớ đệm ngữ cảnh (Context Caching) mới trên Model Studio giúp bạn tránh việc phải trả phí lặp lại cho các dữ liệu đầu vào cố định như system prompt hay tài liệu, từ đó tiết kiệm đáng kể chi phí sử dụng API.

Simon Willison Blog
Nghiên cứuĐiểm AI 56/100

Lỗ hổng bảo mật: Đánh cắp chuỗi suy luận từ API của các mô hình LLM hàng đầu

Các nhà nghiên cứu phát hiện lỗ hổng cho phép giải mã và đánh cắp các chuỗi suy luận ẩn của Anthropic, OpenAI và Google thông qua việc phát lại dữ liệu. Dù đã được các nhà cung cấp khắc phục, đây là cảnh báo quan trọng về bảo mật dữ liệu trong các mô hình AI suy luận.

Diễn biến sự kiện · 4 bài →
Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 31/100

Oumi ra mắt nền tảng giúp LLM tự học liên tục từ dữ liệu thực tế

Oumi has introduced a new development platform that allows LLMs to keep learning from their own prod…

DịchOumi giới thiệu nền tảng cho phép LLM tự đánh giá, tổng hợp dữ liệu và tự huấn luyện từ chính lưu lượng truy cập thực tế. Giải pháp này giúp doanh nghiệp xây dựng trí tuệ nhân tạo độc quyền, tạo lợi thế cạnh tranh thay vì phụ thuộc vào các mô hình dùng chung.

Boris Cherny@bcherny
Hướng dẫnĐiểm AI 62/100

Lỗi code từ AI đã thay đổi: Kiểm thử đối kháng là 'vũ khí' mới

LLMs still produce bugs, but those bugs are different than what they used to be. It's less off-by-on…

DịchChuyên gia Boris Cherny nhận định lỗi từ LLM đã chuyển từ cú pháp cơ bản sang các vấn đề hệ thống phức tạp. Sử dụng kỹ thuật kiểm thử đối kháng (adversarial review) là cách hiệu quả nhất để phát hiện các lỗ hổng này.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (48 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “LLM” — Trang 32 | AIHOT.vn