13/08

Thứ Năm · 45 tin
OpenRouter: Announcements
Hướng dẫnĐiểm AI 61/100

Hướng dẫn gọi công cụ trên OpenRouter: Viết code một lần, chạy đa mô hình chỉ với một dòng thay đổi

OpenRouter ra mắt hướng dẫn giúp lập trình viên sử dụng chung một cấu trúc code để gọi công cụ (tool calling) trên nhiều mô hình như Claude, GPT và các mô hình mã nguồn mở, chỉ cần thay đổi tên mô hình trong yêu cầu.

SemiAnalysis@SemiAnalysis_
Mô hìnhĐiểm AI 64/100

Cùng sự kiệnDeepSeek v4 Pro 1.5T ra mắt: Vượt xa Nemotron3 Ultra về hiệu suất

Congrats to @deepseek_ai for their release of DeepSeekv4 Pro 0813 1.5T🔥 It massively beats Nemotron…

DịchDeepSeek vừa trình làng phiên bản v4 Pro 1.5T với khả năng xử lý tác vụ thông minh vượt trội so với Nemotron3 Ultra, đồng thời bản Flash cũng tối ưu hóa hiệu năng đáng kể với số lượng tham số ít hơn nhiều.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 38/100

So sánh chi phí 26 mô hình LLM thương mại: Grok 4.6 dẫn đầu về hiệu năng trên giá thành

Blended cost per 1M tokens across 26 commercial LLMs, ordered low to high.

DịchPhân tích 26 LLM cho thấy Grok 4.6 đạt chỉ số thông minh 61 điểm, gần bằng Claude Fable 5 Max nhưng tiết kiệm tới 80-88% chi phí token, trở thành lựa chọn tối ưu nhất về kinh tế.

Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 62/100

Cùng sự kiệnGrok 4.6 dẫn đầu bảng xếp hạng AA-Briefcase với chi phí vận hành cực thấp

Grok 4.6 made large gains on AA-Briefcase, our agentic knowledge work benchmark and cost substantial…

DịchGrok 4.6 vừa đạt vị trí dẫn đầu trong bài kiểm tra năng lực tác vụ trí tuệ AA-Briefcase, sánh ngang với Claude Fable 5 nhưng có chi phí thực hiện chỉ 4,42 USD, thấp hơn đáng kể so với các đối thủ cạnh tranh.

Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Kim@kimmonismus
Hướng dẫnĐiểm AI 39/100

Cuộc chiến giá khốc liệt giữa Grok 4.6 và DeepSeek 4 Pro GA

One thing became very clear today: performance and, above all, price are becoming increasingly impor…

DịchGrok 4.6 và DeepSeek 4 Pro GA đang đẩy mạnh cuộc đua về hiệu năng và giá thành. Với mức giá chỉ từ $0.435/M token và hỗ trợ ngữ cảnh 1 triệu token, DeepSeek đang tạo áp lực lớn lên thị trường AI.

Thêm 1 nguồn khác đưa tinWeChat: Khazix
AK@_akhaliq
Nghiên cứuĐiểm AI 35/100

BDH-CQ: Đột phá học tập ngữ cảnh thông qua suy luận tiềm ẩn tuần hoàn

BDH-CQ In-Context Learning with Recurrent Latent Reasoning paper: https://huggingface.co/papers/26...

DịchNghiên cứu giới thiệu BDH-CQ, một phương pháp mới tối ưu hóa khả năng học tập ngữ cảnh (In-Context Learning) bằng cách áp dụng cơ chế suy luận tiềm ẩn tuần hoàn, giúp mô hình xử lý thông tin hiệu quả hơn.

cb_doge@cb_doge
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnGrok 4.6 soán ngôi đầu bảng ARI Bench, vượt mặt cả Claude và GPT

Grok 4.6 takes the #1 spot on ARI Bench - the benchmark for recursive AI improvement. 🥇 It signifi…

DịchGrok 4.6 vừa thiết lập cột mốc mới trên ARI Bench - thước đo khả năng tự cải tiến đệ quy của AI. Phiên bản này không chỉ bỏ xa người tiền nhiệm Grok 4.5 mà còn vượt qua các đối thủ sừng sỏ như Claude Opus 5 và GPT-5.6.

Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 31/100

Mô hình AI không thể sử dụng là vô giá trị: Tranh cãi về sự suy giảm năng lực

models that are not usable by humans are not useful i don't think it is constructive to say that "o…

DịchDex Horthy cho rằng các mô hình AI hiện nay chỉ có 'năng lực' chứ không có 'trí tuệ' thực sự, đồng thời chỉ trích việc các mô hình ngày càng khó sử dụng và có dấu hiệu suy giảm hiệu suất.

12/08

Thứ Tư · 28 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 39/100

Cùng sự kiệnRa mắt mô hình mã nguồn mở Qwen3.8-2.4T-A95B với 2,4 nghìn tỷ tham số

Alibaba vừa phát hành Qwen3.8-2.4T-A95B, mô hình mã nguồn mở khổng lồ với 2,4 nghìn tỷ tham số tổng và 95 tỷ tham số kích hoạt, hiện đã có mặt trên Hugging Face.

Cùng sự kiện, bài đại diện «Qwen3.8-27B sắp ra mắt: Đếm ngược đến thế hệ mô hình mới từ Alibaba»
X.PIN@thexpin
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Bài viết cung cấp cái nhìn tổng quan về các kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
IT Home
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnAlibaba công bố mã nguồn mở Qwen3.8-2.4T-A95B: Mô hình MoE 2.4 nghìn tỷ tham số, hỗ trợ ngữ cảnh 256K

Alibaba chính thức mở mã nguồn mô hình Qwen-Max với 2.4 nghìn tỷ tham số, kích hoạt 95 tỷ tham số mỗi token và hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token.

Cùng sự kiện, tinh chọn hiển thị «Alibaba ra mắt mô hình mã nguồn mở Qwen3.8-2.4T-A95B, SiliconFlow hỗ trợ ngay lập tức»
Yuchen Jin@Yuchenj_UW
Mô hìnhĐiểm AI 50/100

Qwen3.8-Max chính thức lộ diện: Mô hình 2.4 nghìn tỷ tham số với 95 tỷ tham số kích hoạt

Qwen3.8-Max weights just dropped on Hugging Face! 2.4T total parameters, with 95B activated. A goo…

DịchAlibaba vừa phát hành trọng số của Qwen3.8-Max trên Hugging Face. Với quy mô khổng lồ 2.4 nghìn tỷ tham số, đây là bước tiến lớn tiếp theo cho cộng đồng AI mã nguồn mở.

Thêm 1 nguồn khác đưa tinX: Qwen (@Alibaba_Qwen)
X.PIN@thexpin
Mô hìnhĐiểm AI 59/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt: So sánh hiệu năng với bản thử nghiệm

JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…

DịchDeepSeek vừa trình làng phiên bản V4 Pro. Hãy cùng điểm qua những kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.

Cùng sự kiện, bài đại diện «DeepSeek chính thức ra mắt phiên bản V4 Pro»
Elon Musk@elonmusk
Hướng dẫnĐiểm AI 34/100

Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA

Grok 4.6 reaches 1753 ELO

DịchMô hình Grok 4.6 vừa thiết lập cột mốc ấn tượng với 1753 điểm ELO, vươn lên vị trí dẫn đầu trên bảng xếp hạng GDPVal-AA.

Thêm 3 nguồn khác đưa tinX: cb_doge (@cb_doge)X: MiniMax (@MiniMax_AI)X: Artificial Analysis (@ArtificialAnlys)
cb_doge@cb_doge
Mô hìnhĐiểm AI 52/100

Cùng sự kiệnGrok 4.6 chính thức ra mắt: Thiết lập hàng loạt kỷ lục mới trên các bảng xếp hạng AI

Grok 4.6 is a massive upgrade 🚀 It beats Grok 4.5 High across every benchmark listed and now ranks…

DịchGrok 4.6 mang đến bước tiến lớn khi vượt qua phiên bản tiền nhiệm ở mọi bài kiểm tra, đồng thời đạt điểm số ngang bằng với GPT-5.6 Sol Max trên bảng xếp hạng Artificial Analysis. Người dùng hiện đã có thể trải nghiệm mô hình này thông qua Cursor và Grok Build.

Cùng sự kiện, tinh chọn hiển thị «Grok 4.6 chính thức ra mắt: Thông minh, tốc độ vượt trội và tối ưu chi phí»
cb_doge@cb_doge
Hướng dẫnĐiểm AI 39/100

Cùng sự kiệnGrok 4.6 chính thức soán ngôi đầu bảng xếp hạng GDPVal-AA

BREAKING: Grok 4.6 takes the #1 spot on the GDPVal-AA benchmark 🏆 • Grok 4.6 - 1, 753 Elo • Fable 5…

DịchGrok 4.6 vừa thiết lập cột mốc mới khi dẫn đầu bảng xếp hạng GDPVal-AA với 1.753 điểm Elo, vượt qua các đối thủ mạnh như Fable 5 Max và GPT-5.6 Sol Max.

Cùng sự kiện, bài đại diện «Grok 4.6 chính thức dẫn đầu bảng xếp hạng GDPVal-AA»
Kim@kimmonismus
Mô hìnhĐiểm AI 49/100

Cùng sự kiệnDeepSeek V4 Pro chính thức ra mắt, API Grok 4.6 bất ngờ lộ diện

DeepSeek v4 Pro GA is rolling out! Grok 4.6 API spotted as well! Really excited! After the most rec…

DịchDeepSeek V4 Pro đã chính thức phát hành cùng với sự xuất hiện của API Grok 4.6. Đây là bước tiến lớn tiếp theo sau phiên bản Flash, hứa hẹn mang đến nhiều cải tiến mạnh mẽ cho cộng đồng AI.

Cùng sự kiện, bài đại diện «DeepSeek bất ngờ ra mắt phiên bản chính thức V4 Pro: Hiệu năng ngang ngửa các model hàng đầu»
JiQiZhiXin
Nghiên cứuĐiểm AI 95/100

Tinh chọnChấn động giới AI: Nghiên cứu 116 trang tiết lộ cách 'trích xuất' tư duy ẩn của Claude và GPT

Một nghiên cứu mới chỉ ra lỗ hổng bảo mật nghiêm trọng trên các API mô hình lớn, cho phép kẻ xấu trích xuất toàn bộ chuỗi tư duy (reasoning traces) vốn được các hãng như OpenAI hay Anthropic mã hóa để bảo mật.


Vì sao đáng đọc: Đây là phát hiện bảo mật quan trọng ảnh hưởng trực tiếp đến các mô hình AI hàng đầu, có giá trị chuyên môn cao và đang thu hút sự quan tâm lớn từ cộng đồng công nghệ.
Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 29/100

Viết sách giáo khoa AI: Liệu các mô hình ngôn ngữ có đang 'bất lực'?

My latest piece is a little verbose, but I think it is really a nice example digging into a sort of …

DịchTác giả Nathan Lambert chia sẻ trải nghiệm thực tế khi viết sách giáo khoa về AI, qua đó chỉ ra rằng các mô hình hiện nay vẫn chưa đủ khả năng để thay thế con người trong việc tổng hợp và trình bày kiến thức chuyên sâu.

Nathan Lambert@natolambert
Hướng dẫnĐiểm AI 52/100

Nathan Lambert cảnh báo: Năng lực viết văn bản dài của AI đang chững lại

A few years ago, when I started my AI textbook, I would've guessed AI models would've maybe made it …

DịchSau khi tự viết sách giáo khoa AI, Nathan Lambert nhận thấy các mô hình hiện nay vẫn gặp khó khăn trong việc viết và tổ chức tư duy cho các nội dung kỹ thuật dài. Ông lo ngại điều này sẽ cản trở tiềm năng của AI trong việc thúc đẩy nghiên cứu khoa học mở.

Nathan Lambert: Interconnects
Hướng dẫnĐiểm AI 62/100

Tinh chọnTôi đã viết một cuốn sách giáo khoa về AI: Liệu AI còn bao lâu nữa mới có thể viết lách tốt hơn?

Tác giả nhận thấy dù AI đã đạt trình độ siêu việt trong lập trình và toán học, khả năng viết văn bản dài và phi hư cấu vẫn dậm chân tại chỗ, gây cản trở việc tự chủ giải quyết các vấn đề khoa học phức tạp.


Vì sao đáng đọc: Góc nhìn thực tế từ người trong cuộc về giới hạn của LLM hiện tại, giúp độc giả có cái nhìn khách quan hơn về sự phát triển của AI thay vì chỉ chạy theo các con số kỹ thuật.
Deedy Das@deedydas
Hướng dẫnĐiểm AI 41/100

Tấn công truy vết suy luận mã hóa không ảnh hưởng đến mô hình Fable

Objectively one of the coolest papers in LLM jailbreak world but most people didn't read the actual …

DịchChuyên gia Deedy Das làm rõ rằng các cuộc tấn công khai thác lỗ hổng API để trích xuất suy luận ẩn không hiệu quả với mô hình Fable, bác bỏ các tuyên bố trước đó về việc giải mã quá trình chưng cất mô hình này.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 56/100

LLM thực sự giỏi loại toán nào?

Dù OpenAI đã giải được nhiều bài toán hóc búa, LLM vẫn mạnh về tìm phản ví dụ hơn là chứng minh lý thuyết. Bài viết phân tích lý do tại sao mô hình ngôn ngữ lại có ưu thế đặc biệt trong việc phát hiện các trường hợp ngoại lệ này.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Power Law Graph Attention: Bước tiến mới thay thế cơ chế Scaled Dot-Product Attention truyền thống

Nghiên cứu giới thiệu Power Law Graph Attention (PLGA), một cơ chế chú ý mới thay thế tích vô hướng truyền thống bằng toán tử song tuyến tính học được, giúp tối ưu hóa khả năng biểu diễn và suy luận của các mô hình ngôn ngữ lớn.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 39/100

llama.cpp: Giải pháp mã nguồn mở đưa AI tiên tiến chạy hoàn toàn trên máy tính cá nhân

llama.cpp cho phép chạy các mô hình AI mạnh mẽ ngay trên thiết bị cá nhân mà không cần API hay kết nối internet, đảm bảo quyền riêng tư tuyệt đối. Công cụ này tối ưu hóa hiệu suất trên nhiều loại phần cứng, hỗ trợ các model mới nhất như Qwen 3.6 và Gemma 4.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Decoding-Level Taboo: Kiểm tra khả năng chịu tải của LLM bằng phương pháp can thiệp logit

Nghiên cứu giới thiệu bài kiểm tra 'Taboo' giúp đánh giá độ bền của LLM bằng cách ép mô hình đi chệch khỏi lộ trình tạo văn bản thông thường, từ đó bộc lộ những hạn chế thực tế mà các bài benchmark truyền thống thường bỏ qua.

LangChain: Blog
Hướng dẫnĐiểm AI 54/100

Giải mã LangChain: AI Agent là gì và cách vận hành?

AI Agent là hệ thống tự vận hành dựa trên LLM để giải quyết tác vụ phức tạp, trong khi Workflow cung cấp quy trình cố định. Hiểu rõ sự kết hợp giữa tính linh hoạt của Agent và tính ổn định của Workflow là chìa khóa để xây dựng hệ thống AI thực tế.

Alibaba Cloud@alibaba_cloud
Hướng dẫnĐiểm AI 34/100

Model Studio ra mắt tính năng bộ nhớ đệm ngữ cảnh giúp tối ưu chi phí API

You're paying for the same tokens twice. Every API call reloads the same context: system prompts, do…

DịchTính năng bộ nhớ đệm ngữ cảnh (Context Caching) mới trên Model Studio giúp bạn tránh việc phải trả phí lặp lại cho các dữ liệu đầu vào cố định như system prompt hay tài liệu, từ đó tiết kiệm đáng kể chi phí sử dụng API.

Tổng 40 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (45 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “llm” — Trang 32 | AIHOT.vn