16/09

Thứ Tư · 21 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
NgànhĐiểm AI 29/100

Jev: Mô hình AI mới hứa hẹn rẻ hơn 40-400 lần và nhanh hơn 20-200 lần

Typesafe.ai vừa ra mắt Jev, một mô hình AI đột phá với hiệu suất vượt trội về tốc độ và chi phí. Tuy nhiên, các thông số kỹ thuật chi tiết vẫn chưa được công bố, gây ra nhiều tranh luận trong cộng đồng công nghệ.

Emad Mostaque@EMostaque
NgànhĐiểm AI 23/100

Emad Mostaque: Chất lượng dữ liệu quyết định sự phát triển của mô hình AI

You are what you eat and AI models especially so https://x.com/EMostaque/status/2099580512675262512...

DịchCũng giống như con người 'ăn gì thì người nấy', các mô hình AI cũng phụ thuộc hoàn toàn vào chất lượng dữ liệu đầu vào để hình thành trí tuệ.

Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 67/100

Cùng sự kiệnGoogle ra mắt bộ đôi mô hình âm thanh Gemini 3.8 Live và Extended Thinking

GOOGLE 🔥: Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking are rolling out on APIs, Google AI …

DịchGoogle vừa trình làng Gemini 3.8 Live cùng phiên bản Extended Thinking, hỗ trợ xử lý âm thanh chuyên sâu và hiện đã có mặt trên API, Google AI Studio và ứng dụng Gemini Live.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói»
Google AI@GoogleAI
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Live và 3.8 Live Extended Thinking: Bước tiến mới cho mô hình âm thanh

Introducing our most advanced Gemini Audio models yet 🗣 Gemini 3.8 Live and 3.8 Live Extended Thin…

DịchGoogle vừa giới thiệu Gemini 3.8 Live và 3.8 Live Extended Thinking, những mô hình âm thanh tiên tiến nhất của hãng với khả năng xử lý tư duy mở rộng.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt Gemini 3.8 Live và bản Extended Thinking: Đột phá mới cho trợ lý giọng nói»

15/09

Thứ Ba · 15 tin
Testing Catalog@testingcatalog
NgànhĐiểm AI 39/100

OpenAI hé lộ kế hoạch ra mắt dòng mô hình GPT-6

OPENAI 🔥: A big "ship" week has been declared, teasing new models from GPT-6 family. > GPT-6 Sol …

DịchOpenAI vừa thông báo về một tuần lễ công bố lớn, trong đó hé lộ sự xuất hiện của dòng GPT-6, bao gồm phiên bản GPT-6 Sol. Tuy nhiên, tiến độ phát triển thế hệ mới này đang được điều chỉnh chậm lại, khiến thời điểm ra mắt chính thức vào tháng 9 vẫn còn là một ẩn số.

Thêm 1 nguồn khác đưa tinX: Haider (@haider1)
Testing Catalog@testingcatalog
NgànhĐiểm AI 40/100

Điểm tin AI: Rò rỉ về Gemini 3.8, Grok 4.8 và cuộc tranh luận về tốc độ phát triển AI

DAILY AI BRIEF 🗞 - Sept 15 MODEL FORECAST 🔥: - Today? Gemini 3.8 Live and Live Extended Thinking…

DịchThông tin rò rỉ cho thấy Gemini 3.8 đang được chuẩn bị, trong khi Grok 4.8 với 2,5 nghìn tỷ tham số đang bước vào giai đoạn huấn luyện cuối cùng trên nền tảng C++ mới.

IT Home
Mô hìnhĐiểm AI 61/100

Cùng sự kiệnStepStar ra mắt dòng mô hình âm thanh StepAudio 3: Đa năng từ Realtime đến tạo nhạc

StepStar vừa trình làng bộ 5 mô hình StepAudio 3 bao gồm Realtime, ASR, TTS, Gen và Music, hiện đã chính thức có mặt trên nền tảng mở của hãng.

Cùng sự kiện, tinh chọn hiển thị «StepAI ra mắt dòng mô hình âm thanh StepAudio 3: Thống trị bảng xếp hạng toàn cầu của Artificial Analysis»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 45/100

RSIAgent: Bước tiến mới trong tự cải tiến đệ quy thông qua bộ nhớ tự chủ

RSIAgent là khung đa tác tử không cần huấn luyện, giúp AI tự khám phá môi trường và xây dựng bộ nhớ dùng chung để tối ưu hóa hiệu suất. Phương pháp này giúp các mô hình mã nguồn mở như Kimi và GLM vượt qua cả những mô hình đóng hàng đầu hiện nay.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnRealtime-Venus: Hệ thống tương tác song công thời gian thực với cơ chế ủy quyền bất đồng bộ

Realtime-Venus là hệ thống tương tác đa phương thức sử dụng mô hình 9B, cho phép duy trì hội thoại liên tục trong khi thực hiện các tác vụ phức tạp ở chế độ nền nhờ cơ chế ủy quyền bất đồng bộ.

Thêm 1 nguồn khác đưa tinAnt Group inclusionAI: GitHub kho mã mới

Vì sao đáng đọc: Bước tiến quan trọng trong việc tối ưu hóa trải nghiệm hội thoại thời gian thực, giải quyết được bài toán xử lý đa nhiệm mà không làm gián đoạn tương tác của người dùng.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnZGCM-1: Mô hình nền tảng 7B mã nguồn mở tối ưu cho toán học và tìm kiếm tác tử

ZGCM-1 là mô hình 7B đột phá, kết hợp tư duy nội tại với công cụ bên ngoài để vượt qua giới hạn dung lượng tham số. Với kiến trúc FP8 và quy trình huấn luyện hiệu quả, mô hình hỗ trợ ngữ cảnh 256K, cho phép tác tử tự vận hành và tối ưu hóa dữ liệu.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng về tối ưu hóa mô hình nhỏ (7B) để đạt hiệu suất cao thông qua tư duy tác tử và kiến trúc hiện đại, rất có giá trị cho cộng đồng AI.
Alibaba Cloud@alibaba_cloud
NgànhĐiểm AI 42/100

Cùng sự kiệnDeepSeek-V4.1-Flash chính thức có mặt trên Alibaba Cloud

DeepSeek-V4.1-Flash is now on Alibaba Cloud Token Plan. Built for agentic workloads with a 1M-token …

DịchDeepSeek-V4.1-Flash đã cập bến Alibaba Cloud với gói Token Plan, tối ưu cho tác vụ AI Agent nhờ cửa sổ ngữ cảnh 1M token, tốc độ suy luận nhanh và thông lượng cao với giá từ 6 USD/tháng.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh»
karminski@karminski3
NgànhĐiểm AI 41/100

Tranh cãi việc các hãng AI dùng bản 'Max' để chạy điểm benchmark nhưng khuyên người dùng dùng bản 'High'

Người dùng chỉ trích các hãng AI vì dùng cấu hình 'Max' để đạt điểm cao trên bảng xếp hạng, nhưng lại khuyến nghị người dùng phổ thông sử dụng cấu hình 'High' vì hiệu năng thực tế tốt hơn, cho thấy sự thiếu hụt trong quá trình hậu huấn luyện.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Tối ưu hóa dự báo sự kiện: Kết hợp mô hình ngôn ngữ và dữ liệu thực tế thông qua cơ chế Competence-Gated Pooling

Nghiên cứu giới thiệu cơ chế 'cổng năng lực' giúp đánh giá và kết hợp thông minh các dự báo từ mô hình ngôn ngữ với dữ liệu thị trường sẵn có, giúp cải thiện đáng kể độ chính xác của các dự báo sự kiện thực tế.

Yuchen Jin@Yuchenj_UW
NgànhĐiểm AI 23/100

Từ bỏ Claude Code để chọn Codex: Kimi K3 vẫn là 'vua' lập trình

It's been 23 days since I last opened Claude Code. It used to be one of my favorite products, but I…

DịchSau 23 ngày trải nghiệm, người dùng chuyển từ Claude Code sang Codex vì khả năng tương thích với mô hình nguồn mở tốt hơn. Trong đó, Kimi K3 được đánh giá là mô hình vượt trội nhất hiện nay cho các tác vụ lập trình.

14/09

Thứ Hai · 14 tin
Haider@haider1
NgànhĐiểm AI 29/100

Grok 5 với 5 nghìn tỷ tham số: Bước tiến mới hướng tới AGI?

Grok 5 will be AGI and it is supposed to be a 5T-parameter model or larger. yes i'm skeptical of E…

DịchTin đồn về việc Grok 5 sở hữu 5 nghìn tỷ tham số đang làm dấy lên kỳ vọng về AGI. Dù lịch trình của Elon Musk thường gây hoài nghi, nhưng hiệu suất ấn tượng của các phiên bản Grok hiện tại và sự tích hợp với Cursor cho thấy tiềm năng phát triển mạnh mẽ của hệ sinh thái này.

Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 44/100

Cùng sự kiệnAnt Group ra mắt Qwen3.5-2B-singprobe: Công cụ giám sát an toàn AI thời gian thực

Ant Group giới thiệu Qwen3.5-2B-singprobe, một mô hình giám sát an toàn tận dụng trạng thái ẩn của Qwen3.5 để phát hiện ý đồ xấu, nội dung độc hại và ảo tưởng với chi phí tính toán cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt Qwen3.5-9B-singprobe: Công cụ giám sát an toàn AI siêu nhẹ»
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 44/100

Cùng sự kiệnAnt Group ra mắt Step-3.7-Flash-singprobe: Công cụ giám sát an toàn AI siêu nhẹ

Ant Group giới thiệu Step-3.7-Flash-singprobe, một bộ dò an toàn chỉ 8.13M tham số giúp phát hiện ý định độc hại và ảo tưởng của AI theo thời gian thực với chi phí vận hành cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt SingProbe: Công cụ giám sát an toàn AI siêu nhẹ cho mô hình GPT-OSS»
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 45/100

Cùng sự kiệnAnt Group ra mắt Qwen3.6-27B-singprobe: Công cụ kiểm soát an toàn AI hiệu suất cao

Ant Group vừa phát hành Qwen3.6-27B-singprobe trên HuggingFace, một mô hình dò tìm an toàn theo thời gian thực giúp đánh giá từng token với chi phí giải mã cực thấp, dưới 0,5%.

Cùng sự kiện, bài đại diện «Ant Group ra mắt SingProbe: Công cụ kiểm soát an toàn AI hiệu năng cao dựa trên Qwen3.6»
Ant Group inclusionAI: HuggingFace mô hình mới
NgànhĐiểm AI 43/100

Cùng sự kiệnAnt Group ra mắt Qwen3-0.6B-singprobe: Công cụ giám sát an toàn AI thời gian thực

Ant Group giới thiệu mô hình Qwen3-0.6B-singprobe, tận dụng trạng thái ẩn của mô hình nền để phát hiện rủi ro an toàn và ảo tưởng theo từng token với chi phí vận hành cực thấp.

Cùng sự kiện, bài đại diện «Ant Group ra mắt Qwen3.5-9B-singprobe: Công cụ giám sát an toàn AI siêu nhẹ»
Hacker News: AI bài nổi bật
NgànhĐiểm AI 38/100

Cùng sự kiệnOpenAI hoãn phát hành mô hình GPT-2 đầy đủ vì lo ngại bị lạm dụng

Dù đạt hiệu suất đột phá với 1,5 tỷ tham số, OpenAI quyết định chỉ công bố phiên bản rút gọn của GPT-2 nhằm ngăn chặn các rủi ro tiềm ẩn từ việc lạm dụng AI.

Cùng sự kiện, bài đại diện «OpenAI chính thức mở API cho mô hình giọng nói GPT-Live-1»
Haider@haider1
NgànhĐiểm AI 28/100

Haider: AGI không còn là giấc mơ xa vời

6 months ago, i thought AGI was still many versions away models like opus 4.6 and 5.6 sol were good…

DịchVới sự xuất hiện của các mô hình tiên tiến như Astra, Mythos và khả năng giải toán phức tạp của OpenAI, Haider tin rằng chúng ta đang tiến rất gần đến AGI, ngay cả khi tốc độ mở rộng quy mô hiện tại chững lại.

13/09

Chủ Nhật · 4 tin
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnChi phí suy luận giảm 96%, hiệu năng vượt trội: Khi mô hình nhỏ biết tự 'cầu cứu' AI lớn

Pyromind giới thiệu PyroDash, giải pháp cho phép các mô hình nhỏ tự quyết định thời điểm cần gọi mô hình lớn hỗ trợ. Cách tiếp cận này giúp cắt giảm chi phí vận hành tới 96% mà vẫn duy trì, thậm chí cải thiện độ chính xác so với việc chỉ dùng mô hình lớn.


Vì sao đáng đọc: Đây là bước tiến thực tế giải quyết bài toán chi phí đắt đỏ trong AI, có tính ứng dụng cao cho doanh nghiệp và lập trình viên, đồng thời phương pháp tiếp cận rất thông minh.
Haider@haider1
NgànhĐiểm AI 31/100

Giải mã hệ thống phân cấp tên gọi các mô hình OpenAI

i'm pretty clear on how openai's model tiers are shaping up now, especially after Astra: astra = fa…

DịchTác giả phân tích sự tương đồng giữa các dòng mô hình OpenAI và Anthropic, cho rằng các tên gọi như Astra, Sol, Terra, Luna đại diện cho một hệ thống phân cấp năng lực mới thay vì chỉ là tên gọi riêng lẻ.

Haider@haider1
NgànhĐiểm AI 27/100

Google và tin đồn về RSI: Tốc độ phát hành chóng mặt và những ẩn số

i don't believe the rumor that Google has reached RSI but their release pace has been really fast, …

DịchDù tính xác thực của tin đồn về RSI tại Google vẫn còn gây tranh cãi, nhưng tốc độ ra mắt sản phẩm dồn dập gần đây cho thấy Google đang đẩy mạnh nghiên cứu nội bộ, nơi các mô hình bí mật thường vượt xa những gì công chúng được tiếp cận.

12/09

Thứ Bảy · 4 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnDeepSeek V4.1 Flash: 'Phép màu' công nghệ khiến bản Pro phải dè chừng

DeepSeek V4.1 Flash gây sốt khi vượt mặt bản Pro về hiệu suất dù có tham số nhỏ hơn, nhờ những đột phá trong tối ưu hóa KV cache và chi phí vận hành cực thấp.


Vì sao đáng đọc: Tin tức nóng hổi về mô hình AI đang dẫn đầu xu hướng, phân tích kỹ thuật sâu sắc và có tác động lớn đến thị trường API, rất đáng để cộng đồng công nghệ quan tâm.
Latent Space
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnDeepSeek v4.1-Flash: Kiến trúc Encoder-Decoder đột phá đánh dấu sự trở lại đầy ấn tượng

DeepSeek ra mắt kiến trúc 763B tham số mới tích hợp thị giác máy tính, một bước tiến mạnh mẽ khiến giới chuyên gia cho rằng đây xứng đáng là phiên bản v5.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh»
Baseten Blog kỹ thuật (Web)
Mô hìnhĐiểm AI 70/100

Đã có đại diệnDeepSeek ra mắt V4.1-Flash: Kiến trúc CED tối ưu chi phí xử lý cho AI lập trình

DeepSeek vừa phát hành mã nguồn mở V4.1-Flash với kiến trúc CED giúp giảm đáng kể chi phí prefill. Mô hình 552B tham số này hỗ trợ cửa sổ ngữ cảnh 1 triệu token và khả năng xử lý đa phương thức văn bản - hình ảnh.

Cùng sự kiện, tinh chọn hiển thị «DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (61 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Mô hình ngôn ngữ” — Trang 5 | AIHOT.vn