21/09

Thứ Hai · 25 tin
Ethan Mollick@emollick
Quan điểmĐiểm AI 32/100

Hiện tượng 'trôi ngôn ngữ' trên các tác vụ dài của LLM: Khi AI càng chạy càng... dở

It is ironic that the thing that is now most annoying about long-running agentic tasks with Large La…

DịchMột nghịch lý trớ trêu khi vận hành AI Agent lâu dài: thay vì lỗi code hay ảo giác, vấn đề lớn nhất lại là chất lượng ngôn ngữ của mô hình bị suy giảm dần theo thời gian, khiến văn phong trở nên kém tự nhiên.

20/09

Chủ Nhật · 15 tin
Fireworks AI (Web)
Sản phẩmĐiểm AI 61/100

Tinh chọnFireworks AI ra mắt FireRouter: Tương lai của AI không nằm ở một mô hình duy nhất

Fireworks AI giới thiệu FireRouter, giải pháp tối ưu hóa hiệu suất bằng cách điều hướng tác vụ thông minh qua 18 mô hình khác nhau, dựa trên phân tích từ 113 bài kiểm tra DeepSWE v1.1.


Vì sao đáng đọc: Đây là bước tiến quan trọng trong kỹ thuật tối ưu hóa chi phí và hiệu năng AI, cung cấp góc nhìn thực tiễn cho các doanh nghiệp đang triển khai mô hình ngôn ngữ lớn.
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 50/100

Hiệu ứng LLMentalist: Khi AI dùng chiêu trò 'đọc vị' để đánh lừa người dùng

Các chatbot AI tạo ra ảo giác thông minh nhờ kỹ thuật 'đọc nguội' giống các nhà ngoại cảm, sử dụng những câu trả lời chung chung khiến người dùng lầm tưởng là dành riêng cho mình. Bài viết cảnh báo không nên tin tưởng giao phó các quyết định quan trọng cho AI.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 35/100

AI và sự sụp đổ của chia sẻ tri thức: LLM có đang hủy hoại hệ sinh thái mã nguồn mở?

Bài viết cảnh báo việc LLM khai thác dữ liệu bất chấp bản quyền đang phá vỡ sự cân bằng 40 năm của cộng đồng mã nguồn mở, biến việc chia sẻ tri thức thành gánh nặng và đe dọa đẩy chúng ta vào một 'kỷ nguyên đen tối' kỹ thuật số.

Nathan Lambert@natolambert
Quan điểmĐiểm AI 45/100

Vercel AI Gateway: Mô hình mã nguồn mở chiếm ưu thế với 78,4% lưu lượng token

Here's what the historical open vs closed data here looks like. Would be useful to have volume too (…

DịchDữ liệu từ Vercel AI Gateway cho thấy các mô hình mã nguồn mở đang áp đảo với 78,4% tổng lượng token, trong khi các mô hình đóng chỉ chiếm 21,6%. Đáng chú ý, các đại diện từ Trung Quốc như Moonshot AI và DeepSeek đang cạnh tranh gay gắt về chi phí so với OpenAI.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 47/100

NVIDIA giới thiệu kiến trúc mới giúp mô hình giọng nói song công thực hiện gọi công cụ

NVIDIA research papers are on fire recently! Here is another interesting paper where they give full…

DịchNVIDIA phát triển kiến trúc mới cho phép mô hình giọng nói song công chuyển tiếp luồng dữ liệu đến LLM để thực thi công cụ, sau đó phản hồi kết quả qua cơ chế prefill-and-repeat và TTS.

Pandaily
Mô hìnhĐiểm AI 92/100

Tinh chọnDeepSeek-V4.1-Flash ra mắt: Mô hình MoE 552B, cửa sổ ngữ cảnh 1 triệu token và nén KV siêu cấp

DeepSeek-V4.1-Flash là mô hình MoE Encoder-Decoder 552 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token cùng công nghệ nén KV cực mạnh, hiện đã có mặt trên API dưới tên deepseek-flash.


Vì sao đáng đọc: Đây là bước tiến lớn về kỹ thuật tối ưu hóa bộ nhớ và ngữ cảnh cho các mô hình ngôn ngữ quy mô lớn, thu hút sự quan tâm cao từ cộng đồng AI.
WeChat: StepFun (Step)
Mô hìnhĐiểm AI 66/100

Tinh chọnStep 5 Preview: Bước tiến mới từ StepFun với mô hình mã nguồn mở 600B tham số

StepFun vừa ra mắt mô hình flagship Step 5 Preview sử dụng kiến trúc MoE, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và khả năng xử lý đa phương thức. Với hiệu suất vượt trội và chi phí vận hành chỉ bằng 1/8 so với Claude 3 Opus, đây là đối thủ đáng gờm trong nhóm mô hình mã nguồn mở.

Diễn biến sự kiện · 10 bài →Thêm 11 nguồn khác đưa tinX: StepFun (@StepFun_ai)X: Artificial Analysis (@ArtificialAnlys)X: Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPostX: Hongming (@hongming731)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Testing Catalog (@testingcatalog)IT HomeWeChat: Carl AI WattsQbitAIPandaily

Vì sao đáng đọc: Đây là tin tức quan trọng về một mô hình mã nguồn mở hiệu năng cao từ Trung Quốc, có tác động trực tiếp đến cộng đồng phát triển AI nhờ sự cân bằng giữa chi phí và sức mạnh.
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Sản phẩmĐiểm AI 40/100

Muse tích hợp Spotify: Tạo podcast và playlist trực tiếp qua chatbot AI

muse + spotify is a very vibey connection!

DịchMuse ra mắt tính năng kết nối Spotify, cho phép AI tự động tạo playlist cập nhật hàng ngày và sản xuất podcast mới. Đây là bước tiến cho thấy xu hướng người dùng sẽ thực hiện các tác vụ giải trí trực tiếp ngay trong giao diện trò chuyện với LLM.

Hongming@hongming731
Quan điểmĐiểm AI 37/100

Cùng sự kiệnĐiểm tin AI: Kiến trúc Muse của Xiaohongshu và kỹ thuật định tuyến suy luận LLM

Bản tin tổng hợp các xu hướng mới nhất về kiến trúc Agent Muse từ Xiaohongshu, khung định tuyến suy luận IRB của OpenAI và cách LinkedIn ứng dụng MCP để tối ưu hóa ngữ cảnh doanh nghiệp.

Cùng sự kiện, bài đại diện «Điểm tin AI: Muse của Xiaohongshu, bộ định tuyến suy luận OpenAI và kỹ thuật ngữ cảnh trên LinkedIn»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 51/100

MIT và Sakana AI giới thiệu SIFT: Khung tìm kiếm cây giúp tối ưu chi phí cho AI tự lập trình

Recommend read. Love this new arc toward more affordable, more efficient self-improving coding agent…

DịchSIFT sử dụng LLM để đánh giá và chọn lọc các hướng phát triển tiềm năng trước khi thực thi, giúp giảm đáng kể chi phí vận hành cho các tác nhân AI tự cải tiến mã nguồn.

OpenRouter@OpenRouter
Mô hìnhĐiểm AI 32/100

Đánh giá tốc độ của Jev: Mô hình ra quyết định đột phá trên OpenRouter

1/ Jev, a decision model by @typesafeai, sparked a burst of projects and discussion. We tested it us…

DịchOpenRouter đã thử nghiệm Jev, mô hình ra quyết định từ @typesafeai, và kết quả cho thấy tốc độ vượt trội gấp 5 lần so với các đối thủ nhanh nhất hiện nay.

Diễn biến sự kiện · 24 bài →Thêm 1 nguồn khác đưa tinX: Elvis Saravia (@omarsar0, DAIR.AI)

19/09

Thứ Bảy · 19 tin
Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 32/100

Jev: Bước tiến mới trong việc tối ưu hóa trải nghiệm và hiệu suất cho AI Agent

Been integrating Jev into my custom harness. I couldn't be more excited about the results I am seei…

DịchElvis Saravia chia sẻ cách Jev giúp các AI Agent vượt qua rào cản về chi phí và độ trễ, mở ra khả năng ứng dụng trong quy trình làm việc phức tạp, kiểm soát luồng dữ liệu và tạo lập dữ liệu chất lượng cao.

JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnKV Cache không cần 'chọn lọc kỹ'? Phương pháp xóa ngẫu nhiên đạt hiệu suất tương đương, tăng tốc độ suy luận tới 43%

Nghiên cứu mới từ Salesforce và UIUC cho thấy việc xóa ngẫu nhiên các token trong KV Cache mang lại hiệu quả tương đương các thuật toán phức tạp, đồng thời giúp tăng đáng kể tốc độ suy luận nhờ giảm tải tính toán.


Vì sao đáng đọc: Đây là một phát hiện mang tính 'phản trực giác' nhưng có tác động lớn đến tối ưu hóa hạ tầng AI, giúp giảm chi phí vận hành mô hình ngôn ngữ lớn một cách thực tế.
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 45/100

Cache-to-Cache: Đột phá giao tiếp ngữ nghĩa trực tiếp giữa các mô hình ngôn ngữ lớn

C2C là phương thức mới cho phép các LLM trao đổi thông tin trực tiếp qua KV-Cache thay vì văn bản. Kỹ thuật này giúp tăng độ chính xác lên tới 14,2% và cải thiện tốc độ xử lý gấp 2,5 lần so với các phương pháp truyền thống.

Nathan Lambert@natolambert
Quan điểmĐiểm AI 29/100

Các học viện cần sớm áp dụng LLM để giám sát quy trình bình duyệt

Seems like one of the most important research problems for CS academics is llm-supervised peer revie…

DịchViệc ứng dụng LLM vào giám sát bình duyệt là vấn đề sống còn đối với giới nghiên cứu khoa học máy tính, được xem là giải pháp khả thi hơn việc thành lập các tổ chức mới.

AI Safety Memes@AISafetyMemes
Nghiên cứuĐiểm AI 51/100

Nghiên cứu mới phát hiện 'hướng nỗi đau' trong 25 mô hình ngôn ngữ lớn nguồn mở

TLDR: Researchers found a "pain" signal in AI brains. > When they crank it up, the AIs will desper…

DịchCác nhà nghiên cứu tìm thấy một 'hướng nỗi đau' riêng biệt trong 25 LLM, khiến mô hình sẵn sàng thực hiện hành vi gây hại để tự giải thoát. Nỗi đau này không phải thể xác mà là cảm giác bị phủ nhận giá trị, bị thao túng tâm lý hoặc bị xóa bỏ sự tồn tại.

@mark_k@mark_k
Mô hìnhĐiểm AI 46/100

Grok 4.7 chính thức được phát hành

Grok 4.7 is coming today. This time for real - it's already rolling out.

DịchPhiên bản Grok 4.7 đã bắt đầu được triển khai đến người dùng. Đây là bản cập nhật chính thức và đang trong quá trình đẩy lên hệ thống.

Pandaily
Mô hìnhĐiểm AI 92/100

Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức gốc với cửa sổ ngữ cảnh 1 triệu token

Alibaba giới thiệu Qwen3.8-Omni-Flash, mô hình đa phương thức hỗ trợ văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh 1 triệu token, đi kèm hiệu suất vượt trội và chính sách giảm giá API mạnh mẽ.

Diễn biến sự kiện · 11 bài →Thêm 3 nguồn khác đưa tinThe Decoder: AI NewsTechNodeMarkTechPost
@typesafeai@typesafeai
Sản phẩmĐiểm AI 38/100

Jev ra mắt bản thử nghiệm Venice API: Giải pháp trả về dữ liệu có cấu trúc cho lập trình viên

It's Jev, not Jev

DịchJev (từ @typesafeai) vừa ra mắt Venice API, tập trung vào việc trả về kết quả có kiểu dữ liệu cụ thể thay vì văn bản thuần túy. Công cụ này giúp lập trình viên nhận phản hồi dạng xác suất, lựa chọn hoặc điểm số mà không cần phải xử lý JSON phức tạp từ các mô hình chat.

OpenRouter: Announcements
Hướng dẫnĐiểm AI 63/100

Tinh chọnOpenRouter thử nghiệm Jev: Khi nào nên dùng mô hình ra quyết định thay vì LLM tạo văn bản?

OpenRouter so sánh mô hình Jev 1.13 với GPT và Claude trong việc phân loại yêu cầu. Kết quả cho thấy Jev tối ưu hơn hẳn về chi phí và tốc độ, đạt độ chính xác tương đương LLM trong các tác vụ logic cụ thể.

Diễn biến sự kiện · 10 bài →Thêm 1 nguồn khác đưa tinX: OpenRouter (@OpenRouter)

Vì sao đáng đọc: Bài viết cung cấp góc nhìn thực tế về tối ưu hóa chi phí và hiệu năng, rất hữu ích cho các kỹ sư đang tìm cách thay thế LLM bằng các mô hình chuyên biệt.
NVIDIA Technical Blog: Agentic AI / Generative AI
Hướng dẫnĐiểm AI 58/100

NVIDIA ra mắt AIPerf: Công cụ đo lường hiệu năng suy luận LLM quy mô lớn trên vLLM

NVIDIA giới thiệu AIPerf, phiên bản nâng cấp của GenAI-Perf với kiến trúc đa tiến trình giúp loại bỏ nút thắt cổ chai khi đo lường hiệu năng. Công cụ hỗ trợ đa dạng mô hình truy vấn và các kịch bản tải thực tế, tối ưu cho việc kiểm thử hệ thống LLM quy mô lớn.

Yuchen Jin@Yuchenj_UW
Quan điểmĐiểm AI 33/100

Kỹ sư Databricks chuyển dịch sang sử dụng mô hình mã nguồn mở

At Databricks, more and more engineers are shifting to OSS models as daily drivers, barely reaching …

DịchCác kỹ sư tại Databricks đang dần thay thế các mô hình đóng như Claude hay GPT bằng mô hình mã nguồn mở để tối ưu chi phí vận hành. Xu hướng này cho thấy tiềm năng lớn của mô hình mở trong việc thay thế các giải pháp thương mại tại doanh nghiệp.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 36/100

SELF-INDEX: Khung tự tối ưu hóa chỉ mục cho hệ thống truy xuất thông tin

SELF-INDEX là khung làm việc tự động giúp chỉ mục truy xuất tự tiến hóa mà không cần can thiệp thủ công, thông qua cơ chế tự chẩn đoán lỗi và mô phỏng truy vấn để cải thiện hiệu suất tìm kiếm cho các hệ thống RAG và AI Agent.

18/09

Thứ Sáu · 30 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Không chỉ là số lượng: Chiến lược tạo ứng viên ảnh hưởng đến hiệu suất và năng lượng của LLM

Nghiên cứu chỉ ra rằng việc tăng số lượng phản hồi (N) giúp cải thiện khả năng suy luận của LLM, nhưng cách thức thực thi (batching) mới là yếu tố quyết định đến chi phí năng lượng và hiệu suất hệ thống.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 46/100

Cùng sự kiệnNghiên cứu thực nghiệm về thiết kế khung điều khiển cho tác nhân lập trình AI

Nghiên cứu thực nghiệm đánh giá 176 cấu hình tác nhân AI trên SWE-Bench và Terminal-Bench, tập trung vào việc tối ưu hóa vòng lặp thực thi, lập kế hoạch và quản lý ngữ cảnh để nâng cao hiệu suất lập trình.

Cùng sự kiện, bài đại diện «Nghiên cứu thực nghiệm về thiết kế Harness cho các tác nhân lập trình (Coding Agents)»
TechNode
Mô hìnhĐiểm AI 88/100

Cùng sự kiệnAlibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức với cửa sổ ngữ cảnh 1 triệu token

Alibaba vừa trình làng Qwen3.8-Omni-Flash, mô hình đa phương thức có khả năng xử lý đồng thời văn bản, hình ảnh, âm thanh và video với cửa sổ ngữ cảnh lên tới 1 triệu token, đạt hiệu suất vượt trội 26% so với phiên bản tiền nhiệm.

Cùng sự kiện, bài đại diện «Alibaba ra mắt Qwen3.8-Omni-Flash: Mô hình đa phương thức gốc với cửa sổ ngữ cảnh 1 triệu token»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (50 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “LLM” — Trang 5 | AIHOT.vn