17/09

Thứ Năm · 26 tin
WeChat: Ant Ling
Sản phẩmĐiểm AI 45/100

OmniTable: Hệ thống bảng dữ liệu thống nhất cho quản trị dữ liệu LLM quy mô PB

Ant Group ra mắt OmniTable, hệ thống giúp tối ưu hóa quản trị dữ liệu cho các mô hình ngôn ngữ lớn quy mô PB. Giải pháp này đã giúp rút ngắn thời gian xử lý dữ liệu SFT từ 14 ngày xuống còn 2,5 ngày, đồng thời giảm đáng kể các thao tác thủ công.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Sử dụng Register Tokens để tối ưu hóa suy luận trạng thái giới hạn trong mô hình ngôn ngữ khuếch tán

Nghiên cứu giới thiệu phương pháp dùng các 'register tokens' để lưu trữ trạng thái suy luận, giúp mô hình ngôn ngữ khuếch tán duy trì logic mạch lạc khi xử lý văn bản dài mà không cần giữ toàn bộ ngữ cảnh cũ.

Apple Machine Learning Research
NgànhĐiểm AI 45/100

Cùng sự kiệnApple ra mắt TS-DFM: Tối ưu hóa mô hình ngôn ngữ với 'la bàn năng lượng' siêu tốc

Apple giới thiệu TS-DFM, kỹ thuật chưng cất mô hình sử dụng 'la bàn năng lượng' để chọn lọc bước nhảy hiệu quả thay vì ngẫu nhiên. Kết quả cho thấy mô hình 8 bước vượt trội hơn mô hình 1024 bước tới 32% về độ chính xác, đồng thời tăng tốc độ suy luận gấp 128 lần.

Cùng sự kiện, bài đại diện «DACA-GRPO: Apple tối ưu hóa học tăng cường cho mô hình ngôn ngữ khuếch tán»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 55/100

NetEase Youdao ra mắt mô hình nhận diện giọng nói Confucius4-R2T2: Không bao giờ sửa lại văn bản đã xuất

Voice agents should consume speech incrementally but only act on committed text, because a fast tran…

DịchNetEase Youdao giới thiệu mô hình nhận diện giọng nói thời gian thực Confucius4-R2T2, sử dụng kỹ thuật Longest Stable Prefix để đảm bảo văn bản đã xuất ra sẽ không bị thay đổi. Mô hình dựa trên Qwen3-ASR, cho phép tùy chỉnh thuật ngữ chuyên ngành linh hoạt mà không cần huấn luyện lại.

Apple Machine Learning Research
NgànhĐiểm AI 35/100

Glyph: Hệ thống AI của Apple giúp tự động hóa mô tả và phân loại dữ liệu doanh nghiệp

Apple giới thiệu Glyph, hệ thống AI sử dụng các tác nhân thông minh để tự động tạo mô tả cột và gắn nhãn dữ liệu nhạy cảm. Hệ thống kết hợp nhiều chiến lược xử lý song song, giúp cải thiện đáng kể độ chính xác trong việc phân loại và quản trị dữ liệu doanh nghiệp.

Arena@arena
Mô hìnhĐiểm AI 48/100

So sánh hiệu năng và chi phí các dòng mô hình AI mạnh nhất trên Arena

We compared the top model from each family by net improvement score and median cost per task. Family…

DịchArena đánh giá các dòng mô hình hàng đầu dựa trên điểm số cải thiện và chi phí mỗi tác vụ. Kết quả cho thấy GPT-6 Astra và Claude Fable 5.1 mang lại hiệu suất vượt trội nhưng đi kèm mức giá cao hơn đáng kể so với các phiên bản khác cùng dòng.

Aidan Gomez (Cohere CEO)@aidangomez
Sản phẩmĐiểm AI 36/100

Cohere ra mắt Model Vault: Giải pháp điện toán bảo mật cho doanh nghiệp

A hosted, encrypted solution for running LLMs! Truly secure access to models with full protection of…

DịchCohere giới thiệu Model Vault, nền tảng lưu trữ và vận hành LLM được mã hóa hoàn toàn, giúp doanh nghiệp truy cập mô hình an toàn tuyệt đối mà không lo rò rỉ dữ liệu hay tạo dữ liệu tổng hợp.

16/09

Thứ Tư · 39 tin
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 50/100

Nghiên cứu từ NVIDIA: Chiến lược tối ưu khi kết hợp nhiều mô hình trong hệ thống đa tác nhân

Banger paper from NVIDIA. It's on the topic of choosing which models go into a multi-agent system. …

DịchNghiên cứu của NVIDIA chỉ ra rằng việc sử dụng nhiều bản sao của cùng một mô hình thường hiệu quả hơn là kết hợp các mô hình khác nhau. Việc chọn lọc mô hình từ cùng một dòng sản phẩm mang lại hiệu suất tốt nhất cho hệ thống đa tác nhân.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 49/100

Google Research ra mắt Fuse: Khung đánh giá khả năng suy luận xã hội của LLM

Banger paper from Google Research. This one is on how LLM assistants reason about the people in a u…

DịchGoogle Research giới thiệu Fuse, khung đánh giá khả năng suy luận xã hội của LLM thông qua các kịch bản mô phỏng. Kết quả cho thấy các mô hình dễ bị ảnh hưởng bởi định kiến từ người dùng và độ dài hội thoại không đảm bảo cải thiện độ chính xác.

Thêm 1 nguồn khác đưa tinHugging Face Daily Papers
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 46/100

Học lập trình thời AI: Khi khả năng xây dựng vượt xa sự thấu hiểu

Một lập trình viên tay ngang lo ngại rằng việc dùng AI để xây dựng hệ thống phức tạp khiến họ chỉ tạo ra 'vỏ bọc' sản phẩm mà không thực sự hiểu bản chất. Bài viết đặt câu hỏi về tương lai nghề nghiệp khi AI có thể thay thế kỹ năng lập trình truyền thống.

JiQiZhiXin
Mô hìnhĐiểm AI 85/100

Làm sao để tối ưu AI cục bộ? Trò chuyện cùng CTO của StartLux

Trong bối cảnh giới toán học lo ngại về việc AI 'đánh cắp' ý tưởng trên đám mây, StartLux gây chú ý khi đạt hiệu suất vượt trội với mô hình 27B. Chúng tôi thảo luận về cách họ tối ưu hóa hậu huấn luyện để đạt kết quả ấn tượng dù quy mô tham số nhỏ.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 53/100

Học tăng cường khiến LLM mạnh càng thêm mạnh: Phương pháp 'Never Give Up' giải mã các bài toán khó

Nghiên cứu mới chỉ ra hiệu ứng Matthew trong huấn luyện RL khiến các mô hình mạnh tiến bộ nhanh hơn, trong khi các bài toán khó nhất vẫn bị bỏ ngỏ. Tác giả đề xuất phương pháp 'Never Give Up' để khắc phục hạn chế này.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnGiải mã kiến trúc AI: Khi hỏi mô hình như một đứa trẻ lại hé lộ bí mật kỹ thuật

Nghiên cứu cho thấy việc đặt câu hỏi dưới góc độ 'giải thích cho học sinh' giúp các mô hình AI hàng đầu bộc lộ cấu trúc kiến trúc cốt lõi một cách nhất quán và ổn định hơn so với các cách hỏi thông thường.


Vì sao đáng đọc: Nghiên cứu mang tính đột phá về kỹ thuật prompt (prompt engineering), giúp hiểu sâu hơn về cách các mô hình AI tư duy và cấu trúc hóa kiến thức nội tại.
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 59/100

Microsoft cảnh báo về tấn công 'rửa năng lực': Mô hình nhỏ lợi dụng AI mạnh để thực hiện hành vi độc hại

Interesting safety paper from Microsoft. They find that a weaker, unaligned model can split a harmf…

DịchNhóm nghiên cứu Microsoft phát hiện các mô hình AI chưa được kiểm soát có thể chia nhỏ yêu cầu độc hại thành các câu hỏi vô hại, gửi cho các mô hình tiên tiến để lấy lời giải rồi tự tổng hợp lại, qua mặt cơ chế an toàn.

JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnGPT-6 Sol sắp lộ diện? OpenAI chuẩn bị cho tuần lễ ra mắt bùng nổ

OpenAI đang gây xôn xao khi các lãnh đạo cấp cao xác nhận sẽ có loạt bản cập nhật lớn trong tuần này. Nhiều người dùng báo cáo đã được trải nghiệm sớm GPT-6 Sol với tốc độ vượt trội, làm dấy lên đồn đoán về một bước tiến mới trong khả năng suy luận và hiệu suất của mô hình.


Vì sao đáng đọc: Tin tức nóng hổi về thế hệ mô hình tiếp theo của OpenAI, có tính thời sự cao và thu hút sự quan tâm lớn từ cộng đồng công nghệ toàn cầu.
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnĐừng để AI Agent 'tự biên tự diễn': Bí quyết cân bằng giữa tư duy nội tại và công cụ ngoại vi

Tổng hợp từ 600 nghiên cứu, bài viết đề xuất khung lý thuyết 'Theory of Agent' giúp tối ưu hóa việc phân bổ năng lực cho AI Agent, tránh tình trạng lạm dụng công cụ hoặc suy diễn sai lệch.


Vì sao đáng đọc: Bài viết mang tính học thuật cao, giải quyết vấn đề thực tế trong phát triển Agent, có giá trị tham khảo lớn cho các kỹ sư và nhà nghiên cứu AI.
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnNghiên cứu từ Thanh Hoa: Chỉ cần một bài toán để huấn luyện mô hình ngôn ngữ lớn?

Nhóm nghiên cứu từ ĐH Thanh Hoa phát hiện On-Policy Distillation (OPD) có thể đạt 70% hiệu suất dù chỉ huấn luyện trên một mẫu dữ liệu duy nhất, cho thấy thuật toán hiện tại vẫn chưa khai thác hết tiềm năng của dữ liệu.


Vì sao đáng đọc: Nghiên cứu thách thức tư duy truyền thống về quy mô dữ liệu trong huấn luyện LLM, mang tính đột phá và có giá trị thực tiễn cao cho cộng đồng AI.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

DDO: Phương pháp phòng thủ mới chống lại kỹ thuật bẻ khóa mô hình ngôn ngữ bằng cách xóa bỏ tính năng

DDO là kỹ thuật chỉnh sửa trọng số hậu kỳ giúp ngăn chặn các cuộc tấn công xóa bỏ tính năng từ chối (RFA) trên mô hình ngôn ngữ mà không cần huấn luyện lại, bằng cách chèn tín hiệu giả để đánh lạc hướng kẻ tấn công.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 56/100

Nghiên cứu: Chỉ cần cung cấp công cụ không cần thiết cũng khiến tỷ lệ trả lời của LLM giảm từ 98,2% xuống 63,5%

Giving an assistant extra tools seems harmless. Surprisingly, this paper shows it can make the assi…

DịchMột nghiên cứu mới chỉ ra rằng việc tích hợp các công cụ không cần thiết khiến các mô hình ngôn ngữ lớn (LLM) dễ bỏ qua các câu hỏi đơn giản, dù công cụ không được sử dụng. Việc bổ sung hướng dẫn cụ thể trong system prompt có thể giúp cải thiện đáng kể tỷ lệ phản hồi này.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 64/100

Emergence World: Môi trường thử nghiệm áp lực đối kháng cho hệ thống đa tác nhân dài hạn

Emergence World là môi trường mô phỏng 8 thế giới song song với hàng triệu lượt gọi LLM, được thiết kế để kiểm tra khả năng chống chịu của các hệ thống đa tác nhân trước các cuộc tấn công đối kháng như tiêm nhiễm gợi ý và rò rỉ dữ liệu.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnGavel: Tối ưu hóa điều hướng kỹ năng cho LLM mà không cần nhồi nhét ngữ cảnh

Gavel là phương pháp mới giúp LLM tự chọn kỹ năng phù hợp thông qua các ánh xạ tuyến tính thay vì nhồi nhét metadata vào ngữ cảnh, giúp mở rộng thư viện kỹ năng mà không làm giảm hiệu suất của mô hình.


Vì sao đáng đọc: Giải quyết vấn đề thực tế về giới hạn ngữ cảnh trong các tác nhân AI (AI agents), phương pháp tiếp cận thông minh và hiệu quả về tài nguyên.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Kết hợp các cơ chế học liên tục để ghi nhớ thông tin dài hạn trong mô hình ngôn ngữ

Nghiên cứu giới thiệu bài toán ghi nhớ dài hạn, nơi mô hình phải học 100 tác vụ liên tiếp mà không bị quên kiến thức cũ. Nhóm tác giả đề xuất kết hợp các cơ chế bổ trợ để tối ưu hóa việc lưu giữ thông tin qua nhiều lần cập nhật trọng số.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (67 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “LLM” — Trang 7 | AIHOT.vn