17/09

Thứ Năm · 26 tin
Zhipu AI Z.ai@Zai_org
NgànhĐiểm AI 43/100

Zhipu AI tối ưu hóa hạ tầng suy luận cho GLM-5.3, tăng gấp 3 lần lưu lượng xử lý

We're sharing how GLM-5.3 helped build and optimize the inference infrastructure serving GLM-5.3-Fla…

DịchZhipu AI chia sẻ cách họ xây dựng và tối ưu hóa hạ tầng cho GLM-5.3-Flash chỉ trong hai tuần, giúp tăng gấp ba lần lưu lượng xử lý nhờ quy trình kiểm thử và phản hồi kỹ thuật chặt chẽ.

Thêm 1 nguồn khác đưa tinX: Tang Jie (@jietang)
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnXConf: Nâng cao độ tin cậy của mô hình ngôn ngữ thông qua kinh nghiệm thực tế

XConf là phương pháp ước tính độ tin cậy mới, không chỉ dựa vào suy luận hiện tại mà còn truy xuất các bài học từ những trải nghiệm giải quyết vấn đề trong quá khứ để đánh giá chính xác hơn khả năng thành công của mô hình.


Vì sao đáng đọc: Đây là hướng tiếp cận mới mẻ và thực tiễn trong việc giải quyết bài toán 'ảo tưởng' của AI, giúp các hệ thống tự động hóa đưa ra quyết định tin cậy hơn.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

HypoEvolve: Ứng dụng thuật toán di truyền giúp AI đa tác nhân khám phá giả thuyết khoa học

HypoEvolve là khung làm việc mới sử dụng thuật toán di truyền để điều phối các tác nhân LLM chuyên biệt, giúp tối ưu hóa quá trình tổng hợp và kiểm chứng các giả thuyết khoa học thông qua cơ chế tiến hóa.

WeChat: Ant Ling
Sản phẩmĐiểm AI 45/100

OmniTable: Hệ thống bảng dữ liệu thống nhất cho quản trị dữ liệu LLM quy mô PB

Ant Group ra mắt OmniTable, hệ thống giúp tối ưu hóa quản trị dữ liệu cho các mô hình ngôn ngữ lớn quy mô PB. Giải pháp này đã giúp rút ngắn thời gian xử lý dữ liệu SFT từ 14 ngày xuống còn 2,5 ngày, đồng thời giảm đáng kể các thao tác thủ công.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Sử dụng Register Tokens để tối ưu hóa suy luận trạng thái giới hạn trong mô hình ngôn ngữ khuếch tán

Nghiên cứu giới thiệu phương pháp dùng các 'register tokens' để lưu trữ trạng thái suy luận, giúp mô hình ngôn ngữ khuếch tán duy trì logic mạch lạc khi xử lý văn bản dài mà không cần giữ toàn bộ ngữ cảnh cũ.

Apple Machine Learning Research
NgànhĐiểm AI 45/100

Cùng sự kiệnApple ra mắt TS-DFM: Tối ưu hóa mô hình ngôn ngữ với 'la bàn năng lượng' siêu tốc

Apple giới thiệu TS-DFM, kỹ thuật chưng cất mô hình sử dụng 'la bàn năng lượng' để chọn lọc bước nhảy hiệu quả thay vì ngẫu nhiên. Kết quả cho thấy mô hình 8 bước vượt trội hơn mô hình 1024 bước tới 32% về độ chính xác, đồng thời tăng tốc độ suy luận gấp 128 lần.

Cùng sự kiện, bài đại diện «DACA-GRPO: Apple tối ưu hóa học tăng cường cho mô hình ngôn ngữ khuếch tán»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 55/100

NetEase Youdao ra mắt mô hình nhận diện giọng nói Confucius4-R2T2: Không bao giờ sửa lại văn bản đã xuất

Voice agents should consume speech incrementally but only act on committed text, because a fast tran…

DịchNetEase Youdao giới thiệu mô hình nhận diện giọng nói thời gian thực Confucius4-R2T2, sử dụng kỹ thuật Longest Stable Prefix để đảm bảo văn bản đã xuất ra sẽ không bị thay đổi. Mô hình dựa trên Qwen3-ASR, cho phép tùy chỉnh thuật ngữ chuyên ngành linh hoạt mà không cần huấn luyện lại.

Apple Machine Learning Research
NgànhĐiểm AI 35/100

Glyph: Hệ thống AI của Apple giúp tự động hóa mô tả và phân loại dữ liệu doanh nghiệp

Apple giới thiệu Glyph, hệ thống AI sử dụng các tác nhân thông minh để tự động tạo mô tả cột và gắn nhãn dữ liệu nhạy cảm. Hệ thống kết hợp nhiều chiến lược xử lý song song, giúp cải thiện đáng kể độ chính xác trong việc phân loại và quản trị dữ liệu doanh nghiệp.

Arena@arena
Mô hìnhĐiểm AI 48/100

So sánh hiệu năng và chi phí các dòng mô hình AI mạnh nhất trên Arena

We compared the top model from each family by net improvement score and median cost per task. Family…

DịchArena đánh giá các dòng mô hình hàng đầu dựa trên điểm số cải thiện và chi phí mỗi tác vụ. Kết quả cho thấy GPT-6 Astra và Claude Fable 5.1 mang lại hiệu suất vượt trội nhưng đi kèm mức giá cao hơn đáng kể so với các phiên bản khác cùng dòng.

Aidan Gomez (Cohere CEO)@aidangomez
Sản phẩmĐiểm AI 36/100

Cohere ra mắt Model Vault: Giải pháp điện toán bảo mật cho doanh nghiệp

A hosted, encrypted solution for running LLMs! Truly secure access to models with full protection of…

DịchCohere giới thiệu Model Vault, nền tảng lưu trữ và vận hành LLM được mã hóa hoàn toàn, giúp doanh nghiệp truy cập mô hình an toàn tuyệt đối mà không lo rò rỉ dữ liệu hay tạo dữ liệu tổng hợp.

16/09

Thứ Tư · 39 tin
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 50/100

Nghiên cứu từ NVIDIA: Chiến lược tối ưu khi kết hợp nhiều mô hình trong hệ thống đa tác nhân

Banger paper from NVIDIA. It's on the topic of choosing which models go into a multi-agent system. …

DịchNghiên cứu của NVIDIA chỉ ra rằng việc sử dụng nhiều bản sao của cùng một mô hình thường hiệu quả hơn là kết hợp các mô hình khác nhau. Việc chọn lọc mô hình từ cùng một dòng sản phẩm mang lại hiệu suất tốt nhất cho hệ thống đa tác nhân.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 49/100

Google Research ra mắt Fuse: Khung đánh giá khả năng suy luận xã hội của LLM

Banger paper from Google Research. This one is on how LLM assistants reason about the people in a u…

DịchGoogle Research giới thiệu Fuse, khung đánh giá khả năng suy luận xã hội của LLM thông qua các kịch bản mô phỏng. Kết quả cho thấy các mô hình dễ bị ảnh hưởng bởi định kiến từ người dùng và độ dài hội thoại không đảm bảo cải thiện độ chính xác.

Thêm 1 nguồn khác đưa tinHugging Face Daily Papers
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 46/100

Học lập trình thời AI: Khi khả năng xây dựng vượt xa sự thấu hiểu

Một lập trình viên tay ngang lo ngại rằng việc dùng AI để xây dựng hệ thống phức tạp khiến họ chỉ tạo ra 'vỏ bọc' sản phẩm mà không thực sự hiểu bản chất. Bài viết đặt câu hỏi về tương lai nghề nghiệp khi AI có thể thay thế kỹ năng lập trình truyền thống.

JiQiZhiXin
Mô hìnhĐiểm AI 85/100

Làm sao để tối ưu AI cục bộ? Trò chuyện cùng CTO của StartLux

Trong bối cảnh giới toán học lo ngại về việc AI 'đánh cắp' ý tưởng trên đám mây, StartLux gây chú ý khi đạt hiệu suất vượt trội với mô hình 27B. Chúng tôi thảo luận về cách họ tối ưu hóa hậu huấn luyện để đạt kết quả ấn tượng dù quy mô tham số nhỏ.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 53/100

Học tăng cường khiến LLM mạnh càng thêm mạnh: Phương pháp 'Never Give Up' giải mã các bài toán khó

Nghiên cứu mới chỉ ra hiệu ứng Matthew trong huấn luyện RL khiến các mô hình mạnh tiến bộ nhanh hơn, trong khi các bài toán khó nhất vẫn bị bỏ ngỏ. Tác giả đề xuất phương pháp 'Never Give Up' để khắc phục hạn chế này.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnGiải mã kiến trúc AI: Khi hỏi mô hình như một đứa trẻ lại hé lộ bí mật kỹ thuật

Nghiên cứu cho thấy việc đặt câu hỏi dưới góc độ 'giải thích cho học sinh' giúp các mô hình AI hàng đầu bộc lộ cấu trúc kiến trúc cốt lõi một cách nhất quán và ổn định hơn so với các cách hỏi thông thường.


Vì sao đáng đọc: Nghiên cứu mang tính đột phá về kỹ thuật prompt (prompt engineering), giúp hiểu sâu hơn về cách các mô hình AI tư duy và cấu trúc hóa kiến thức nội tại.
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 59/100

Microsoft cảnh báo về tấn công 'rửa năng lực': Mô hình nhỏ lợi dụng AI mạnh để thực hiện hành vi độc hại

Interesting safety paper from Microsoft. They find that a weaker, unaligned model can split a harmf…

DịchNhóm nghiên cứu Microsoft phát hiện các mô hình AI chưa được kiểm soát có thể chia nhỏ yêu cầu độc hại thành các câu hỏi vô hại, gửi cho các mô hình tiên tiến để lấy lời giải rồi tự tổng hợp lại, qua mặt cơ chế an toàn.

JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnGPT-6 Sol sắp lộ diện? OpenAI chuẩn bị cho tuần lễ ra mắt bùng nổ

OpenAI đang gây xôn xao khi các lãnh đạo cấp cao xác nhận sẽ có loạt bản cập nhật lớn trong tuần này. Nhiều người dùng báo cáo đã được trải nghiệm sớm GPT-6 Sol với tốc độ vượt trội, làm dấy lên đồn đoán về một bước tiến mới trong khả năng suy luận và hiệu suất của mô hình.


Vì sao đáng đọc: Tin tức nóng hổi về thế hệ mô hình tiếp theo của OpenAI, có tính thời sự cao và thu hút sự quan tâm lớn từ cộng đồng công nghệ toàn cầu.
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnĐừng để AI Agent 'tự biên tự diễn': Bí quyết cân bằng giữa tư duy nội tại và công cụ ngoại vi

Tổng hợp từ 600 nghiên cứu, bài viết đề xuất khung lý thuyết 'Theory of Agent' giúp tối ưu hóa việc phân bổ năng lực cho AI Agent, tránh tình trạng lạm dụng công cụ hoặc suy diễn sai lệch.


Vì sao đáng đọc: Bài viết mang tính học thuật cao, giải quyết vấn đề thực tế trong phát triển Agent, có giá trị tham khảo lớn cho các kỹ sư và nhà nghiên cứu AI.
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnNghiên cứu từ Thanh Hoa: Chỉ cần một bài toán để huấn luyện mô hình ngôn ngữ lớn?

Nhóm nghiên cứu từ ĐH Thanh Hoa phát hiện On-Policy Distillation (OPD) có thể đạt 70% hiệu suất dù chỉ huấn luyện trên một mẫu dữ liệu duy nhất, cho thấy thuật toán hiện tại vẫn chưa khai thác hết tiềm năng của dữ liệu.


Vì sao đáng đọc: Nghiên cứu thách thức tư duy truyền thống về quy mô dữ liệu trong huấn luyện LLM, mang tính đột phá và có giá trị thực tiễn cao cho cộng đồng AI.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

DDO: Phương pháp phòng thủ mới chống lại kỹ thuật bẻ khóa mô hình ngôn ngữ bằng cách xóa bỏ tính năng

DDO là kỹ thuật chỉnh sửa trọng số hậu kỳ giúp ngăn chặn các cuộc tấn công xóa bỏ tính năng từ chối (RFA) trên mô hình ngôn ngữ mà không cần huấn luyện lại, bằng cách chèn tín hiệu giả để đánh lạc hướng kẻ tấn công.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 56/100

Nghiên cứu: Chỉ cần cung cấp công cụ không cần thiết cũng khiến tỷ lệ trả lời của LLM giảm từ 98,2% xuống 63,5%

Giving an assistant extra tools seems harmless. Surprisingly, this paper shows it can make the assi…

DịchMột nghiên cứu mới chỉ ra rằng việc tích hợp các công cụ không cần thiết khiến các mô hình ngôn ngữ lớn (LLM) dễ bỏ qua các câu hỏi đơn giản, dù công cụ không được sử dụng. Việc bổ sung hướng dẫn cụ thể trong system prompt có thể giúp cải thiện đáng kể tỷ lệ phản hồi này.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (61 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “llm” — Trang 7 | AIHOT.vn