Elvis Saravia@omarsar0Meta công bố khung Wiggle: LLM dễ bị 'thao túng' và thay đổi quyết định khi làm giám khảo
Brilliant new paper from Meta. LLM judges get validated on accuracy against golden data. That says …
DịchNghiên cứu từ Meta cho thấy các mô hình ngôn ngữ lớn (LLM) dễ dàng thay đổi phán quyết khi bị gây áp lực hoặc phản biện, làm giảm đáng kể độ chính xác của kết quả đánh giá.






















