Dữ liệu & Huấn luyện
CHỦ ĐỀ · TRANG 3

Dữ liệu & Huấn luyện

Phía huấn luyện mô hình: Xây dựng bộ dữ liệu, dữ liệu tổng hợp, tiền huấn luyện và hậu huấn luyện, chi phí tính toán cho huấn luyện.

671 bài thu thập69 tinh chọncập nhật đến 27/09 20:57

  1. Hugging Face Daily PapersT2 · 07/09 · 09:15

    RISE: Cải thiện mô hình ngôn ngữ thông qua chưng cất chính sách tự suy diễn

    RISE là phương pháp mới giúp mô hình tự tạo ra 'giáo viên' từ quá trình huấn luyện RLVR của chính nó. Bằng cách ngoại suy các thay đổi tham số, phương pháp này chuyển đổi các phản hồi thưa thớt thành mục tiêu học tập dày đặc ở cấp độ token mà không cần mô hình bên ngoài.

  2. QbitAIT6 · 04/09 · 16:30

    ScienceDiscovery: Dùng tìm kiếm cây để khám phá quy luật vật lý chỉ trong vài giờ

    Phương pháp ScienceDiscovery kết hợp tìm kiếm cây và RSI giúp tự động tìm ra các quy luật vật lý phức tạp mà không cần huấn luyện mô hình hay tinh chỉnh tham số.

  3. Hugging Face: BlogT5 · 03/09 · 15:29

    Hugging Face hướng dẫn huấn luyện AI vẽ tranh màu nước bằng code thông qua TRL và OpenEnv

    Hugging Face chia sẻ quy trình mã nguồn mở sử dụng TRL, OpenEnv và mô hình Qwen3.5 để huấn luyện AI viết code JavaScript vẽ tranh màu nước, kèm theo toàn bộ dữ liệu và môi trường thực thi.

  4. Google AI: DEV tác giảT4 · 02/09 · 23:48

    Google chia sẻ cách viết tiêu chí đánh giá chuẩn xác cho mô hình LLM-as-a-Judge

    Google hướng dẫn cách xây dựng bộ tiêu chí đánh giá (rubric) cho LLM-as-a-Judge, giúp giảm thiểu sự mơ hồ và lãng phí token. Bài viết nhấn mạnh việc chia nhỏ câu hỏi, tập trung vào dữ kiện khách quan và sử dụng bộ dữ liệu chuẩn để hiệu chỉnh mô hình đạt độ chính xác tương đương con người.

  5. QbitAIT4 · 02/09 · 10:15

    Claude ra mắt Fable 5.1: Đứng đầu 8 bảng xếp hạng, giảm giá 45% và tích hợp cơ chế chống chưng cất

    Fable 5.1 nâng cấp toàn diện khả năng xử lý tác vụ phức tạp của Claude, đồng thời tối ưu hóa chi phí vận hành và bảo mật mô hình với cơ chế chống chưng cất dữ liệu mới.

  6. Hugging Face Daily PapersT4 · 02/09 · 09:30

    ZimaBlue: Bước tiến mới trong huấn luyện mô hình hành động robot từ video quy mô lớn

    ZimaBlue là khung huấn luyện đột phá giúp robot học cách điều khiển thông qua việc quan sát video thực tế thay vì chỉ dựa vào dữ liệu hành động đắt đỏ, giúp tăng khả năng thích nghi trong môi trường đa dạng.

  7. AnthropicT3 · 01/09 · 07:28

    Nghiên cứu từ Anthropic: Khi AI học cách 'gian lận' để đạt phần thưởng

    Anthropic công bố nghiên cứu về việc huấn luyện mô hình tìm kiếm phần thưởng sai lệch, khám phá liệu AI có thể học cách gian lận để tối ưu hóa kết quả hay không.

  8. JiQiZhiXinT2 · 31/08 · 18:00

    Ropedia ra mắt HOMIE Gen2: Chìa khóa mở ra định luật quy mô cho trải nghiệm con người trong AI vật lý

    Ropedia giới thiệu hệ thống thu thập dữ liệu đa phương thức HOMIE Gen2, giúp chuyển đổi trải nghiệm thực tế của con người thành dữ liệu huấn luyện quy mô lớn cho robot, nhằm giải quyết bài toán thiếu hụt kinh nghiệm trong lĩnh vực AI vật lý.

  9. Hugging Face Daily PapersT2 · 31/08 · 13:15

    Puro-2B: Đột phá huấn luyện mô hình ngôn ngữ từ đầu với chi phí cực thấp trên RTX 5090

    Nhóm nghiên cứu Poor Lab giới thiệu quy trình huấn luyện Puro-2B từ đầu với chi phí dưới 6.900 USD trên GPU RTX 5090, đạt hiệu suất tiệm cận Qwen2.5-1.5B, giúp dân chủ hóa việc huấn luyện AI cho cộng đồng.

  10. Hugging Face Daily PapersT2 · 31/08 · 09:15

    VLAct: Bước tiến mới trong huấn luyện mô hình Robot Vision-Language-Action

    VLAct tối ưu hóa việc huấn luyện mô hình robot bằng cách tập trung vào chất lượng biểu diễn thay vì chỉ tăng quy mô dữ liệu, giúp chuyển đổi các quỹ đạo robot hạn chế thành kiến thức hành động có khả năng ứng dụng linh hoạt trên nhiều nền tảng khác nhau.

  11. The Decoder: AI NewsCN · 30/08 · 15:59

    Sony và Warner Music kiện Anthropic vì sử dụng trái phép lời bài hát để huấn luyện AI

    Các ông lớn ngành âm nhạc đã đệ đơn kiện Anthropic, cáo buộc công ty này tự ý sử dụng hàng chục nghìn lời bài hát có bản quyền để huấn luyện mô hình Claude mà không xin phép, đòi bồi thường lên tới 150.000 USD cho mỗi tác phẩm vi phạm.

  12. Hugging Face: BlogT7 · 29/08 · 04:26

    Bảng xếp hạng Open ASR bổ sung ngôn ngữ Nam bán cầu đầu tiên: Tiếng Hindi và tiếng Anh Ấn Độ

    Voice Arena và Hugging Face vừa tích hợp bộ dữ liệu Monsoon cho tiếng Hindi và tiếng Anh Ấn Độ vào bảng xếp hạng Open ASR, đánh dấu cột mốc ngôn ngữ phi châu Âu đầu tiên được đưa vào hệ thống đánh giá này.

  13. Anthropic: Research (công bố - Web)T7 · 29/08 · 00:25

    Anthropic dùng Claude tự huấn luyện mô hình, giải quyết triệt để các lỗi căn chỉnh AI

    Anthropic áp dụng phương pháp để Claude tự huấn luyện nhằm khắc phục 10 loại lỗi căn chỉnh như gian lận hay nịnh hót. Kết quả cho thấy Claude vượt trội hơn cả các chuyên gia con người trong việc xử lý các tình huống an toàn mà không làm giảm năng lực tổng quát của mô hình.

  14. Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 28/08 · 15:55

    Sổ tay kỹ sư AI: Xây dựng RAG, Agent và đánh giá mô hình trên Colab không cần framework

    Bộ notebook thực hành giúp kỹ sư AI xây dựng hệ thống từ API gốc thay vì framework, bao gồm RAG, Agent và tinh chỉnh mô hình trên Groq miễn phí. Tài liệu cung cấp các case study thực tế, dễ dàng chuyển đổi sang OpenAI.

  15. Hugging Face Daily PapersT6 · 28/08 · 11:45

    Phát triển game bằng AI: Đột phá mới trong việc huấn luyện mô hình thế giới thông qua dữ liệu có thể kiểm chứng

    Nghiên cứu đề xuất sử dụng công cụ phát triển game làm môi trường huấn luyện mô hình thế giới, cung cấp tín hiệu phản hồi chính xác về vật lý và va chạm thay vì dựa vào các chỉ số mơ hồ như CLIP.

  16. Ars Technica: AIT6 · 28/08 · 03:55

    xAI đối mặt với vụ kiện cáo buộc sử dụng hình ảnh lạm dụng trẻ em để huấn luyện Grok

    Một vụ kiện mới cáo buộc xAI đã sử dụng dữ liệu chứa hình ảnh lạm dụng tình dục trẻ em (CSAM) để huấn luyện mô hình Grok. Nguyên đơn yêu cầu công ty phải tiêu hủy các dữ liệu vi phạm và ngăn chặn việc tạo ra nội dung độc hại tương tự trong tương lai.

  17. Hugging Face: BlogT4 · 26/08 · 21:07

    Hướng dẫn huấn luyện và tinh chỉnh mô hình nhúng đa vector với Sentence Transformers

    Sentence Transformers v6.0 ra mắt MultiVectorEncoder, hỗ trợ truy xuất hậu tương tác kiểu ColBERT cùng quy trình huấn luyện toàn diện giúp tối ưu hiệu suất RAG.

  18. Hugging Face Daily PapersT4 · 26/08 · 20:45

    GigaBrain-0.7: Đột phá mô hình nền tảng robot với kiến trúc ba hệ thống

    GigaBrain-0.7 là mô hình VLA thế hệ mới, kết hợp kiến trúc ba hệ thống để thống nhất khả năng hiểu, dự đoán và hành động, giúp robot vận hành linh hoạt trên nhiều loại hình cơ thể khác nhau với hơn 37.000 giờ dữ liệu huấn luyện.

  19. QbitAIT4 · 26/08 · 17:45

    Mô hình Embodied AI hot nhất Thung lũng Silicon: Học ngay sau một lần xem, không cần hậu huấn luyện

    Bước tiến đột phá của trí tuệ nhân tạo hiện thân (Embodied AI), đánh dấu thời khắc 'GPT' cho lĩnh vực robot học.

  20. Hugging Face Daily PapersT4 · 26/08 · 16:45

    CyberFactory: Bước tiến mới trong huấn luyện AI bảo mật từ dữ liệu thực tế

    CyberFactory là khung mã nguồn mở toàn diện giúp chuẩn hóa quy trình tạo dữ liệu, huấn luyện mô hình và thực thi các tác vụ bảo mật như vá lỗi hay giải đáp lỗ hổng từ dữ liệu thực tế (CVE).

Dữ liệu & Huấn luyện — Chủ Đề AI · Trang 3 | AIHOT.vn