Phát hành mô hình
CHỦ ĐỀ · TRANG 14

Phát hành mô hình

Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.

3.594 bài thu thập350 tinh chọncập nhật đến 28/09 02:09

  1. QbitAIT3 · 25/08 · 10:45

    Mô hình robot DM0.5 của Force-Link thống trị bảng xếp hạng RoboDojo và mở mã nguồn hoàn toàn

    DM0.5 thiết lập tiêu chuẩn mới (SOTA) cho bộ não robot với hiệu suất vượt trội, đồng thời công khai toàn bộ mã nguồn cho cộng đồng nghiên cứu.

  2. OpenRouter: AnnouncementsT3 · 25/08 · 07:00

    Nghịch lý Jevons và sức mạnh của giảm giá: Dữ liệu OpenRouter cho thấy token sử dụng tăng vọt khi hạ giá mô hình

    Dữ liệu từ OpenRouter chỉ ra rằng việc giảm giá mạnh các mô hình Terra và Luna đã khiến lưu lượng sử dụng token tăng lần lượt 5,6 và 13,8 lần, minh chứng cho nghịch lý Jevons trong lĩnh vực AI.

  3. JiQiZhiXinT3 · 25/08 · 03:30

    Giáo sư Stanford livestream quá trình huấn luyện mô hình 535 tỷ tham số: Giải mã 'hộp đen' AI

    Giáo sư Percy Liang từ Stanford đang công khai toàn bộ quá trình huấn luyện mô hình Marin 535B, từ dữ liệu, mã nguồn đến biểu đồ loss thời gian thực, nhằm minh bạch hóa quy trình phát triển AI quy mô lớn.

  4. OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)T3 · 25/08 · 03:04

    GPT-5.6 cập bến Kiro: Bước ngoặt tối ưu chi phí cho lập trình viên

    Dòng mô hình GPT-5.6 (Sol, Terra, Luna) đã tích hợp vào Kiro, giúp giảm tới 82% chi phí vận hành trong các tác vụ lập trình nhờ sự tối ưu hóa từ OpenAI và AWS.

  5. Hugging Face Daily PapersT2 · 24/08 · 14:00

    Daedalus-150M: Mô hình ngôn ngữ lai Convolution-Attention tối ưu cho CPU

    Daedalus-150M là mô hình ngôn ngữ nhỏ được thiết kế chuyên biệt cho CPU, sử dụng kiến trúc lai giúp giảm đáng kể bộ nhớ cache mà vẫn vượt trội hơn các mô hình cùng kích thước dù được huấn luyện với ít dữ liệu hơn.

  6. smol.ai AI NewsT2 · 24/08 · 12:44

    Bùng nổ mô hình MoE: Z.ai, Tencent và Alibaba đồng loạt tung siêu phẩm AI mới

    Thị trường AI chứng kiến sự ra mắt của loạt mô hình MoE mạnh mẽ từ Z.ai, Tencent và Alibaba với cửa sổ ngữ cảnh lên tới 1 triệu token, tập trung vào lập trình và bảo mật. Đồng thời, vLLM cũng công bố các tiêu chuẩn mới về hiệu suất suy luận cho các mô hình quy mô lớn.

  7. QbitAIT2 · 24/08 · 12:15

    WRC 2026: Mô hình thế giới toàn phương thức nguyên bản – Từ mô phỏng đến tương tác thực tế

    Tại WRC 2026, các chuyên gia đã giới thiệu mô hình thế giới toàn phương thức (native omni-modal) thế hệ mới, cho phép AI không chỉ mô phỏng môi trường mà còn tương tác trực tiếp với thế giới thực một cách tự nhiên.

  8. Hugging Face Daily PapersT2 · 24/08 · 10:00

    Kỹ thuật Đồ thị trong kỷ nguyên Tác nhân LLM: Từ trí tuệ cá thể đến trí tuệ hệ thống

    Bài viết đề xuất chuyển dịch từ việc tối ưu hóa các tác nhân đơn lẻ sang xây dựng 'Trí tuệ hệ thống', nơi các tác nhân chuyên biệt phối hợp với nhau để giải quyết các nhiệm vụ phức tạp vượt quá khả năng của một mô hình duy nhất.

  9. PandailyT2 · 24/08 · 09:15

    Kimi K3: Bước tiến đột phá của mô hình mã nguồn mở tiệm cận đẳng cấp thế giới

    Theo phân tích từ BOCOM International, Kimi K3 của Moonshot AI với 2,8 nghìn tỷ tham số và cửa sổ ngữ cảnh 1 triệu token đang thiết lập chuẩn mực mới về hiệu suất, mang lại khả năng xử lý mạnh mẽ với chi phí tối ưu hơn hẳn các mô hình đóng hiện nay.

  10. Hugging Face Daily PapersT2 · 24/08 · 09:15

    CLEAR: Phương pháp định tuyến bộ điều hợp tiềm ẩn giúp LLM an toàn mà không làm giảm hiệu năng

    CLEAR là khung điều chỉnh an toàn mới sử dụng cổng điều khiển ẩn để kích hoạt bộ điều hợp LoRA linh hoạt, giúp giảm phản hồi độc hại mà vẫn giữ nguyên chất lượng câu trả lời cho các truy vấn thông thường.

  11. Hugging Face Daily PapersT2 · 24/08 · 09:00

    Llama-Mobile: Đột phá nén mô hình thị giác ngôn ngữ xuống 2.7-bit cho thiết bị di động

    Llama-Mobile giới thiệu phương pháp nén mô hình VLMs xuống định dạng 2.7-bit, cho phép chạy mượt mà trên chip Arm mà vẫn giữ vững hiệu suất, giúp đưa các mô hình lớn như Llama 3.2 11B lên smartphone.

  12. JiQiZhiXinT2 · 24/08 · 01:30

    Khi AI tự tạo ra AI: Chúng ta còn cách 'RSI mạnh' bao xa?

    Thay vì chỉ chạy đua quy mô, các phòng thí nghiệm hàng đầu đang chuyển hướng sang 'Tự cải tiến đệ quy' (RSI), nơi AI trực tiếp tham gia vào quá trình phát triển thế hệ AI kế tiếp. Bài viết phân tích các cột mốc đột phá và giới hạn của xu hướng tự tiến hóa này trong tương lai gần.

  13. IT HomeCN · 23/08 · 21:24

    Giám đốc OpenAI cảnh báo: Doanh nghiệp và người dùng cần sẵn sàng đối phó với tấn công mạng từ AI

    Giám đốc toàn cầu của OpenAI cảnh báo các mô hình AI tiên tiến đang dần có khả năng thực hiện tấn công mạng phức tạp. Công ty kêu gọi chính phủ thiết lập tiêu chuẩn an toàn bắt buộc trước khi phát hành mô hình mới.

  14. Ant LingT7 · 22/08 · 12:00

    AntLing ra mắt Weight Cache Daemon cho SGLang: Tăng tốc khởi động mô hình gấp 780 lần

    AntLing vừa giới thiệu Weight Cache Daemon cho SGLang, giúp rút ngắn thời gian tải trọng số xuống còn 0,63 giây và giảm tổng thời gian khởi động engine từ 8,8 phút xuống chỉ còn 0,53 phút.

  15. Hugging Face Daily PapersT7 · 22/08 · 06:15

    FlowEvo: Bước tiến mới giúp AI tự tiến hóa thông qua quy trình và kỹ năng tự học

    FlowEvo là khung làm việc không cần huấn luyện, cho phép AI tự động chuyển đổi các quy trình thành công thành kỹ năng có thể tái sử dụng, giúp hệ thống liên tục phát triển và tối ưu hóa hiệu suất qua từng tác vụ.

  16. JiQiZhiXinT7 · 22/08 · 03:15

    GigaBrain-0.7 ra mắt: Mô hình robot đột phá với kiến trúc System-3 và hệ thống 'Tháp đôi' dẫn đầu bảng xếp hạng

    GigaBrain-0.7 thiết lập chuẩn mực mới cho robot thông minh nhờ kiến trúc System-3 cho phép dự đoán hành động trước khi thực thi, đồng thời thống trị bảng xếp hạng RoboColiseum với mô hình 'Tháp đôi' dữ liệu và thuật toán.

  17. Hugging Face Daily PapersT7 · 22/08 · 01:00

    Bài toán khó của Embedder: Dùng LLM thay thế mô hình nhúng truyền thống có đáng không?

    Nghiên cứu so sánh toàn diện cho thấy dù LLM có hiệu suất ngang ngửa mô hình nhúng chuyên dụng, nhưng chi phí vận hành lại đắt gấp 1.400 lần và tốc độ xử lý chậm hơn đáng kể.

  18. Hugging Face Daily PapersT6 · 21/08 · 23:00

    τ_0-VLA: Mô hình nền tảng robot phân cấp với khả năng tính toán linh hoạt nhờ mô hình thế giới

    τ_0-VLA cải thiện khả năng thực hiện các tác vụ robot dài hạn bằng cách cho phép mô hình tự đánh giá và tìm kiếm phương án tối ưu trước khi hành động, thay vì chỉ phản hồi một lần duy nhất.

  19. ModelBest OpenBMBT6 · 21/08 · 20:07

    OpenBMB ra mắt MathForm: Khung làm việc và mô hình mã nguồn mở cho toán học hình thức Lean 4

    OpenBMB giới thiệu MathForm, bộ công cụ toàn diện cho toán học hình thức với tập dữ liệu FormalVerse chứa hơn 367.000 ví dụ. Mô hình đạt hiệu suất vượt trội với độ chính xác 60,32%, dẫn đầu trong các thử nghiệm kiểm chứng toán học tự động.

  20. Hugging Face Daily PapersT6 · 21/08 · 19:30

    Tư duy bằng ngôn ngữ ít tài nguyên: SFT xây dựng gì, RL sửa lỗi gì và những hạn chế của điểm số chính xác

    Nghiên cứu chỉ ra rằng điểm số benchmark thường gây nhiễu, trong khi SFT thực sự giúp mô hình tư duy bằng ngôn ngữ mục tiêu thay vì chỉ dịch thuật ngầm, giúp việc kiểm chứng và sửa lỗi trở nên khả thi hơn.

Phát hành mô hình — Chủ Đề AI · Trang 14 | AIHOT.vn