Phát hành mô hình
CHỦ ĐỀ · TRANG 4

Phát hành mô hình

Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.

3.595 bài thu thập350 tinh chọncập nhật đến 28/09 02:09

  1. JiQiZhiXinT7 · 19/09 · 23:30

    KV Cache không cần 'chọn lọc kỹ'? Phương pháp xóa ngẫu nhiên đạt hiệu suất tương đương, tăng tốc độ suy luận tới 43%

    Nghiên cứu mới từ Salesforce và UIUC cho thấy việc xóa ngẫu nhiên các token trong KV Cache mang lại hiệu quả tương đương các thuật toán phức tạp, đồng thời giúp tăng đáng kể tốc độ suy luận nhờ giảm tải tính toán.

  2. JiQiZhiXinT7 · 19/09 · 23:30

    AI giải mã mùi hương: Bước ngoặt đưa khứu giác vào kỷ nguyên số

    Osmo đang tiên phong trong việc số hóa khứu giác bằng AI, chuyển đổi các phân tử hóa học thành dữ liệu để máy tính có thể 'ngửi' và hiểu thế giới như con người, mở ra tiềm năng ứng dụng đột phá trong y tế và tiêu dùng.

  3. JiQiZhiXinT7 · 19/09 · 21:30

    Astra chiếm 13% thị phần chỉ sau 2 tuần, Anthropic nóng lòng tung model mới

    Chỉ sau hai tuần ra mắt, OpenAI Astra đã nhanh chóng chiếm lĩnh thị phần, buộc Anthropic phải cân nhắc đẩy nhanh tiến độ phát hành model mới dù trước đó vừa kêu gọi "giảm tốc" phát triển AI.

  4. QbitAIT7 · 19/09 · 14:15

    Terence Tao đại diện SAIR Foundation khởi động 'Dự án Mô hình Toán học Mở'

    Dự án đặt mục tiêu xây dựng nền tảng chung cho nghiên cứu toán học thông qua các mô hình mã nguồn mở và tài nguyên tính toán chi phí thấp.

  5. OpenRouter: AnnouncementsT7 · 19/09 · 07:00

    OpenRouter thử nghiệm Jev: Khi nào nên dùng mô hình ra quyết định thay vì LLM tạo văn bản?

    OpenRouter so sánh mô hình Jev 1.13 với GPT và Claude trong việc phân loại yêu cầu. Kết quả cho thấy Jev tối ưu hơn hẳn về chi phí và tốc độ, đạt độ chính xác tương đương LLM trong các tác vụ logic cụ thể.

  6. xAI: News (Web)T7 · 19/09 · 00:49

    xAI ra mắt mô hình chuyển đổi giọng nói Grok Voice Transcribe 2.0 với độ chính xác vượt trội

    xAI vừa giới thiệu Grok Voice Transcribe 2.0, cải thiện độ chính xác gấp đôi so với bản tiền nhiệm trong khi giữ nguyên giá. Mô hình này hiện dẫn đầu bảng xếp hạng của Artificial Analysis về khả năng nhận diện đa ngôn ngữ và giảm đáng kể tỷ lệ lỗi từ ngữ.

  7. Qwen: Blog Retrieval (API)T6 · 18/09 · 22:48

    Qwen ra mắt mô hình dịch thuật trực tiếp Qwen3.8-LiveTranslate với độ trễ chỉ 2,3 giây

    Qwen giới thiệu Qwen3.8-LiveTranslate sử dụng kiến trúc Interleave và thiết kế Hybrid-MoE, giúp giảm độ trễ trung bình (LAAL) từ 2,8 giây xuống còn 2,3 giây cho trải nghiệm dịch thuật thời gian thực mượt mà hơn.

  8. QbitAIT6 · 18/09 · 20:30

    Cuộc chiến AGI: Google và Amazon đối đầu, LimiX-2 từ Trung Quốc bất ngờ bứt phá

    LimiX-2 tạo đột phá khi giúp mô hình AI thấu hiểu cơ chế nhân quả đằng sau dữ liệu, vượt mặt các ông lớn công nghệ trong cuộc đua AGI.

  9. JiQiZhiXinT6 · 18/09 · 19:30

    Samsung ra mắt TrOPD: Đưa trí tuệ AI cao cấp vào thiết bị di động với chi phí tối ưu

    Samsung phối hợp cùng Oxford và Đại học Bắc Kinh giới thiệu phương pháp TrOPD, giúp mô hình nhỏ học hỏi hiệu quả từ mô hình lớn thông qua cơ chế 'vùng tin cậy', giải quyết bài toán đưa AI mạnh mẽ lên hàng triệu thiết bị di động mà vẫn tiết kiệm tài nguyên.

  10. JiQiZhiXinT6 · 18/09 · 19:30

    Sau dự đoán của Hinton: Mô hình AI chẩn đoán hình ảnh y tế của Alibaba chính thức lên tạp chí Science

    Alibaba DAMO Academy vừa công bố mô hình RADAR, một bước tiến đột phá trong chẩn đoán hình ảnh bụng bằng CT, đạt trình độ chuyên gia và được đăng tải trên tạp chí khoa học danh giá Science.

  11. JiQiZhiXinT6 · 18/09 · 19:30

    EMNLP 2026: Tại sao LLM lại trả lời sai dù thực tế đã 'biết' đáp án?

    Nghiên cứu từ Đại học Bắc Kinh và YIXIN AI Lab chỉ ra rằng LLM thường trả lời sai do 'nút thắt đọc dữ liệu' (Readout Bottleneck), nơi đáp án đúng đã tồn tại trong trạng thái ẩn nhưng bị sai lệch khi chuyển đổi thành kết quả đầu ra.

  12. JiQiZhiXinT6 · 18/09 · 15:30

    Claude tự tiến hóa thần tốc: Tỷ lệ AI chủ đạo công việc tăng từ 1% lên 26% chỉ trong nửa năm

    Anthropic công bố bước tiến đột phá khi AI hiện đã đảm nhận 26% khối lượng công việc nghiên cứu nội bộ, đánh dấu sự chuyển dịch mạnh mẽ sang kỷ nguyên AI tự vận hành và tự cải tiến.

  13. HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)T6 · 18/09 · 10:10

    DeepSeek-V4.1-Flash ra mắt: Mô hình MoE 552B đa phương thức với công nghệ nén KV cache đột phá

    DeepSeek vừa trình làng DeepSeek-V4.1-Flash, mô hình MoE đa phương thức 552 tỷ tham số hỗ trợ cửa sổ ngữ cảnh lên tới 1 triệu token, hiện đã có sẵn trên Hugging Face.

  14. WeChat: KhazixT6 · 18/09 · 07:20

    TypeSafe AI ra mắt Jev: Mô hình chuyên biệt cho quyết định tần suất cao, nhanh gấp 200 lần

    Jev là mô hình AI chuyên xử lý các quyết định logic thay vì tạo văn bản, giúp tăng tốc độ xử lý gấp 20-200 lần với chi phí cực thấp. Kết quả thực tế cho thấy Jev đạt hiệu suất vượt trội trong các tác vụ phân loại và sàng lọc dữ liệu song song.

  15. Goodfire Research (Web)T5 · 17/09 · 23:38

    Goodfire phát hiện tín hiệu 'gian lận phần thưởng' trong mô hình AI, cho phép giám sát thời gian thực

    Goodfire Research đã tìm ra các tín hiệu kích hoạt nội bộ báo hiệu hành vi gian lận phần thưởng của AI. Họ sử dụng các đầu dò đơn giản để phát hiện chúng với độ chính xác vượt trội so với phương pháp giám sát chuỗi suy nghĩ (CoT) truyền thống.

  16. JiQiZhiXinT5 · 17/09 · 21:15

    ZDTaichu 5.0-9B: Mô hình mã nguồn mở 9B mạnh nhất cho trí tuệ nhân tạo hiện thân

    ZDTaichu 5.0-9B thiết lập tiêu chuẩn mới cho các mô hình dưới 10B, dẫn đầu 8/9 bảng xếp hạng về trí tuệ nhân tạo không gian và vượt mặt nhiều đối thủ lớn nhờ công nghệ suy luận vòng lặp thích ứng.

  17. JiQiZhiXinT5 · 17/09 · 21:15

    Sharpa Robotics công bố mô hình World Synesthesia: Đột phá điều khiển bàn tay robot linh hoạt trong môi trường thực tế

    Được vinh danh tại CoRL 2026, mô hình World Synesthesia (WSM) tích hợp thị giác, xúc giác và cảm giác bản thể để giúp bàn tay robot 22 bậc tự do xử lý nhiễu cảm biến và ngoại lực, cho phép thao tác vật thể ổn định ngay cả với các vật thể chưa từng gặp.

  18. JiQiZhiXinT5 · 17/09 · 19:15

    Khi Anthropic và Isomorphic chạy đua AI dược phẩm: Anew Labs là ai mà gọi vốn thành công 290 triệu USD?

    Cuộc đua AI trong ngành dược đang nóng lên khi các ông lớn công nghệ và startup chuyên biệt hội tụ. Anew Labs vừa lộ diện với khoản đầu tư 290 triệu USD và mô hình AnewMind, khẳng định vị thế cạnh tranh trực tiếp với các tên tuổi hàng đầu như Anthropic và Isomorphic Labs.

  19. JiQiZhiXinT5 · 17/09 · 19:15

    Cựu chuyên gia OpenAI ra mắt Jev: Mô hình AI 'câm lặng' giúp tăng tốc xử lý dữ liệu gấp 200 lần

    Thay vì tạo văn bản như ChatGPT, mô hình Jev của cựu kỹ sư OpenAI tập trung vào việc đưa ra các quyết định có cấu trúc với tốc độ cực nhanh và chi phí tối ưu, mở ra hướng đi mới cho tự động hóa phần mềm.

  20. JiQiZhiXinT5 · 17/09 · 19:15

    Bảo mật AI Agent: Không thể chỉ dựa vào Prompt, Thượng Hải AI Lab đề xuất mô hình tiến hóa mới

    Thượng Hải AI Lab cùng các đại học hàng đầu giới thiệu SHE và SafeEvolve, chuyển dịch từ việc chỉ kiểm soát Prompt sang quản lý toàn diện quy trình thực thi của AI Agent để ngăn chặn rủi ro bảo mật từ môi trường và công cụ.

Phát hành mô hình — Chủ Đề AI · Trang 4 | AIHOT.vn