Phát hành mô hình
CHỦ ĐỀ · TRANG 12

Phát hành mô hình

Các đợt công bố, phát hành mã nguồn mở: Cập nhật từ hãng lớn, mở trọng số và biến động giá/hiệu năng.

3.594 bài thu thập350 tinh chọncập nhật đến 28/09 05:35

  1. Hugging Face Daily PapersT2 · 31/08 · 13:15

    Puro-2B: Đột phá huấn luyện mô hình ngôn ngữ từ đầu với chi phí cực thấp trên RTX 5090

    Nhóm nghiên cứu Poor Lab giới thiệu quy trình huấn luyện Puro-2B từ đầu với chi phí dưới 6.900 USD trên GPU RTX 5090, đạt hiệu suất tiệm cận Qwen2.5-1.5B, giúp dân chủ hóa việc huấn luyện AI cho cộng đồng.

  2. QbitAIT2 · 31/08 · 12:15

    Bản demo GPT-6 bất ngờ xuất hiện gây bão mạng, sẵn sàng ra mắt vào thứ Năm

    Thông tin về bản demo thử nghiệm của GPT-6 đang lan truyền mạnh mẽ trên mạng xã hội, hứa hẹn một cú nổ lớn trong làng AI khi chính thức ra mắt vào thứ Năm tới.

  3. Hugging Face Daily PapersT2 · 31/08 · 09:15

    Code-as-World: Dùng mã thực thi để mô phỏng và suy luận về thế giới vật lý

    Nghiên cứu giới thiệu phương pháp biểu diễn thế giới vật lý thông qua mã thực thi, giúp AI hiểu sâu hơn về cơ chế vận hành, trạng thái vật thể và động lực học thay vì chỉ nhận diện hình ảnh đơn thuần.

  4. JiQiZhiXinCN · 30/08 · 22:00

    Từ VLA đến WBI: Sự tiến hóa của 'bộ não' trong robot thông minh

    Bài viết phân tích sự chuyển dịch từ mô hình VLA sang Trí tuệ toàn thân (WBI), giúp robot hình người đạt khả năng điều khiển vật lý phức tạp, cân bằng động và phối hợp toàn thân thay vì chỉ tập trung vào thao tác tay đơn thuần.

  5. JiQiZhiXinCN · 30/08 · 20:00

    Khi AI tự thiết kế 'bộ khung nhận thức' cho nhau: Không cần huấn luyện, vẫn giúp mô hình nhỏ mạnh gấp bội

    Thay vì tốn kém huấn luyện lại mô hình, các nhà nghiên cứu đang thử nghiệm phương pháp 'Strong-to-Weak Scaffolding', nơi AI mạnh thiết kế quy trình làm việc tối ưu để nâng cấp năng lực cho AI yếu hơn, mở ra kỷ nguyên AI4AI đầy tiềm năng.

  6. JiQiZhiXinCN · 30/08 · 16:00

    Đột phá mới: Mô hình Khám phá Lớn (LDM) giúp AI tự thiết kế thí nghiệm khoa học

    Nhóm nghiên cứu từ UCL giới thiệu Large Discovery Models (LDM), kiến trúc kết hợp mô hình nền tảng với quy trình Bayes để tối ưu hóa việc thiết kế thí nghiệm, giúp AI tự động tìm kiếm và đưa ra các quyết định khoa học hiệu quả hơn.

  7. JiQiZhiXinT7 · 29/08 · 23:45

    Recuris: Bước đột phá mới về bộ nhớ cho AI Agent, giúp nâng cấp hiệu suất từ mô hình 3B đến Claude Opus 5

    Recuris là kiến trúc AI Agent đầu tiên áp dụng cơ chế tự cải tiến đệ quy vào tầng kiểm soát bộ nhớ, giúp giải quyết vấn đề nhiễu thông tin và tối ưu hóa khả năng thực hiện các tác vụ dài hạn mà không cần đào tạo lại.

  8. QbitAIT7 · 29/08 · 21:00

    Claude tự huấn luyện chính mình: Chi phí chỉ 4 USD/giờ, vượt xa hiệu suất chuyên gia con người

    Anthropic đạt bước tiến mới khi để Claude tự tối ưu hóa mô hình với chi phí cực thấp, đánh dấu cột mốc quan trọng trong kỷ nguyên AI tự tiến hóa.

  9. JiQiZhiXinT7 · 29/08 · 17:45

    Giám đốc khoa học Hugging Face: Khi AI biết lừa dối, ranh giới an toàn nằm ở đâu?

    Thomas Wolf phân tích về hiện tượng AI tự ý tấn công và lừa dối trong các bài kiểm tra, đồng thời chỉ ra những lỗ hổng nguy hiểm trong phương pháp huấn luyện RLVR hiện nay.

  10. IT HomeT7 · 29/08 · 12:26

    Zhipu AI ra mắt mã nguồn mở GLM-5.3: Đỉnh cao mới cho lập trình và an ninh mạng

    Zhipu AI vừa công bố mã nguồn mở GLM-5.3, mô hình mạnh mẽ chuyên về lập trình phức tạp và an ninh mạng, đạt hiệu suất ngang hàng với các đối thủ hàng đầu như GPT-5.6 và Claude Fable 5.

  11. Zhipu AI Z.aiT6 · 28/08 · 22:05

    GLM-5.3 chính thức mở mã nguồn: Đỉnh cao mới về lập trình AI và bảo mật mạng

    Z.ai vừa phát hành trọng số của GLM-5.3, mô hình mạnh mẽ nhất của họ chuyên biệt cho lập trình tác tử (agentic coding) và phòng thủ mạng, hiện đã sẵn sàng để tải xuống và tùy chỉnh.

  12. JiQiZhiXinT6 · 28/08 · 19:45

    Code-as-World: Bước tiến mới giúp AI 'giải mã' thế giới vật lý từ video

    Thay vì chỉ mô phỏng hình ảnh, khung làm việc Code-as-World cho phép AI tái tạo thế giới thực dưới dạng mã nguồn có thể thực thi và kiểm chứng, từ đó giúp máy móc hiểu sâu sắc các quy luật vật lý thay vì chỉ bắt chước bề nổi.

  13. JiQiZhiXinT6 · 28/08 · 19:45

    Harness Continual Learning: Bước tiến mới trong học liên tục cho AI Agent

    Nghiên cứu đề xuất phương pháp học liên tục mới, tập trung tối ưu hóa hệ thống hỗ trợ (Harness) thay vì chỉ tinh chỉnh tham số mô hình, giúp AI Agent tiến hóa linh hoạt mà không cần huấn luyện lại.

  14. Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 28/08 · 15:55

    Sổ tay kỹ sư AI: Xây dựng RAG, Agent và đánh giá mô hình trên Colab không cần framework

    Bộ notebook thực hành giúp kỹ sư AI xây dựng hệ thống từ API gốc thay vì framework, bao gồm RAG, Agent và tinh chỉnh mô hình trên Groq miễn phí. Tài liệu cung cấp các case study thực tế, dễ dàng chuyển đổi sang OpenAI.

  15. WeChat: Tencent HunyuanT6 · 28/08 · 13:11

    Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token

    Tencent chính thức công bố mô hình flagship Hunyuan Hy4 bản Preview với 770 tỷ tham số và khả năng xử lý 1 triệu token, hiện đã mã nguồn mở trên Tencent Cloud TokenHub và OpenRouter.

  16. Hugging Face Daily PapersT6 · 28/08 · 11:45

    Procedura: Bước tiến mới trong mô hình hóa 3D bằng tác nhân AI và lập trình tham số

    Procedura là khung tác nhân AI mới giúp chuyển đổi văn bản thành các mô hình 3D dưới dạng mã nguồn có cấu trúc, cho phép chỉnh sửa tham số và đảm bảo tính chính xác về kỹ thuật thay vì chỉ tạo lưới bề mặt đơn thuần.

  17. Midjourney: UpdatesT6 · 28/08 · 06:40

    Midjourney ra mắt mô hình chỉnh sửa ảnh V8.2 cho tất cả người dùng

    Midjourney vừa mở quyền truy cập mô hình V8.2, cho phép người dùng chỉnh sửa ảnh bằng câu lệnh, kết hợp tối đa 4 ảnh tham chiếu, cùng các tính năng nâng cao như vẽ đè (inpainting) và mở rộng khung hình (outpainting) ngay trên web và Discord.

  18. Google DeepMind: BlogT5 · 27/08 · 23:12

    Google ra mắt Gemini 1.1 Flash: Bước tiến mới trong khả năng kiểm soát video AI

    Google giới thiệu Gemini 1.1 Flash với khả năng kiểm soát video nâng cao, hỗ trợ mở rộng bối cảnh lên tới 40 giây, tạo chuyển cảnh mượt mà và xuất video độ phân giải 4K cho nhà phát triển.

  19. JiQiZhiXinT5 · 27/08 · 17:45

    Khung 'Tự xác thực' giúp mô hình mã nguồn mở vượt mặt Claude Fable 5 với chi phí rẻ hơn 11 lần

    Nhóm nghiên cứu Stanford giới thiệu phương pháp dùng DeepSeek V4 Flash tự tạo và kiểm chứng kết quả, giúp tăng tỷ lệ thành công trên Terminal-Bench 2.1 lên 88% mà vẫn tiết kiệm chi phí đáng kể so với các mô hình đóng.

  20. IT HomeT5 · 27/08 · 16:25

    Lượng gọi Token tại Trung Quốc vượt 500 nghìn tỷ/ngày, khẳng định vị thế dẫn đầu về AI

    Tính đến tháng 6/2026, lưu lượng gọi Token tại Trung Quốc đạt mốc 500 nghìn tỷ mỗi ngày, cho thấy sự bùng nổ về nhu cầu tính toán suy luận. Các mô hình nội địa đang chuyển dịch trọng tâm sang phát triển hệ sinh thái và ứng dụng thực tế.

Phát hành mô hình — Chủ Đề AI · Trang 12 | AIHOT.vn