Tất cả chủ đề
CHỦ ĐỀ

Tạo ảnh AI

Tiền tuyến vẽ tranh AI: Mô hình văn bản sang ảnh, chỉnh sửa ảnh thông minh và hệ sinh thái công cụ sáng tạo.

390 bài thu thập26 tinh chọncập nhật đến 27/09 21:36

Tiêu điểm gần đây

14 ngày qua, xếp theo số nguồn độc lập cùng đưa tin
  1. Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint10 nguồn · 21-09
  2. Tencent Hunyuan ra mắt mô hình tạo ảnh Hy Image 3.5 Preview6 nguồn · 21-09
  3. Ứng dụng Muse cập nhật tính năng kết nối Notion và Granola4 nguồn · 19-09
  4. Black Forest Labs ra mắt FLUX 3 Action: Mô hình hành động thế giới 7B mã nguồn mở3 nguồn · 25-09
  5. Tencent ra mắt mô hình tạo ảnh chuyên nghiệp Hunyuan Image 3.5 Preview3 nguồn · 22-09

25/09

Thứ Sáu · 1 tin
JiQiZhiXin
Điểm AI 88/100

KwaiMind: Mô hình AI chỉnh sửa ảnh thương mại điện tử thấu hiểu tâm lý người dùng

KwaiMind là mô hình nền tảng từ Kuaishou giúp tối ưu hóa hình ảnh sản phẩm thương mại điện tử, hỗ trợ chỉnh sửa chi tiết, thay đổi bối cảnh và tăng tỷ lệ nhấp chuột thực tế lên 2,44%.


Vì sao đáng đọc: Tin tức chuyên sâu về ứng dụng AI thực tế trong thương mại điện tử với số liệu kiểm chứng cụ thể, có giá trị cao cho người làm kinh doanh và kỹ thuật.

24/09

Thứ Năm · 1 tin
Runway: News (Web)
Điểm AI 62/100

Runway ra mắt plugin cho DaVinci Resolve: Tạo và chỉnh sửa video trực tiếp trong phần mềm dựng phim

Runway vừa phát hành plugin cho DaVinci Resolve Studio, cho phép người dùng tạo hình ảnh, video và thực hiện inpainting (vẽ lại) trực tiếp trên timeline mà không cần chuyển đổi ứng dụng.


Vì sao đáng đọc: Đây là bước tiến lớn giúp tối ưu hóa quy trình làm việc cho các nhà làm phim chuyên nghiệp, kết hợp sức mạnh AI của Runway vào công cụ dựng phim tiêu chuẩn ngành.

23/09

Thứ Tư · 1 tin
Qwen@Alibaba_Qwen
Điểm AI 64/100

Qwen-Image-2.1 dẫn đầu bảng xếp hạng mã nguồn mở về chỉnh sửa và tạo ảnh trên Arena

Thanks @arena for the recognition! 🏆 Qwen-Image-2.1 is now the #1 open-source model in both the Ima…

DịchAlibaba thông báo Qwen-Image-2.1 đã vươn lên vị trí số 1 trong các mô hình mã nguồn mở trên bảng xếp hạng Arena cho cả hai hạng mục chỉnh sửa ảnh và tạo ảnh từ văn bản.


Vì sao đáng đọc: Bài viết cung cấp thứ hạng số 1 về mã nguồn mở và điểm số cụ thể từ hai bảng xếp hạng Arena, giúp độc giả so sánh trình độ hiện tại của các mô hình hình ảnh mã nguồn mở.

22/09

Thứ Ba · 1 tin
Tencent Hunyuan: Research (API)
Điểm AI 60/100

Tencent Hunyuan ra mắt mô hình tạo ảnh Hy Image 3.5 Preview

Hy Image 3.5 hỗ trợ tạo ảnh từ văn bản và hình ảnh, cho phép sử dụng tối đa 5 ảnh tham chiếu, chỉnh sửa đa vòng và xuất ảnh độ phân giải 2K. Mô hình đạt hiệu suất vượt trội hơn 30% so với thế hệ trước trong các bài kiểm tra mù của chuyên gia.

Diễn biến sự kiện · 4 bài →Thêm 5 nguồn khác đưa tinX: X.PIN (@thexpin)IT HomeX: Tencent Hunyuan (@TencentHunyuan)X: Rohan Paul (@rohanpaul_ai)WeChat: Tencent Hunyuan
Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ một ông lớn công nghệ, cải thiện đáng kể khả năng kiểm soát hình ảnh và chất lượng đầu ra, rất đáng chú ý trong cộng đồng AI.

21/09

Thứ Hai · 2 tin
Qwen@Alibaba_Qwen
Điểm AI 69/100

Alibaba ra mắt Qwen-Image-2.1: Mô hình 7B tích hợp tạo và chỉnh sửa ảnh trong một checkpoint

Qwen-Image-2.1 × @HuggingApps: live demo on Spaces! 🖼 One single checkpoint for generation and edit…

DịchQwen-Image-2.1 là mô hình 7B mới từ Alibaba, hỗ trợ tạo và chỉnh sửa ảnh linh hoạt với tối đa 10 ảnh tham chiếu. Mô hình tích hợp sẵn LLM tăng cường gợi ý, hỗ trợ ComfyUI và có bản demo trực tuyến trên Hugging Face.

Thêm 5 nguồn khác đưa tinX: Arena (@arena)MarkTechPostPandailyTechNodeX: Alibaba Cloud (@alibaba_cloud)
Vì sao đáng đọc: Đây là bước tiến quan trọng của Qwen trong lĩnh vực đa phương thức, tối ưu hóa hiệu năng với mô hình 7B gọn nhẹ và khả năng chỉnh sửa ảnh thực tế.
JiQiZhiXin
Điểm AI 92/100

Qwen-Image-2.1: Đỉnh cao mới của mô hình tạo ảnh mã nguồn mở

Alibaba vừa ra mắt Qwen-Image-2.1, mô hình tạo ảnh mã nguồn mở 7B mạnh mẽ nhất hiện nay. Với khả năng chỉnh sửa cục bộ, tạo ảnh trong suốt và độ chính xác cao, đây là công cụ đắc lực cho thiết kế chuyên nghiệp và thương mại điện tử.


Vì sao đáng đọc: Đây là bước tiến lớn của mô hình mã nguồn mở với hiệu suất vượt trội so với các đối thủ cùng phân khúc, có tính ứng dụng thực tế cao cho cộng đồng sáng tạo.

20/09

Chủ Nhật · 1 tin
Qwen@Alibaba_Qwen
Điểm AI 69/100

Qwen-Image-2.1 chính thức hỗ trợ ComfyUI, mở quyền truy cập mã nguồn

Qwen-Image-2.1 is now supported in ComfyUI! Try it now and share your creations! 🖼️

DịchMô hình Qwen-Image-2.1 (7B) hiện đã hỗ trợ ComfyUI, cho phép tạo và chỉnh sửa ảnh 2K chất lượng cao. Người dùng có thể sử dụng tối đa 10 ảnh tham chiếu để điều khiển chỉnh sửa và xuất file RGBA chuyên nghiệp.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng cho cộng đồng sáng tạo nội dung AI, giúp tích hợp mô hình mạnh mẽ của Alibaba vào quy trình làm việc chuyên nghiệp trên ComfyUI.

18/09

Thứ Sáu · 1 tin
OpenRouter: Announcements
Điểm AI 70/100

So sánh chi phí, chất lượng và khả năng chỉnh sửa của 20 mô hình tạo ảnh trên OpenRouter

OpenRouter đã thử nghiệm 20 mô hình tạo ảnh với cùng một câu lệnh, cho thấy sự chênh lệch chi phí lên tới 22 lần, dao động từ 0,006 USD đến 0,134 USD mỗi ảnh.


Vì sao đáng đọc: Thông tin thực tế, hữu ích cho người dùng muốn tối ưu chi phí và lựa chọn mô hình tạo ảnh phù hợp nhất với nhu cầu.

10/09

Thứ Năm · 5 tin
Google AI@GoogleAI
Điểm AI 67/100

Google ra mắt công cụ chỉnh sửa ảnh Pics: Tích hợp AI Nano Banana, hỗ trợ cộng tác thời gian thực

Bring your imagination to life with Google Pics. Built with Nano Banana, Pics makes it easy to gene…

DịchGoogle vừa giới thiệu Pics (pics.new), công cụ chỉnh sửa ảnh mạnh mẽ dựa trên mô hình Nano Banana, cho phép người dùng chỉnh sửa chi tiết, thay đổi văn bản trong ảnh và cộng tác nhóm dễ dàng.


Vì sao đáng đọc: Sản phẩm thực tế từ Google với tính năng chỉnh sửa chuyên sâu, có tính ứng dụng cao cho người dùng phổ thông và chuyên nghiệp.
Hugging Face: Blog
Điểm AI 65/100

Hugging Face ra mắt Workflow1111: Tái hiện sức mạnh của AUTOMATIC1111 bằng Gradio

Hugging Face giới thiệu Workflow1111, sử dụng 73 node Gradio để tái lập hầu hết các tính năng chủ chốt của AUTOMATIC1111, từ tạo ảnh, inpaint, ControlNet đến hỗ trợ video, mang lại trải nghiệm linh hoạt và trực quan hơn.


Vì sao đáng đọc: Đây là bước tiến quan trọng giúp đơn giản hóa quy trình làm việc với Stable Diffusion, biến các tính năng phức tạp thành luồng công việc trực quan, rất hữu ích cho cộng đồng AI.
QbitAI
Điểm AI 92/100

ChatGPT Images 2.5 ra mắt: Bước tiến mới trong kỷ nguyên AGI với khả năng tạo ảnh siêu tốc

Phiên bản mới tập trung cải thiện tốc độ tạo ảnh, độ chi tiết vượt trội và tính năng chỉnh sửa ảnh chuyên nghiệp như người thật.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ OpenAI, đánh dấu bước tiến lớn trong khả năng xử lý hình ảnh của AI, thu hút sự quan tâm lớn từ cộng đồng công nghệ.
IT Home
Điểm AI 92/100

macOS 27 RC ra mắt: Siri tích hợp Apple Intelligence, nâng cấp chỉnh sửa ảnh và Safari

Apple phát hành macOS 27 RC với Siri AI thông minh hơn, tính năng Visual Intelligence cho phép tương tác trực tiếp với nội dung màn hình, cùng các công cụ chỉnh sửa ảnh và duyệt web Safari được cải tiến mạnh mẽ.


Vì sao đáng đọc: Đây là bản cập nhật lớn mang tính bước ngoặt cho hệ sinh thái Apple, tích hợp sâu AI vào hệ điều hành, thu hút sự quan tâm lớn từ người dùng công nghệ.
IT Home
Điểm AI 92/100

Apple phát hành iOS/iPadOS 27 RC: Nâng cấp Siri AI toàn diện và tính năng thông minh mới

Bản cập nhật iOS/iPadOS 27 RC mang đến Siri AI thông minh hơn với khả năng hiểu ngữ cảnh, tích hợp sâu vào ứng dụng và các công cụ chỉnh sửa ảnh, duyệt web bằng Apple Intelligence cho dòng iPhone 15 Pro trở lên.


Vì sao đáng đọc: Đây là thông tin quan trọng về hệ điều hành di động phổ biến nhất, đánh dấu bước tiến lớn của Apple trong việc tích hợp AI sâu vào trải nghiệm người dùng.

09/09

Thứ Tư · 3 tin
Hugging Face Daily Papers
Điểm AI 88/100

RelightFormer: Transformer tạo ảnh thế hệ mới cho kỹ thuật chiếu sáng vật thể đa góc nhìn

RelightFormer là mô hình Transformer đột phá giúp tái chiếu sáng vật thể từ một hoặc nhiều góc nhìn mà không cần ước tính các thuộc tính vật lý phức tạp. Bằng cách tận dụng dữ liệu từ bộ dataset LOD khổng lồ, mô hình đạt độ chính xác cao trong việc mô phỏng tương tác ánh sáng 3D.


Vì sao đáng đọc: Đây là bước tiến quan trọng trong lĩnh vực đồ họa máy tính và AI tạo sinh, giải quyết bài toán khó về chiếu sáng 3D bằng cách bỏ qua các quy trình render truyền thống.
OpenRouter: Announcements
Điểm AI 64/100

Hướng dẫn sử dụng API OpenRouter để chỉnh sửa ảnh với Nano Banana 2

OpenRouter chia sẻ hướng dẫn chi tiết cách dùng API để chỉnh sửa ảnh bằng mô hình Nano Banana 2, kèm ví dụ code Python/TypeScript và mẹo tối ưu hóa kết quả.


Vì sao đáng đọc: Hướng dẫn thực tế, có code mẫu cụ thể cho lập trình viên, rất hữu ích cho những ai đang tìm cách tích hợp AI vào quy trình xử lý ảnh.
OpenAI@OpenAI
Điểm AI 56/100

OpenAI ra mắt ChatGPT Images 2.5: Tạo ảnh nhanh hơn, sắc nét và thông minh hơn

ChatGPT Images 2.5-faster, sharper, smarter, with better tools for creating whatever you can dream o…

DịchOpenAI vừa nâng cấp ChatGPT Images 2.5 với tốc độ tạo ảnh vượt trội, độ chi tiết cao và khả năng chỉnh sửa cục bộ thông minh, giúp giữ vững sự nhất quán trong các lần thay đổi.

Diễn biến sự kiện · 29 bài →Thêm 6 nguồn khác đưa tinX: OpenAI Developers (@OpenAIDevs)X: Runway (@runwayml)X: Luma AI (@LumaLabsAI)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: Tibo (@thsottiaux)X: Greg Brockman (@gdb)
Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ OpenAI cho công cụ tạo ảnh, cải thiện trực tiếp trải nghiệm người dùng về tốc độ và tính năng chỉnh sửa, rất đáng chú ý.

08/09

Thứ Ba · 1 tin
JiQiZhiXin
Điểm AI 92/100

LLaDA-Image: Đột phá mô hình tạo ảnh từ văn bản không cần tiền huấn luyện cặp ảnh-chữ

LLaDA-Image là mô hình Diffusion Transformer 6B mới, ưu tiên học cấu trúc hình ảnh trước khi thực hiện căn chỉnh ngôn ngữ, giúp đạt hiệu suất dẫn đầu trên bảng xếp hạng Qwen-Image-Bench.


Vì sao đáng đọc: Đây là bước tiến quan trọng trong kiến trúc tạo ảnh, thay đổi tư duy huấn luyện truyền thống bằng cách tách biệt việc học hình ảnh và ngôn ngữ, có tính ứng dụng và tham khảo cao.

05/09

Thứ Bảy · 1 tin
JiQiZhiXin
Điểm AI 88/100

Phó chủ tịch Qualcomm: Tại sao AI tạo ảnh vẫn chưa đạt được độ kiểm soát chính xác?

Dù AI tạo ảnh đã rất ấn tượng về thị giác, nhưng vẫn gặp khó khăn trong việc duy trì danh tính nhân vật và bố cục phức tạp. Bài viết phân tích các giải pháp kỹ thuật mới từ Qualcomm nhằm giúp AI trở nên đáng tin cậy và có tính ứng dụng cao hơn trong công việc chuyên nghiệp.


Vì sao đáng đọc: Bài viết đi sâu vào các rào cản kỹ thuật thực tế của AI tạo ảnh, cung cấp góc nhìn chuyên môn từ lãnh đạo Qualcomm và giải pháp cụ thể (Disco), rất hữu ích cho người làm chuyên môn.

03/09

Thứ Năm · 1 tin
JiQiZhiXin
Điểm AI 92/100

Apple đột phá với IVT: Tư duy thị giác nội tại giúp tăng tốc suy luận video gấp 5 lần

Apple giới thiệu khung huấn luyện IVT, cho phép mô hình học cách dự đoán tương lai thông qua biểu diễn ẩn thay vì phải tạo ảnh trực tiếp, giúp tăng tốc độ suy luận video gấp 5 lần mà vẫn giữ được độ chính xác.


Vì sao đáng đọc: Nghiên cứu quan trọng từ Apple giải quyết bài toán tối ưu hóa suy luận video thời gian thực, có tính ứng dụng cao trong robot và trợ lý ảo.

01/09

Thứ Ba · 1 tin
Google Blog: AI
Điểm AI 61/100

Google Workspace ra mắt Google Pics: Công cụ chỉnh sửa và tạo ảnh bằng AI

Google vừa giới thiệu Google Pics, công cụ hỗ trợ tạo và chỉnh sửa hình ảnh tích hợp trong Workspace, dự kiến triển khai cho người dùng gói AI Pro, Ultra và khách hàng doanh nghiệp trong vài tuần tới.

Diễn biến sự kiện · 3 bài →
Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ Google, trực tiếp ảnh hưởng đến quy trình làm việc của hàng triệu người dùng văn phòng, tính ứng dụng thực tế rất cao.

28/08

Thứ Sáu · 1 tin
Midjourney: Updates
Điểm AI 64/100

Midjourney ra mắt mô hình chỉnh sửa ảnh V8.2 cho tất cả người dùng

Midjourney vừa mở quyền truy cập mô hình V8.2, cho phép người dùng chỉnh sửa ảnh bằng câu lệnh, kết hợp tối đa 4 ảnh tham chiếu, cùng các tính năng nâng cao như vẽ đè (inpainting) và mở rộng khung hình (outpainting) ngay trên web và Discord.


Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ công cụ tạo ảnh hàng đầu, mang đến khả năng kiểm soát hình ảnh chuyên sâu vốn được cộng đồng mong đợi từ lâu.

23/08

Chủ Nhật · 1 tin
JiQiZhiXin
Điểm AI 92/100

Đại học Princeton công bố i1: Công thức mở hoàn chỉnh cho mô hình tạo ảnh từ văn bản

Nhóm nghiên cứu tại Princeton đã thực hiện hơn 300 thí nghiệm với 700.000 giờ TPU để tạo ra i1, một mô hình tạo ảnh 3B tham số hoàn toàn mở, vượt trội hơn các mô hình mã nguồn mở hiện có tới 29,5% trên các bài kiểm tra tiêu chuẩn.


Vì sao đáng đọc: Đây là bước tiến quan trọng cho cộng đồng mã nguồn mở, cung cấp dữ liệu và công thức huấn luyện minh bạch, giúp chuẩn hóa nghiên cứu trong lĩnh vực tạo ảnh AI.

19/08

Thứ Tư · 1 tin
Hugging Face Daily Papers
Điểm AI 88/100

IVT: Bước tiến mới giúp AI 'tư duy hình ảnh nội tại' để dự đoán video chủ động

IVT là phương pháp huấn luyện giúp mô hình AI dự đoán các khung hình tương lai mà không cần tạo ảnh trung gian, giúp tăng tốc độ xử lý video mà vẫn giữ được khả năng suy luận logic.


Vì sao đáng đọc: Giải quyết trực diện vấn đề độ trễ của Visual CoT trong xử lý video, một thách thức lớn trong thực tế. Phương pháp tiếp cận mới mẻ và có tính ứng dụng cao.

18/08

Thứ Ba · 1 tin
Ant Group inclusionAI: GitHub kho mã mới
Điểm AI 64/100

Ant Group ra mắt ConceptEdit: Công cụ mã nguồn mở tạo dữ liệu chỉnh sửa ảnh bằng AI

ConceptEdit là quy trình tự động tạo tập dữ liệu chỉnh sửa ảnh quy mô lớn thông qua ba bước: tạo lệnh bằng VLM, thực thi chỉnh sửa với FLUX và đánh giá bằng VQA, giúp tối ưu hóa việc huấn luyện các mô hình chỉnh sửa hình ảnh.


Vì sao đáng đọc: Đây là công cụ hữu ích cho cộng đồng nghiên cứu AI, giải quyết bài toán thiếu hụt dữ liệu chất lượng cao cho các mô hình chỉnh sửa ảnh, có tính ứng dụng thực tiễn cao.

17/08

Thứ Hai · 1 tin
Hugging Face Daily Papers
Điểm AI 88/100

Marionette: Mô hình thế giới game đột phá bằng cách tách biệt trạng thái 3D và kết xuất hình ảnh

Marionette cải thiện tính nhất quán trong game bằng cách tách biệt việc dự đoán trạng thái 3D của nhân vật với quá trình kết xuất hình ảnh, giúp kiểm soát chuyển động và hình học chính xác hơn so với các mô hình tạo ảnh pixel truyền thống.


Vì sao đáng đọc: Phương pháp tiếp cận mới lạ, giải quyết vấn đề tích tụ lỗi trong mô hình thế giới game bằng cách kết hợp tư duy đồ họa truyền thống với AI, có tính ứng dụng cao.

12/08

Thứ Tư · 1 tin
JiQiZhiXin
Điểm AI 92/100

Đột phá từ ByteDance: Tối ưu hóa mô hình tạo ảnh bằng 'Structured Prompt' thay vì chỉ tăng độ dài văn bản

Nhóm Seed của ByteDance phát hiện rằng thông tin hình ảnh trong Caption quan trọng hơn độ dài văn bản. Họ đề xuất Structured Prompt giúp cải thiện đáng kể khả năng suy luận và hiểu biết thế giới của các mô hình khuếch tán.


Vì sao đáng đọc: Nghiên cứu giải quyết vấn đề cốt lõi trong huấn luyện mô hình tạo ảnh, đưa ra phương pháp tối ưu hóa hiệu quả thay vì chỉ chạy đua tài nguyên phần cứng.
Không còn tin nào nữa
Tạo ảnh AI — Chủ Đề AI | AIHOT.vn