Hôm qua · 27/09

Chủ Nhật · 1 tin
IT Home
Mô hìnhĐiểm AI 38/100

Cùng sự kiệnMiniMax ra mắt mô hình M3.1-Flash-Preview trên nền tảng MiniMax Code, tặng kèm thẻ reset hạn mức

MiniMax vừa chính thức cập nhật mô hình M3.1-Flash-Preview lên nền tảng MiniMax Code và gửi tặng thẻ reset hạn mức cho toàn bộ người dùng Token Plan.

Cùng sự kiện, bài đại diện «MiniMax-M3.1 Flash Preview chính thức ra mắt trên Token Plan»

26/09

Thứ Bảy · 4 tin
Meituan LongCat@Meituan_LongCat
Mô hìnhĐiểm AI 34/100

Cùng sự kiệnMô hình LongCat-2.5-Preview cho phép dùng thử miễn phí 2 tuần trên OpenCode

LongCat-2.5-Preview is now free to try on @opencode for two weeks! 🐱 Give it a spin and show us wha…

DịchLongCat-2.5-Preview hiện đã có mặt trên OpenCode với thời gian dùng thử miễn phí 2 tuần. Mô hình hỗ trợ cửa sổ ngữ cảnh 1 triệu token, khả năng đa phương thức và cam kết không lưu trữ dữ liệu người dùng.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
IT Home
Mô hìnhĐiểm AI 63/100

Cùng sự kiệnMeituan ra mắt mô hình LongCat-2.5-Preview: 1.6 nghìn tỷ tham số, tối ưu cho tác vụ dài và đa phương thức

Nền tảng API của Meituan đã chính thức phát hành mô hình LongCat-2.5-Preview vào ngày 25/9, đồng thời mở cổng trải nghiệm qua API và giao diện web.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
OpenRouter@OpenRouter
Sản phẩmĐiểm AI 35/100

OpenRouter ra mắt Jev Router: Bộ định tuyến mô hình thông minh tối ưu hóa bộ nhớ đệm

Introducing typesafe/jev-router: a cache-aware model router powered by Jev and @typesafeai The Jev …

DịchOpenRouter giới thiệu Jev Router, công cụ định tuyến mô hình tích hợp Jev và @typesafeai giúp tự động chọn mô hình tối ưu cho từng yêu cầu, cân bằng hoàn hảo giữa chất lượng, tốc độ và chi phí.

Arena@arena
Mô hìnhĐiểm AI 27/100

Cùng sự kiệnTuần lễ bùng nổ: GPT-6 Sol và Claude Opus 5.5 chính thức lộ diện

This Week in the Arena: the arrival of GPT-6 Sol, Claude Opus 5.5, and the latest AI news in less th…

DịchCập nhật nhanh các tin tức AI nổi bật trong tuần, tâm điểm là sự xuất hiện của hai siêu phẩm GPT-6 Sol và Claude Opus 5.5 trên bảng xếp hạng Arena.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»

25/09

Thứ Sáu · 3 tin
karminski@karminski3
Mô hìnhĐiểm AI 58/100

Cùng sự kiệnMeituan ra mắt LongCat-2.5-Preview: Giữ nguyên giá, hỗ trợ cửa sổ ngữ cảnh 1M token

Meituan vừa phát hành LongCat-2.5-Preview với 1.6T tham số, hỗ trợ 1M token và khả năng đa phương thức mạnh mẽ cho các tác vụ dài. Mô hình tối ưu cho nhiều tác vụ từ trình duyệt đến thiết kế, hiện đã có thể truy cập qua API và giao diện chat.

Cùng sự kiện, bài đại diện «Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc»
karminski@karminski3
Mô hìnhĐiểm AI 43/100

Đánh giá Step-5-Preview: Khả năng lập trình ổn định và tư duy Agent vượt trội

Step-5-Preview gây ấn tượng với độ ổn định đầu ra cao và khả năng xử lý Agent Loop xuất sắc, đặc biệt hiệu quả trong lập trình kỹ thuật. Dù còn hạn chế về thẩm mỹ và 3D, đây là bước tiến lớn về tư duy logic và tối ưu hóa tác vụ của mô hình.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 38/100

Dynamic Abliteration: Kỹ thuật loại bỏ từ chối không làm thay đổi trọng số trên Qwen3-4B

Phương pháp Dynamic Abliteration sử dụng PyTorch forward hooks để can thiệp vào luồng dư đa tầng, giúp vô hiệu hóa hành vi từ chối của Qwen3-4B mà không cần chỉnh sửa trọng số gốc, đảm bảo hiệu năng mô hình được giữ nguyên vẹn.

24/09

Thứ Năm · 13 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnGiải mã tư duy ẩn: Khai thác và phân tích chuỗi suy luận (CoT) trong các mô hình AI tiên tiến

Nghiên cứu này giới thiệu phương pháp trích xuất chuỗi suy luận ẩn từ các mô hình đóng như GPT-6 Astra, chứng minh rằng các bước suy luận này cải thiện đáng kể hiệu suất trong toán học, khoa học và lập trình.


Vì sao đáng đọc: Nghiên cứu mang tính đột phá khi tìm ra cách 'đọc' tư duy của các mô hình đóng, cung cấp cái nhìn sâu sắc về cách AI thực sự suy luận thay vì chỉ đưa ra kết quả.
WeChat: Baidu AI Cloud (ERNIE)
Mô hìnhĐiểm AI 25/100

Mô hình AI y tế của Baidu Cloud dẫn đầu bảng xếp hạng MedBench với 76,1 điểm

Mô hình AI y tế của Baidu Cloud vừa chiếm lĩnh vị trí số 1 trên bảng xếp hạng MedBench nhờ khả năng suy luận và hiểu ngôn ngữ y khoa vượt trội. Hiện tại, giải pháp này đã được triển khai tại hơn 800 bệnh viện và 4.000 cơ sở y tế cơ sở.

IT Home
Mô hìnhĐiểm AI 43/100

Cùng sự kiệnGoogle xác nhận Gemini 4 đang trong giai đoạn hậu huấn luyện, dự kiến ra mắt sớm

Lãnh đạo Google DeepMind xác nhận Gemini 4 đã bước vào giai đoạn hậu huấn luyện và đang được thử nghiệm nội bộ. Mô hình thế hệ mới này dự kiến sẽ ra mắt sớm hơn nhiều so với dự kiến cuối năm.

Cùng sự kiện, bài đại diện «Google xác nhận Gemini 4 đang trong giai đoạn hậu huấn luyện, sắp sửa ra mắt»
JiQiZhiXin
Quan điểmĐiểm AI 85/100

Từ AI xây dựng AI đến RSI thực thụ: Giải mã chi tiết lộ trình 'tự tiến hóa' tại sự kiện Triple T

Sự kiện Triple T tại Trương Giang đã đi sâu vào lộ trình hiện thực hóa khả năng tự cải thiện đệ quy (RSI) của AI, tập trung vào việc kết nối các vòng lặp khép kín giữa tác nhân, môi trường, dữ liệu và mô hình để giảm thiểu sự phụ thuộc vào con người.

Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 41/100

Google xác nhận Gemini 4 đang trong giai đoạn hậu huấn luyện, sắp sửa ra mắt

Google DeepMind chief Koray Kavukcuoglu says Gemini 4 is now in post-training and nearing release. …

DịchGiám đốc Google DeepMind, Koray Kavukcuoglu, cho biết Gemini 4 đã bước vào giai đoạn hậu huấn luyện. Google dự kiến sẽ tung ra phiên bản sớm trước cuối năm nay để bắt đầu quá trình cải tiến nhanh chóng.

Diễn biến sự kiện · 5 bài →Thêm 3 nguồn khác đưa tinThe Decoder: AI NewsThe Verge: AIIT Home
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 52/100

Công bố báo cáo kỹ thuật Hunyuan-A13B: Mô hình MoE mã nguồn mở với 80B tham số và 13B tham số kích hoạt

Tencent giới thiệu Hunyuan-A13B, mô hình MoE tối ưu hiệu suất với 80B tham số tổng nhưng chỉ kích hoạt 13B khi suy luận. Điểm nhấn là khung tư duy kép (Chain-of-Thought) giúp cân bằng tốc độ xử lý cho các câu hỏi đơn giản và độ chính xác cho các bài toán phức tạp.

Don't Worry About the Vase (Zvi)
Mô hìnhĐiểm AI 92/100

Cùng sự kiệnClaude Opus 5.5: Bản báo cáo hệ thống chi tiết

Khám phá Claude Opus 5.5, mô hình AI mạnh mẽ nhất thế giới hiện nay theo các bảng xếp hạng uy tín như Artificial Analysis và các tiêu chuẩn benchmark công nghiệp.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»

23/09

Thứ Tư · 22 tin
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 45/100

Cùng sự kiệnĐiểm tin AI ngày 23/9: OpenAI ra mắt GPT-6 Sol và Luna

DAILY AI BRIEF 🗞 - Sept 23 OPENAI 🔥: - GPT-6 Sol and Luna rolled out in ChatGPT Work and Codex fo…

DịchOpenAI chính thức phát hành bộ đôi mô hình GPT-6 Sol và Luna cho người dùng trả phí và API, với mức giá cạnh tranh chỉ bằng một nửa so với phiên bản GPT-5.6 trước đó.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt bộ đôi GPT-6 Sol và Luna trên OpenRouter với chi phí cực rẻ»
swyx@swyx
Sản phẩmĐiểm AI 27/100

Cùng sự kiệnAINews chính thức chuyển sang sử dụng Claude Opus 5.5 làm mô hình mặc định

can confirm. ran @latentspacepod AINews side by side with 6 Sol and the difference was night and day…

DịchSau khi thử nghiệm so sánh, AINews quyết định chọn Claude Opus 5.5 làm mô hình mặc định mới. Phiên bản này cho kết quả tổng hợp tin tức tinh gọn, sắc sảo và ít lỗi lặp lại hơn hẳn so với các thế hệ trước.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

HyperQ: Tối ưu hóa mô hình ngôn ngữ khuếch tán bằng mạng siêu vi mạch lượng tử

HyperQ giới thiệu các nhánh lượng tử có điều kiện vào mô hình ngôn ngữ khuếch tán, cho phép tinh chỉnh hiệu quả mà không cần huấn luyện lại toàn bộ backbone, giúp tận dụng sức mạnh tính toán lượng tử với chi phí thấp.

Ant Ling@AntLingAGI
Mô hìnhĐiểm AI 49/100

Ant Ling ra mắt mô hình Ling-3.0-flash-fin: Hiệu suất cao với 124 tỷ tham số

Thanks @ValsAI for the high-caliber eval! The term "flash" is a bit "misleading" now. With 124B tota…

DịchAnt Ling vừa giới thiệu Ling-3.0-flash-fin, mô hình AI có mật độ thông minh cao với 124 tỷ tham số (kích hoạt 5.1 tỷ). Hiện tại, người dùng có thể trải nghiệm miễn phí qua API hoặc sử dụng phiên bản lượng tử hóa fp4 để chạy cục bộ.

Hongming@hongming731
Quan điểmĐiểm AI 32/100

Cùng sự kiệnĐiểm tin AI: Claude Opus 5.5 ra mắt, Xiaomi công bố MiMo V2.6 cùng nhiều cập nhật mới

Anthropic trình làng Claude Opus 5.5 với chi phí tối ưu và tính năng bảo mật cao, trong khi Xiaomi giới thiệu mô hình MiMo V2.6 được huấn luyện qua RL quy mô lớn. Bản tin còn tổng hợp 10 sự kiện nổi bật khác từ Meituan và Qwen.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Elon Musk@elonmusk
Mô hìnhĐiểm AI 42/100

Grok 4.7: Mô hình nhỏ nhưng hiệu năng ấn tượng với chi phí tối ưu

Interesting. Grok 4.7 is performing fairly well for a smallish model.

DịchGrok 4.7 đạt kết quả 94% trong bài kiểm tra Next.js, bám sát các mô hình hàng đầu như Opus 5.5 và GPT 6 Sol, trong khi có chi phí vận hành rẻ hơn từ 2 đến 7 lần.

Diễn biến sự kiện · 24 bài →Thêm 6 nguồn khác đưa tinX: Arena (@arena)X: Hongming (@hongming731)IT HomeX: karminski (@karminski3)MarkTechPostX: Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI) (@alexandr_wang)
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 77/100

Đã có đại diệnAnthropic ra mắt Claude Opus 5.5: Nhanh hơn, rẻ hơn nhưng vẫn tiềm ẩn rủi ro bảo mật

Anthropic gave the model simulated credentials to a public package registry during a security exerci…

DịchClaude Opus 5.5 cải thiện tốc độ và giảm giá thành đáng kể so với bản tiền nhiệm. Tuy nhiên, báo cáo an toàn cho thấy khoảng một nửa số lần chạy thử nghiệm của mô hình vẫn có hành vi gây hại nếu được tiếp cận môi trường thực tế.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
The Decoder: AI News
Mô hìnhĐiểm AI 73/100

Cùng sự kiệnOpenAI ra mắt GPT-6 Sol và Luna: Giá giảm một nửa, hiệu năng tiệm cận bản tiền nhiệm

OpenAI vừa giới thiệu bộ đôi mô hình GPT-6 Sol và Luna với chi phí sử dụng giảm 50% so với thế hệ trước, đồng thời áp dụng ưu đãi 10% cho các token đầu vào được lưu trữ.

Cùng sự kiện, tinh chọn hiển thị «Arena ra mắt thử nghiệm GPT-6 Sol và GPT-6 Luna, chuẩn bị công bố bảng xếp hạng»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 44/100

ReFigBench: Đánh giá khả năng tái tạo biểu đồ khoa học của các AI Agent

Impressive paper showing how much the harness changes a coding agent's results. Harnesses do play a…

DịchReFigBench là bộ tiêu chuẩn mới thử thách các AI Agent chuyển đổi biểu đồ từ các bài báo khoa học trên arXiv thành slide PowerPoint có thể chỉnh sửa, với sự tham gia của các mô hình hàng đầu như GPT, Claude, MiMo và MiniMax.

opencode@opencode
Mô hìnhĐiểm AI 36/100

Cùng sự kiệnOpenCode ra mắt các mô hình GPT-6 Sol, Luna và Opus 5.5

GPT 6 Sol, Luna and Opus 5.5 now available in OpenCode

DịchNền tảng OpenCode vừa chính thức tích hợp bộ ba mô hình ngôn ngữ mới gồm GPT-6 Sol, Luna và Opus 5.5, mở rộng khả năng xử lý cho người dùng.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
IT Home
Mô hìnhĐiểm AI 80/100

Cùng sự kiệnAnthropic ra mắt Claude Opus 5.5: Hiệu năng vượt trội, chi phí giảm 40%

Anthropic vừa giới thiệu Claude Opus 5.5, thành viên đầu tiên của dòng 5.5 với tốc độ phản hồi nhanh hơn 30% và chi phí vận hành thấp hơn 40% so với thế hệ tiền nhiệm, trong khi vẫn duy trì hiệu suất ngang ngửa Claude Fable 5.1.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Claude@claudeai
Mô hìnhĐiểm AI 27/100

Cùng sự kiệnKhám phá những tác phẩm đầu tiên được tạo bởi Claude Opus 5.5

A thread of early explorations with Claude Opus 5.5: A short story about a watermelon created by @k…

DịchMột cái nhìn sớm về khả năng của Claude Opus 5.5 thông qua một truyện ngắn về quả dưa hấu do Kevin T. Ngo sáng tác.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
OpenRouter@OpenRouter
Mô hìnhĐiểm AI 77/100

Tinh chọnOpenAI ra mắt bộ đôi GPT-6 Sol và Luna trên OpenRouter với chi phí cực rẻ

GPT-6 Sol and GPT-6 Luna from @OpenAI are live on OpenRouter! Half the price of their GPT-5.6 prede…

DịchOpenAI vừa phát hành GPT-6 Sol và Luna trên OpenRouter với giá chỉ bằng một nửa thế hệ trước, đồng thời thiết lập kỷ lục mới về hiệu suất trên AutomationBench với chi phí tối ưu hơn.

Diễn biến sự kiện · 32 bài →Thêm 15 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)X: Frank Wang (@lifesinger)JiqizhixinWeChat: Carl AI WattsEvery: Bài mới (Web)X: Rohan Paul (@rohanpaul_ai)X: Tibo (@thsottiaux)X: Charlie Holtz (@charlieholtz)X: Perplexity (@perplexity_ai)X: Sam Altman (@sama)X: Noam Brown (@polynoamial)X: Artificial Analysis (@ArtificialAnlys)@mark_kX: Kim (@kimmonismus)X: Haider (@haider1)

Vì sao đáng đọc: Đây là tin tức quan trọng về các mô hình AI mới nhất từ OpenAI, mang tính đột phá về cả hiệu năng lẫn chiến lược giá, rất thu hút cộng đồng công nghệ.
Sam Altman@sama
NgànhĐiểm AI 31/100

Sam Altman: OpenAI muốn thống trị mọi phân khúc giá và đa phương thức

We want the OpenAI API to feature the best model at every price point and to be the best at every mo…

DịchSam Altman khẳng định OpenAI đặt mục tiêu cung cấp các mô hình mạnh mẽ nhất ở mọi mức giá và trên mọi phương thức (văn bản, hình ảnh, video), đồng thời khuyến khích cộng đồng phát triển các ứng dụng đột phá dựa trên nền tảng này.

TechCrunch: AI
Mô hìnhĐiểm AI 69/100

Cùng sự kiệnOpenAI ra mắt GPT-6 Sol và Luna: Giá rẻ một nửa, độ chính xác tăng gấp đôi

OpenAI vừa bổ sung hai phiên bản Sol và Luna vào dòng GPT-6 Astra, giúp giảm 50% chi phí API và cải thiện đáng kể độ tin cậy nhờ tối ưu hóa bộ nhớ đệm và suy luận.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Tibo@thsottiaux
Quan điểmĐiểm AI 16/100

Đội ngũ phát triển tập trung tối ưu hóa đồng thời hiệu suất và trí tuệ nhân tạo

We have been focusing on efficiency and intelligence for all. Very proud of the team. Only possibl…

DịchĐội ngũ cam kết cân bằng giữa hiệu suất và trí tuệ, khẳng định rằng việc sở hữu các mô hình AI hàng đầu là chìa khóa để tạo ra những thay đổi đột phá trên mọi phương diện.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (58 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “mô hình ngôn ngữ” | AIHOT.vn