Independent eval from @arena: Qwen3.8-Max-0902 debuts at #1 in Code Arena: WebDev. 1691 pts. Built …
DịchAlibaba Cloud vừa trình làng Qwen3.8-Max-0902, mẫu AI đạt 1691 điểm và vươn lên dẫn đầu bảng xếp hạng Code Arena: WebDev, vượt qua các đối thủ sừng sỏ như Claude Opus 5 và Kimi K3.
Mô hình Qwen3.8-Max-0902 mới của Alibaba đã xuất sắc đạt 1691 điểm trên CodeArena WebDev, chính thức vượt qua các đối thủ mạnh như Claude Opus 5 và Kimi K3 để chiếm lĩnh vị trí số 1.
Fable 5.1 nâng cấp toàn diện khả năng xử lý tác vụ phức tạp của Claude, đồng thời tối ưu hóa chi phí vận hành và bảo mật mô hình với cơ chế chống chưng cất dữ liệu mới.
Mô hình Fable 5.1 mới của Anthropic không chỉ giải quyết triệt để các lỗi phần mềm tồn tại lâu năm mà còn giúp giảm đáng kể chi phí cho các tác vụ lập trình phức tạp.
Anthropic giới thiệu bộ đôi Claude 5.1 với hiệu năng vượt trội và chi phí tối ưu. Trong đó, Fable 5.1 được phát hành rộng rãi, còn Mythos 5.1 giới hạn cho các tổ chức được kiểm duyệt tại Mỹ thuộc dự án Project Glasswing.
Fable 5.1 is our best model yet for coding, data analysis, computer use, design, presentations, Tag, …
DịchAnthropic vừa giới thiệu Claude Fable 5.1 và Mythos 5.1, được đánh giá là những mô hình mạnh mẽ nhất hiện nay trong việc xử lý lập trình, phân tích dữ liệu, thiết kế và các tác vụ đại lý (agent) phức tạp kéo dài.
So, Claude's official support doc is already mentioning Fable 5.1
DịchTài liệu chính thức của Claude đề cập đến Fable 5.1, phiên bản sẽ hạn chế khả năng chỉnh sửa ngữ cảnh xung quanh các khối suy luận (thought blocks) trong Messages API nhằm ngăn chặn hành vi trích xuất dữ liệu huấn luyện từ mô hình.
Fable 5.1 benchmarls are insane. Ngl, i did not expect such jumps. Terminal-Bench 4.0, Science-Ben…
DịchKOL @kimmonismus chia sẻ kết quả benchmark ấn tượng của Fable 5.1 trên các nền tảng như Terminal-Bench 4.0 và HLE, vượt xa các đối thủ như Opus 5 và GPT-5.6 Sol, tạo áp lực lớn lên OpenAI và Astra.
Fable 5.1 is live, even for me in germany. Lets go!
DịchFable 5.1 đã được phát hành và người dùng tại Đức đã có thể trải nghiệm. Bản cập nhật mới bổ sung các tùy chọn mô hình như Opus 5, Sonnet 5 và Haiku 4.5 trực tiếp trong giao diện Claude.
META 🔥: A new Muse Voice Transcribe model from MSL is now available on Meta models API. > SOTA …
DịchMeta vừa phát hành Muse Voice Transcribe trên API, hỗ trợ hơn 70 ngôn ngữ với khả năng chuyển đổi giọng nói thời gian thực đạt chuẩn SOTA. Mô hình này hiện đã được tích hợp vào các ứng dụng của Meta và cung cấp tùy chọn bảo mật không lưu trữ dữ liệu cho người dùng doanh nghiệp.
Fable 5.1 already officially mentioned in the support docs. release is imminent.
DịchClaude Fable 5.1 vừa xuất hiện trong tài liệu chính thức của Anthropic với thay đổi quan trọng về Messages API. Bản cập nhật này sẽ hạn chế chỉnh sửa các khối suy luận (thinking blocks) trong hội thoại nhằm ngăn chặn việc chưng cất dữ liệu mô hình.
The assumption was actually that Fable 5.1 and Opus 5.1 were supposed to be released yesterday. It s…
DịchDù dự kiến ra mắt vào hôm qua, bộ đôi mô hình Fable 5.1 và Opus 5.1 đã bị dời lịch sang tuần tới. Tuy nhiên, một số người dùng đã bắt đầu có quyền truy cập sớm vào các mô hình này.
The upcoming Ox Alpha is GLM-5.3 Flash (as expected): 320b total parameters, 18b active. Outperform…
DịchMô hình Ox Alpha (GLM-5.3 Flash) sở hữu 320 tỷ tham số với 18 tỷ tham số kích hoạt, hứa hẹn vượt trội hơn bản 5.2 về lập trình và tác vụ thông minh với chi phí chỉ bằng 1/10.
OpenRouter giới thiệu quy trình chọn mô hình dựa trên hiệu suất thực tế và chi phí hoàn thành tác vụ thay vì giá mỗi token. Bạn có thể tích hợp MCP server vào Cursor hoặc Claude Code để tự động so sánh và điều hướng yêu cầu đến mô hình phù hợp nhất.
Vì sao đáng đọc: Hướng dẫn thực tế, giải quyết nỗi đau về chi phí và hiệu năng cho lập trình viên khi sử dụng AI, có công cụ hỗ trợ tích hợp trực tiếp vào workflow.
The fun doesn't stop: apparently there is also a new Qwen model - Qwen 4 - already being tested. So…
DịchCác nguồn tin uy tín cho thấy Qwen 4 đang được thử nghiệm, cùng với các bản cập nhật từ Claude, GLM và sự xuất hiện của GPT Astra. Một làn sóng mô hình AI thế hệ mới hứa hẹn sẽ khuấy động thị trường trong vài tuần tới.
DeepSeek V4 Flash Vision Exp is live on OpenRouter! @deepseek_ai's new model supports Image input a…
DịchDeepSeek vừa ra mắt phiên bản V4 Flash Vision hỗ trợ xử lý hình ảnh trên OpenRouter. Mô hình này duy trì mức giá cũ nhưng đạt hiệu suất vượt trội so với Opus-4.8 trong các bài kiểm tra năng lực AI chuyên sâu.
DeepSeek 🔥: DeepSeek-V4-Flash-Vision-Exp multimodal model is now available on the DeepSeek API Plat…
DịchDeepSeek vừa cập nhật mô hình đa phương thức deepseek-v4-flash-vision-exp lên nền tảng API, với hiệu năng xử lý văn bản tương đương bản V4-Flash và tiệm cận Claude 3 Opus 4.8.
Brilliant piece by Zhipu Founder Tang Jie. AI scaling is moving past parameter growth. "How many …
DịchĐường cong tăng trưởng mô hình không còn phụ thuộc vào tham số, mà nằm ở dữ liệu, tính toán và hậu huấn luyện. Zhipu chứng minh GLM-5.3 dù cùng cấu trúc với bản cũ nhưng nhờ tối ưu hóa suy luận và RL, hiệu suất đã vượt trội đáng kể.
Phiên bản Opus 5.0 đang bị người dùng chỉ trích dữ dội trên GitHub vì khả năng suy luận sa sút, thường xuyên đưa ra các câu trả lời rời rạc và mâu thuẫn nội dung.
Stripe mua lại OpenRouter để phát triển hạ tầng kết nối các mô hình AI, giúp tối ưu hóa việc lựa chọn và điều phối mô hình thông minh cho doanh nghiệp.
Meet Wan3.0: Simple input. Smart creation. Where imagination meets reality. Join the Wan team and l…
DịchAlibaba Cloud giới thiệu mô hình Wan 3.0 với khả năng chuyển đổi ý tưởng thành hình ảnh/video thông minh. Sự kiện livestream sẽ chia sẻ về các nâng cấp mới, quy trình làm việc thực tế và mẹo sử dụng hiệu quả từ các chuyên gia.
Chỉ vài giờ sau lời hứa từ chuyên gia Tang Jie, Zhipu AI đã tung ra GLM-5.3 chuyên biệt cho lập trình và bảo mật, đạt điểm số kỷ lục trên SWE-Marathon và CyberGym.
Low latency matters more inside an agent because one task can stack many sequential model calls. Gem…
DịchGemini 3.7 Flash thiết lập chuẩn mực mới về tốc độ và hiệu quả chi phí cho các tác vụ AI phức tạp, đồng thời Devin hiện đang áp dụng ưu đãi giảm giá 50% cho người dùng.
Gemini 3.7 Flash is here! Improved capabilities for long-horizon software engineering tasks, but al…
DịchGemini 3.7 Flash chính thức trình làng với hiệu suất vượt trội trong các tác vụ kỹ thuật phần mềm phức tạp và khả năng phân tích tài liệu PDF chuyên sâu.
Netlify hiện đã tích hợp OpenRouter, cho phép người dùng tùy chọn bất kỳ mô hình AI nào. Bài viết thực hiện kiểm chứng 11 model khác nhau với cùng một câu lệnh để so sánh hiệu suất thực tế.
Gemini 3.7 is out on vertex. Looks like it's another release day. Let's see how the flash (cheap and…
DịchGoogle vừa đưa Gemini 3.7 lên nền tảng Vertex AI. Phiên bản Flash mới hứa hẹn cân bằng hoàn hảo giữa chi phí và hiệu năng, tạo nên cuộc cạnh tranh gay gắt với DeepSeek 4 Flash.
Grok 4.6 chính thức trở lại nhóm dẫn đầu với hiệu năng vượt trội và giá thành rẻ hơn Fable 5, đồng thời đánh dấu sự ra mắt của Workbuddy phiên bản từ Musk.
DeepSeek-V4-Pro GA officially announced! Yesterday's leaked benchmarks were real: The model now su…
DịchDeepSeek-V4-Pro và V4-Flash vừa được cập nhật tính năng tùy chỉnh cường độ suy luận (thấp/cao/tối đa), đồng thời hỗ trợ chuẩn OpenAI Responses API giúp tích hợp dễ dàng hơn.
DeepSeek-V4-Pro đã có mặt trên mọi nền tảng với chế độ chuyên gia, khả năng xử lý tác vụ thông minh và hỗ trợ API OpenAI. Đặc biệt, hãng áp dụng chính sách giá linh hoạt theo khung giờ, giúp tối ưu chi phí cho người dùng.
We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 …
DịchDeepSeek chính thức trình làng V4-Pro và V4-Flash, hỗ trợ tùy chỉnh cường độ suy luận linh hoạt cho từng loại tác vụ và tích hợp sẵn OpenAI Responses API để dễ dàng triển khai.
DeepSeek V4 Pro 0813 is live on OpenRouter. @deepseek_ai reports large agent gains over V4 Pro Prev…
DịchDeepSeek V4 Pro 0813 đã cập bến OpenRouter với khả năng xử lý tác vụ thông minh vượt trội, đặc biệt là trong các bài kiểm tra về lập trình và vận hành hệ thống so với bản Preview.
BREAKING 🔥: SPACEXAI RELEASED GROK 4.6, AND IT IS NOW ON PAR WITH FABLE 5 and GPT 5.6 SOL ON MANY B…
DịchxAI vừa trình làng Grok 4.6 với khả năng xử lý vượt trội, đạt điểm số ấn tượng trên Frontend Arena. Người dùng hiện đã có thể trải nghiệm mô hình này ngay trên Cursor và Grok Build với ưu đãi gấp đôi dung lượng sử dụng trong tuần đầu tiên.
JUST IN: Deepseek V4 Pro has just released. A quick glance at latest benchmarks comparing with V4 pr…
DịchDeepSeek vừa trình làng phiên bản V4 Pro. Bài viết cung cấp cái nhìn tổng quan về các kết quả kiểm thử hiệu năng mới nhất so với bản xem trước (preview) trước đó.
imo GDPVal is probably the most important benchmark, it measures the performance of models on real w…
DịchCựu CEO Stability AI đánh giá cao GDPVal như một thước đo quan trọng cho khả năng thực tế của AI, đồng thời chúc mừng đội ngũ xAI khi Grok 4.6 dẫn đầu về tỷ lệ hiệu năng trên giá thành.