OpenRouter vừa giới thiệu Batch API cho phép xử lý yêu cầu không đồng bộ trong vòng 24 giờ với mức giá ưu đãi chỉ bằng một nửa so với thông thường, hỗ trợ hơn 70 mô hình AI khác nhau.
Thêm 1 nguồn khác đưa tinX: OpenRouter (@OpenRouter)
Vì sao đáng đọc: Đây là cập nhật quan trọng giúp tối ưu chi phí vận hành cho các nhà phát triển và doanh nghiệp sử dụng API, có tính ứng dụng thực tế cao.
The "perfect prompt" is mostly a myth. Real AI video workflows look much more like prototyping: 360p…
DịchĐại diện Alibaba Cloud khẳng định quy trình làm video AI hiệu quả giống như việc tinh chỉnh dần từ độ phân giải thấp lên cao, thay vì phụ thuộc vào một câu lệnh (prompt) duy nhất. Wan3.0 hiện đã mở API cho người dùng trải nghiệm qua Model Studio và Qwen Cloud.
DeepSeek chính thức phát hành mô hình V4.1 Flash với cơ chế định giá mới. Dịch vụ V4 Pro sẽ được duy trì đến trưa ngày 14/9 trước khi chuyển hướng hoàn toàn sang V4.1 Flash.
Meta vừa triển khai chương trình ưu đãi cho Muse Spark 1.2 và 1.3, cho phép người dùng giảm sâu chi phí API xuống chỉ còn 1.3-8% giá gốc nếu đồng ý chia sẻ dữ liệu đầu vào và kết quả để phục vụ việc huấn luyện các mô hình AI thế hệ tiếp theo.
10% cheaper. 20× more TPM. 🔥 Your limits on Kimi K3 just got boosted on SiliconFlow. Starting now: …
DịchSiliconFlow vừa công bố giảm 10% giá cước cho mô hình Kimi K3, đồng thời tăng hạn mức mặc định (TPM) từ 100K lên 2 triệu token, áp dụng cho toàn bộ người dùng.
Trong bối cảnh các ông lớn AI đồng loạt tăng giá API, Alibaba gây ấn tượng khi tung ra Qwen3.8-Flash với hiệu năng vượt trội trong các tác vụ lập trình và đa phương thức, đặt ra tiêu chuẩn mới về sự cân bằng giữa chi phí và sức mạnh xử lý.
Vì sao đáng đọc: Tin tức quan trọng về mô hình mới từ Alibaba, phân tích sâu sắc về xu hướng tăng giá API của ngành AI và khả năng cạnh tranh của Qwen3.8-Flash so với các đối thủ lớn.
Google has released Gemini 3.5 Transcribe, ranking #5 on AA-WER at 2.6%, alongside Gemini 3.5 Transc…
DịchGoogle giới thiệu bộ API Gemini 3.5 Transcribe với khả năng xử lý âm thanh siêu tốc, độ trễ thấp chỉ 0.4 giây và hỗ trợ hơn 85 ngôn ngữ, thiết lập chuẩn mực mới cho công nghệ nhận diện giọng nói.
Happy Friday! We're giving you a $5 coupon to build on Ori Harness this weekend Run your favorite …
DịchOpenRouter tặng người dùng voucher 5$ để trải nghiệm Ori Harness, hỗ trợ chạy các CLI như Claude Code hay DeepSeek trên hơn 500 mô hình AI với chi phí tiết kiệm tới 75%.
Alibaba Cloud vừa bổ sung GLM-5.3 và DeepSeek-V4-Pro vào nền tảng Qwen AI, mở rộng khả năng xử lý từ lập trình, tác vụ dài đến tạo nội dung đa phương tiện.
OpenAI's GPT-5.6 Sol is now half off on OpenRouter! This also applies to batch API, flex, and prior…
DịchOpenRouter hiện áp dụng ưu đãi giảm giá 50% cho mô hình GPT-5.6 Sol của OpenAI, bao gồm cả các cấp độ API linh hoạt và ưu tiên. Mức giá mới cho cấp độ linh hoạt chỉ còn 1,25 USD cho đầu vào và 7,50 USD cho đầu ra.
Thêm 4 nguồn khác đưa tinX: opencode (@opencode)X: AI Notes (@AYi_AInotes)X: SemiAnalysis (@SemiAnalysis_)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Alex Atallah might be the luckiest founder of all time. He co-founded OpenSea in 2017 and helped bu…
DịchNgay sau khi Stripe thâu tóm OpenRouter, đối thủ mới Straitly đã xuất hiện với mô hình cổng kết nối AI không phí chênh lệch (0% markup), cho phép truy cập hơn 142 mô hình từ 20 nhà cung cấp với độ tin cậy cao.
On tokens and prices per token. I said I'd write more about this, so here goes: an OpenAI token! = …
DịchPhân tích cho thấy bộ phân tách token của GPT-5.6 Sol hiệu quả hơn Claude Opus 5 tới 34,5%. Người dùng nên tập trung vào chi phí thực tế trên mỗi kết quả đầu ra thay vì so sánh giá đơn lẻ trên mỗi triệu token.
Google released Gemini 3.7 Flash just 3 weeks after 3.6 Flash, halving introductory API prices. 3.7…
DịchChỉ 3 tuần sau bản 3.6, Google tiếp tục tung ra Gemini 3.7 Flash với mức giá API ưu đãi giảm 50%, chỉ còn 0,75 USD/3,75 USD cho mỗi triệu token đầu vào/đầu ra cho đến hết năm 2026.