Grok 4.6 is now available in Perplexity and Perplexity Computer. On WANDR, it sits on the Pareto fr…
DịchGrok 4.6 đã chính thức có mặt trên Perplexity và Perplexity Computer. Mô hình này đạt hiệu suất vượt trội trên WANDR, mang lại kết quả tương đương Fable 5 với chi phí thấp hơn 40%.
Dòng model GPT-5.6 mang đến khả năng suy luận bền bỉ và điều phối đa tác nhân với chi phí thấp hơn đáng kể. Đặc biệt, model Luna đạt hiệu suất ngang ngửa bản 5.5 nhưng giảm chi phí vận hành tới 25 lần.
Thêm 1 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Vì sao đáng đọc: Cập nhật kỹ thuật quan trọng cho lập trình viên, cung cấp giải pháp thực tế để giảm chi phí API mà vẫn giữ được hiệu năng cao cho các tác nhân AI.
We're launching Optima. Now anyone can create a custom benchmark for their use case, leveraging Arti…
DịchOptima cho phép người dùng xây dựng bộ tiêu chuẩn đánh giá riêng dựa trên dữ liệu cá nhân hoặc HuggingFace, giúp so sánh chính xác chi phí, tốc độ và hiệu suất giữa các mô hình AI hàng đầu để tối ưu hóa lựa chọn.
Elon Musk chia sẻ Grok 4.6 đã hoàn thành tác vụ tương tự Fable chỉ trong 84 phút với 8,6 triệu token, giúp tiết kiệm chi phí xuống còn 55 USD, chỉ bằng 1/10 so với phương pháp cũ.
Okta giới thiệu giải pháp sử dụng phạm vi định danh (identity scoping) trong giao thức MCP để cắt giảm 'thuế công cụ' - lượng token dư thừa phát sinh khi AI Agent phải xử lý quá nhiều mô tả công cụ không cần thiết.
DeepSeek-V4-Pro (Max) is expected to shift the Pareto frontier DeepSeek-V4-Pro (Max) reached 1607 i…
DịchDeepSeek-V4-Pro đạt 1607 điểm trên Code Arena, chỉ kém GPT-5.6 15 điểm nhưng có giá thành chỉ bằng 1/31. Với mức giá 0,435 USD/triệu token, mô hình này đang định nghĩa lại tiêu chuẩn hiệu năng trên giá thành trong phân khúc cao cấp.
For video or image generations, iteration loop is the real workflow, which makes queue latency and g…
DịchSeedance 2.5 tối ưu hóa quy trình tạo ảnh lặp lại với chi phí cực thấp chỉ từ 0,097 USD/giây. Người dùng hiện có thể trải nghiệm miễn phí 4 lượt tạo ảnh mỗi ngày trên Dreamina mà không cần chờ đợi.
Blended cost per 1M tokens across 26 commercial LLMs, ordered low to high.
DịchPhân tích 26 LLM cho thấy Grok 4.6 đạt chỉ số thông minh 61 điểm, gần bằng Claude Fable 5 Max nhưng tiết kiệm tới 80-88% chi phí token, trở thành lựa chọn tối ưu nhất về kinh tế.
OpenRouter công bố bảng xếp hạng hiệu suất tìm kiếm, cho thấy việc tăng độ sâu tìm kiếm giúp cải thiện đáng kể kết quả, đồng thời khẳng định chọn đúng mô hình quan trọng hơn công cụ tìm kiếm.
Own your intelligence. How? Start by building specialized models using agents. @oumi_ai does this …
DịchOumi giúp doanh nghiệp tự động hóa quy trình từ dữ liệu đến triển khai mô hình AI riêng, tối ưu chi phí và tạo lợi thế cạnh tranh thay vì phụ thuộc vào các mô hình chung đắt đỏ.