Tài liệu API của OpenAI vừa xuất hiện thông tin về Ultrafast API, cho thấy hãng sắp bổ sung tùy chọn tốc độ mới bên cạnh Standard và Fast trong giao diện Playground.
Inference on steroid: NVIDIA's Groq 3 LPX is now in full production, adding a dedicated token-genera…
DịchNVIDIA Groq 3 LPX đã đi vào sản xuất hàng loạt, đạt tốc độ kỷ lục 3400 token/giây khi chạy mô hình Gemma 4 31B. Công nghệ này sẽ sớm được triển khai trên nền tảng Vera Rubin thông qua Nebius và Groq.