# Perplexity ra mắt kiến trúc mô hình pplx-embed: Tối ưu độ trễ vượt trội so với vLLM

- Nguồn: X: Aravind Srinivas (Perplexity CEO) (@AravSrinivas)
- Thời gian phát hành: 2026-09-05 09:38 (giờ Việt Nam)
- Điểm AI: 36/100
- Link AIHOT.vn: https://aihot.vn/items/6485d704bd12a102
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmtns357k0aamroqsfaz57czk
- Link gốc: https://x.com/AravSrinivas/status/2096065348487487832

## Tóm tắt AI

Perplexity vừa công bố kiến trúc phục vụ mô hình pplx-embed, giúp tăng tốc đáng kể các tác vụ embedding và reranking trên quy mô dữ liệu khổng lồ, vượt xa hiệu năng của vLLM.

## Thân bài

_Chưa có thân bài hiển thị được._ Đọc bài gốc: <https://x.com/AravSrinivas/status/2096065348487487832>
