LlamaIndex ra mắt LiteParse 2.14.6 với tối ưu hóa bộ nhớ, giúp giảm thời gian trích xuất văn bản xuống còn 2,76ms/trang, đồng thời bổ sung tính năng định vị thị giác và API is-complex.
Vì sao đáng đọc: Cập nhật kỹ thuật quan trọng cho công cụ xử lý tài liệu phổ biến, mang lại cải thiện hiệu suất thực tế đáng kể cho các nhà phát triển ứng dụng RAG.
LlamaParse vừa bổ sung tính năng kết nối dữ liệu trực tiếp từ SharePoint và Google Drive, cho phép tự động đồng bộ và xử lý tài liệu mà không cần tải lên thủ công. Hệ thống sẽ tự động cập nhật các thay đổi, giúp tối ưu hóa quy trình trích xuất và lập chỉ mục dữ liệu cho nhà phát triển.
Nút thắt của AI trong trích xuất tài liệu không nằm ở mô hình mà ở cách định nghĩa Schema. Khi dữ liệu có nhiều giá trị cùng loại, việc thiếu quy tắc Schema cụ thể sẽ khiến hệ thống đưa ra các kết quả mâu thuẫn.
LlamaIndex chỉ ra rằng khả năng đọc hiểu không quyết định tỷ lệ tự động hóa, mà là cơ chế phân loại (routing). Thay vì chỉ tăng độ chính xác, việc tích hợp chỉ số tin cậy (confidence score) giúp hệ thống tự động xử lý tài liệu hiệu quả hơn đáng kể.
LlamaIndex đề xuất quy trình OCR hai bước: dùng công cụ miễn phí để quét sơ bộ, sau đó chỉ dùng mô hình thị giác (VLM) cho các trang quan trọng nhằm tối ưu chi phí và hiệu suất.