22/09

Thứ Ba · 1 tin

20/09

Chủ Nhật · 1 tin

17/09

Thứ Năm · 1 tin
DAIR.AI@dair_ai
Hướng dẫnĐiểm AI 43/100

Adobe áp dụng hàm Python thay thế đáp án tĩnh để đánh giá hiệu năng AI Agent

Nice work from Adobe. It's standard practice to store a fixed reference answer for every eval case….

DịchCác nhà nghiên cứu tại Adobe đề xuất sử dụng hàm Python làm đáp án tham chiếu cho các bài kiểm tra AI Agent. Cách tiếp cận này cho phép đáp án thay đổi linh hoạt theo dữ liệu thực tế, giúp phát hiện lỗi ngay lập tức khi API thượng nguồn có thay đổi.

16/09

Thứ Tư · 1 tin

15/09

Thứ Ba · 1 tin
OpenAI Developers@OpenAIDevs
NgànhĐiểm AI 25/100

GPT-6 Astra hỗ trợ Perplexity kiểm thử mã nguồn từ đầu đến cuối

GPT-6 Astra in Codex is helping test code end to end at @perplexity_ai. @randomjohnnyh uses it to b…

DịchGPT-6 Astra đang được Perplexity ứng dụng để xây dựng bộ kiểm thử và mô phỏng phản hồi API, giúp tối ưu hóa quy trình kiểm tra sự phối hợp giữa các thành phần trong hệ thống.

10/09

Thứ Năm · 1 tin

08/09

Thứ Ba · 2 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 49/100

State Machines: Giải pháp xây dựng môi trường thử nghiệm cấp doanh nghiệp cho AI Agent

I've lost entire weeks writing mock Salesforce endpoints just to test one agent flow. because most…

DịchState Machines ra mắt hạ tầng thử nghiệm cho phép tái tạo môi trường doanh nghiệp phức tạp, hỗ trợ chạy song song hàng ngàn trạng thái độc lập. Công cụ này giúp các AI Agent duy trì trạng thái xuyên suốt quy trình làm việc, đảm bảo tính nhất quán và khả năng đánh giá cho các tác vụ đa bước.

29/08

Thứ Bảy · 1 tin
Lauren Tan@poteto
Hướng dẫnĐiểm AI 36/100

pstack ra mắt tính năng tự động hóa kiểm thử ứng dụng cho AI Agent

if you're new to using pstack, don't forget to run /create-verification-skill! it creates a high qua…

Dịchpstack bổ sung bộ kỹ năng mới giúp AI Agent tự động tạo và duy trì bản đồ tính năng (feature map), cho phép chúng điều hướng và kiểm thử ứng dụng như người dùng thật một cách liên tục.

24/08

Thứ Hai · 1 tin
ByteByteGo
Hướng dẫnĐiểm AI 41/100

Tại sao xác thực mã nguồn lại trở nên quan trọng hơn bao giờ hết trong kỷ nguyên AI?

Sự bùng nổ của mã nguồn do AI tạo ra đặt ra thách thức lớn cho khâu kiểm chứng. Bài viết phân tích tầm quan trọng ngày càng tăng của việc xác thực mã nguồn và những định hướng tương lai trong quy trình phát triển phần mềm.

21/08

Thứ Sáu · 1 tin

13/08

Thứ Năm · 2 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 38/100

Phá vỡ giới hạn: Dùng Antithesis và Claude tái hiện lỗi WAL-Reset của SQLite trong 15 phút

Sự kết hợp giữa AI và Antithesis đã giúp tái hiện thành công lỗi WAL-Reset tồn tại suốt 14 năm trong SQLite chỉ sau 15 phút, một kỳ tích mà trước đây các kỹ sư phải mất nhiều tháng mới giải quyết được.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 61/100

ToolHazard: Khung tổng hợp môi trường đối kháng giúp kiểm thử bảo mật cho AI Agent

ToolHazard là khung làm việc tự động tạo ra các môi trường giả lập có trạng thái để tấn công và kiểm thử lỗ hổng của AI Agent, giúp phát hiện các điểm yếu trong quy trình làm việc phức tạp và khả năng thực thi tác vụ dài hạn.

12/08

Thứ Tư · 1 tin
TechCrunch: AI
NgànhĐiểm AI 56/100

Startup kiểm thử mã nguồn AI Blacksmith tăng định giá gấp 10 lần chỉ sau một năm

Blacksmith vừa huy động thành công 45 triệu USD, nâng định giá lên 550 triệu USD nhờ giải pháp tự động hóa kiểm thử phần mềm cho hơn 5.000 khách hàng. Công ty dự định mở rộng hệ sinh thái công cụ hỗ trợ lập trình viên tối ưu quy trình phát triển và triển khai mã nguồn.

Tổng 14 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (31 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Kiểm thử phần mềm” | AIHOT.vn