<rss xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title>Testing - Tag - Nguyen Ngoc Tin</title><link>https://ngoctin.me/tags/testing/</link><description>Testing - Tag - Nguyen Ngoc Tin</description><generator>Hugo -- gohugo.io</generator><language>en</language><managingEditor>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</managingEditor><webMaster>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</webMaster><lastBuildDate>Sat, 01 Aug 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://ngoctin.me/tags/testing/" rel="self" type="application/rss+xml"/><item><title>Conducting adversarial testing</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/conducting-adversarial-testing/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/conducting-adversarial-testing/</guid><description>Kiểm thử đối nghịch liên quan đến việc cố tình phơi bày các mô hình học máy trước các đầu vào lừa đảo, bị nhiễu hoặc được tạo ra cẩn thận để đánh giá độ bền vững và xác định các lỗ hổng.</description></item><item><title>LLM Evaluations</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-evaluations/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-evaluations/</guid><description>LLM evaluations là các bài kiểm tra có cấu trúc đo lường mức độ hiệu quả của một model hoặc hệ thống AI dựa trên một tập hợp các tiêu chí được xác định.</description></item><item><title>Deterministic Evals</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deterministic-evals/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deterministic-evals/</guid><description>Các đánh giá tất định sử dụng các kiểm tra dựa trên quy tắc cố định để chấm điểm đầu ra của mô hình.</description></item><item><title>Regression Testing</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/regression-testing/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/regression-testing/</guid><description>Kiểm thử hồi quy cho các hệ thống AI có nghĩa là xác minh rằng một thay đổi đối với prompt, phiên bản mô hình, chiến lược truy xuất hoặc bất kỳ thành phần nào khác không làm giảm hiệu suất trên các trường hợp trước đây đã hoạt động chính xác.</description></item><item><title>DeepEval</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deepeval/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deepeval/</guid><description>DeepEval là một framework đánh giá LLM mã nguồn mở cho phép bạn viết các bài kiểm tra tự động cho ứng dụng AI của mình theo cách tương tự như kiểm thử đơn vị với pytest.</description></item></channel></rss>