<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>11. Evaluation, Safety &amp; Ethics on Nguyen Ngoc Tin</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/</link><description>Recent content in 11. Evaluation, Safety &amp; Ethics on Nguyen Ngoc Tin</description><generator>Hugo</generator><language>en</language><managingEditor>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</managingEditor><webMaster>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</webMaster><lastBuildDate>Sat, 01 Aug 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/index.xml" rel="self" type="application/rss+xml"/><item><title>AI Safety and Ethics</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/ai-safety-and-ethics/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/ai-safety-and-ethics/</guid><description>An toàn và đạo đức AI bao gồm việc thiết lập các hướng dẫn và thực tiễn tốt nhất để đảm bảo rằng các hệ thống trí tuệ nhân tạo được phát triển, triển khai và sử dụng theo cách ưu tiên phúc lợi con người, sự công bằng và tính minh bạch.</description></item><item><title>Prompt Injection Attacks</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/prompt-injection-attacks/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/prompt-injection-attacks/</guid><description>Tấn công Prompt Injection là một loại lỗ hổng bảo mật trong đó các đầu vào độc hại được tạo ra để thao túng hoặc khai thác các mô hình AI, như các mô hình ngôn ngữ, nhằm tạo ra các đầu ra không mong muốn hoặc có hại.</description></item><item><title>Bias and Fairness</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/bias-and-fairness/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/bias-and-fairness/</guid><description>Định kiến và sự công bằng trong AI đề cập đến những thách thức trong việc đảm bảo rằng các mô hình học máy không tạo ra các kết quả phân biệt đối xử hoặc sai lệch.</description></item><item><title>Security and Privacy Concerns</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/security-and-privacy-concerns/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/security-and-privacy-concerns/</guid><description>Các mối quan tâm về bảo mật và quyền riêng tư trong AI xoay quanh việc bảo vệ dữ liệu và sử dụng các mô hình một cách có trách nhiệm.</description></item><item><title>Conducting adversarial testing</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/conducting-adversarial-testing/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/conducting-adversarial-testing/</guid><description>Kiểm thử đối nghịch liên quan đến việc cố tình phơi bày các mô hình học máy trước các đầu vào lừa đảo, bị nhiễu hoặc được tạo ra cẩn thận để đánh giá độ bền vững và xác định các lỗ hổng.</description></item><item><title>Content Moderation APIs</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/content-moderation-apis/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/content-moderation-apis/</guid><description>Các API kiểm duyệt nội dung là các công cụ tự động phân tích văn bản, hình ảnh, video và âm thanh để phát hiện nội dung có khả năng gây hại hoặc không phù hợp.</description></item><item><title>Adding end-user IDs in prompts</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/adding-end-user-ids-in-prompts/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/adding-end-user-ids-in-prompts/</guid><description>Việc gửi ID người dùng cuối trong các yêu cầu của bạn có thể là một công cụ hữu ích để giúp OpenAI giám sát và phát hiện hành vi lạm dụng.</description></item><item><title>Robust prompt engineering</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/robust-prompt-engineering/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/robust-prompt-engineering/</guid><description>Kỹ thuật prompt mạnh mẽ liên quan đến việc tạo ra các đầu vào một cách cẩn thận để hướng dẫn các mô hình AI tạo ra các đầu ra chính xác, phù hợp và đáng tin cậy.</description></item><item><title>Know your Customers / Usecases</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/know-your-customers-usecases/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/know-your-customers-usecases/</guid><description>Hiểu khách hàng của bạn có nghĩa là hiểu sâu sắc nhu cầu, hành vi và kỳ vọng của người dùng mục tiêu.</description></item><item><title>Constraining outputs and inputs</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/constraining-outputs-and-inputs/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/constraining-outputs-and-inputs/</guid><description>Việc ràng buộc đầu ra và đầu vào trong các mô hình AI đề cập đến việc thực hiện các giới hạn hoặc quy tắc hướng dẫn cả dữ liệu mà mô hình xử lý (đầu vào) và kết quả mà nó tạo ra (đầu ra).</description></item><item><title>LLM Observability</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-observability/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-observability/</guid><description>LLM observability là thực hành giám sát và hiểu những gì xảy ra bên trong ứng dụng AI của bạn tại thời điểm chạy, theo dõi các thứ như prompt nào đã được gửi, phản hồi nào đã trả về, mỗi cuộc gọi mất bao lâu và bao nhiêu token đã được sử dụng.</description></item><item><title>LLM Evaluations</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-evaluations/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/llm-evaluations/</guid><description>LLM evaluations là các bài kiểm tra có cấu trúc đo lường mức độ hiệu quả của một model hoặc hệ thống AI dựa trên một tập hợp các tiêu chí được xác định.</description></item><item><title>Tracing &amp; Logging</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/tracing-logging/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/tracing-logging/</guid><description>Tracing ghi lại toàn bộ vòng đời của một yêu cầu thông qua hệ thống AI của bạn, từ đầu vào ban đầu của người dùng qua bất kỳ cuộc gọi LLM trung gian, việc sử dụng công cụ hoặc các bước truy xuất, cho đến phản hồi cuối cùng.</description></item><item><title>Cost &amp; Latency Monitoring</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/costlatency-monitoring/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/costlatency-monitoring/</guid><description>Giám sát chi phí và độ trễ theo dõi việc sử dụng token, chi phí tài chính và thời gian phản hồi trong hệ thống AI của bạn.</description></item><item><title>Production Monitoring</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/production-monitoring/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/production-monitoring/</guid><description>Giám sát sản xuất là việc quan sát liên tục hệ thống AI của bạn khi nó đã hoạt động và xử lý lưu lượng truy cập thực tế.</description></item><item><title>LangSmith</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/langsmith/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/langsmith/</guid><description>LangSmith là một nền tảng quan sát và đánh giá được xây dựng bởi đội ngũ LangChain, được thiết kế đặc biệt cho các ứng dụng LLM.</description></item><item><title>LangFuse</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/langfuse/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/langfuse/</guid><description>LangFuse là một nền tảng quan sát LLM mã nguồn mở cung cấp các công cụ theo dõi, quản lý prompt và đánh giá.</description></item><item><title>Helicone</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/helicone/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/helicone/</guid><description>Helicone là một proxy ghi nhật ký và quan sát cho các API LLM.</description></item><item><title>Arize AI</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/arize-ai/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/arize-ai/</guid><description>Arize là một nền tảng quan sát ML hỗ trợ cả các mô hình ML truyền thống và các ứng dụng LLM.</description></item><item><title>Deterministic Evals</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deterministic-evals/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deterministic-evals/</guid><description>Các đánh giá tất định sử dụng các kiểm tra dựa trên quy tắc cố định để chấm điểm đầu ra của mô hình.</description></item><item><title>Model-Based Evals</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/model-based-evals/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/model-based-evals/</guid><description>Các đánh giá dựa trên mô hình sử dụng một mô hình AI riêng biệt để tự động chấm điểm hoặc đánh giá đầu ra của ứng dụng LLM của bạn.</description></item><item><title>Human Evals</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/human-evals/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/human-evals/</guid><description>Đánh giá của con người liên quan đến việc mọi người trực tiếp xem xét và chấm điểm đầu ra của mô hình dựa trên các tiêu chí đã xác định.</description></item><item><title>Evaluation Metrics</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/evaluation-metrics/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/evaluation-metrics/</guid><description>Các chỉ số đánh giá là các phép đo cụ thể được sử dụng để chấm điểm đầu ra của LLM dựa trên các tiêu chí chất lượng đã xác định.</description></item><item><title>Regression Testing</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/regression-testing/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/regression-testing/</guid><description>Kiểm thử hồi quy cho các hệ thống AI có nghĩa là xác minh rằng một thay đổi đối với prompt, phiên bản mô hình, chiến lược truy xuất hoặc bất kỳ thành phần nào khác không làm giảm hiệu suất trên các trường hợp trước đây đã hoạt động chính xác.</description></item><item><title>DeepEval</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deepeval/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/deepeval/</guid><description>DeepEval là một framework đánh giá LLM mã nguồn mở cho phép bạn viết các bài kiểm tra tự động cho ứng dụng AI của mình theo cách tương tự như kiểm thử đơn vị với pytest.</description></item><item><title>RAGAS</title><link>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/ragas/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/11-evaluation-safety-and-ethics/ragas/</guid><description>RAGAS là một framework mã nguồn mở được thiết kế đặc biệt để đánh giá các pipeline RAG.</description></item></channel></rss>