<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>08. Multimodal AI on Nguyen Ngoc Tin</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/</link><description>Recent content in 08. Multimodal AI on Nguyen Ngoc Tin</description><generator>Hugo</generator><language>en</language><managingEditor>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</managingEditor><webMaster>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</webMaster><lastBuildDate>Sat, 01 Aug 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://ngoctin.me/ai-engineer/08-multimodal-ai/index.xml" rel="self" type="application/rss+xml"/><item><title>Multimodal AI</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/multimodal-ai/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/multimodal-ai/</guid><description>AI đa phương thức là một phương pháp kết hợp và xử lý dữ liệu từ nhiều nguồn, chẳng hạn như văn bản, hình ảnh, âm thanh và video, để hiểu và tạo ra các phản hồi.</description></item><item><title>Multimodal AI Usecases</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/multimodal-ai-usecases/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/multimodal-ai-usecases/</guid><description>AI đa phương thức cung cấp năng lượng cho các ứng dụng như trả lời câu hỏi bằng hình ảnh, kiểm duyệt nội dung và các công cụ tìm kiếm nâng cao.</description></item><item><title>Image Understanding</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/image-understanding/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/image-understanding/</guid><description>AI đa phương thức nâng cao khả năng hiểu hình ảnh bằng cách tích hợp dữ liệu hình ảnh với các loại thông tin khác, chẳng hạn như văn bản hoặc âm thanh.</description></item><item><title>Image Generation</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/image-generation/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/image-generation/</guid><description>Tạo hình ảnh là một quá trình trong trí tuệ nhân tạo, nơi các mô hình tạo ra hình ảnh mới dựa trên các prompt đầu vào hoặc dữ liệu hiện có.</description></item><item><title>Video Understanding</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/video-understanding/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/video-understanding/</guid><description>Hiểu video với AI đa phương thức bao gồm việc phân tích và diễn giải cả nội dung hình ảnh và âm thanh để cung cấp sự hiểu biết toàn diện hơn về video.</description></item><item><title>Audio Processing</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/audio-processing/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/audio-processing/</guid><description>Xử lý âm thanh trong AI đa phương thức cho phép nhiều trường hợp sử dụng bằng cách kết hợp âm thanh với các loại dữ liệu khác, chẳng hạn như văn bản, hình ảnh hoặc video, để tạo ra các hệ thống nhận biết ngữ cảnh tốt hơn.</description></item><item><title>Text-to-Speech</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/text-to-speech/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/text-to-speech/</guid><description>Trong bối cảnh AI đa phương thức, công nghệ chuyển đổi văn bản thành giọng nói (TTS) chuyển đổi văn bản viết thành ngôn ngữ nói tự nhiên, cho phép các hệ thống AI giao tiếp bằng lời nói.</description></item><item><title>Speech-to-Text</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/speech-to-text/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/speech-to-text/</guid><description>Trong bối cảnh AI đa phương thức, công nghệ chuyển đổi giọng nói thành văn bản chuyển đổi ngôn ngữ nói thành văn bản viết, cho phép tích hợp liền mạch với các loại dữ liệu khác như hình ảnh và văn bản.</description></item><item><title>OpenAI Vision API</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/openai-vision-api/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/openai-vision-api/</guid><description>OpenAI Vision API cho phép các mô hình phân tích và hiểu hình ảnh, cho phép chúng xác định các đối tượng, nhận dạng văn bản và diễn giải nội dung hình ảnh.</description></item><item><title>DALL-E API</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/dall-e-api/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/dall-e-api/</guid><description>DALL-E API là một công cụ do OpenAI cung cấp cho phép các nhà phát triển tích hợp mô hình tạo hình ảnh DALL-E vào các ứng dụng.</description></item><item><title>Whisper API</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/whisper-api/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/whisper-api/</guid><description>Whisper API của OpenAI cho phép các nhà phát triển tích hợp khả năng chuyển đổi giọng nói thành văn bản vào ứng dụng.</description></item><item><title>Hugging Face Models</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/hugging-face-models/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/hugging-face-models/</guid><description>Các mô hình Hugging Face là một bộ sưu tập các mô hình ML được huấn luyện trước có sẵn thông qua nền tảng Hugging Face.</description></item><item><title>LangChain for Multimodal Apps</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/langchain-for-multimodal-apps/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/langchain-for-multimodal-apps/</guid><description>LangChain là một framework được thiết kế để xây dựng các ứng dụng tích hợp nhiều mô hình AI.</description></item><item><title>LlamaIndex for Multi-modal Apps</title><link>https://ngoctin.me/ai-engineer/08-multimodal-ai/llamaindex-for-multimodal-apps/</link><pubDate>Sat, 01 Aug 2026 00:00:00 +0000</pubDate><author>ngoctin.work@gmail.com (Nguyen Ngoc Tin)</author><guid>https://ngoctin.me/ai-engineer/08-multimodal-ai/llamaindex-for-multimodal-apps/</guid><description>LlamaIndex hỗ trợ các ứng dụng đa phương thức bằng cách liên kết các LLM với các nguồn dữ liệu đa dạng.</description></item></channel></rss>