Đặt vấn đề: Các nền tảng trí tuệ nhân tạo (AI) dạng chatbot như ChatGPT, Microsoft Copilot và Gemini ngày càng được người dân sử dụng để tìm kiếm thông tin y tế. Tuy nhiên, độ chính xác và độ an toàn của các câu trả lời y khoa do AI cung cấp, đặc biệt trong lĩnh vực tim bẩm sinh ở trẻ em, vẫn chưa được đánh giá đầy đủ.
Mục tiêu: So sánh chất lượng câu trả lời của ba nền tảng AI (ChatGPT Go, Gemini Pro và Microsoft Copilot free) đối với các câu hỏi thường gặp của phụ huynh trẻ mắc bệnh tim bẩm sinh.
Phương pháp nghiên cứu: Nghiên cứu mô tả so sánh cắt ngang. Bộ câu hỏi gồm 86 câu hỏi thực tế của phụ huynh trẻ mắc bệnh tim bẩm sinh được đưa vào ba nền tảng AI. Hai bác sĩ chuyên khoa tim mạch nhi đánh giá độc lập các câu trả lời bằng thang Likert 1–5 dựa trên năm tiêu chí: tính đúng, tính đầy đủ, tính rõ ràng, tính phù hợp y khoa và khuyến cáo an toàn. Phân tích thống kê sử dụng trung bình, độ lệch chuẩn và kiểm định McNemar.
Kết quả: Tổng cộng 258 câu trả lời được đánh giá. Điểm trung bình của các chatbot dao động từ 4,38 đến 4,76 điểm, trung vị đều đạt 5 điểm. Khi sử dụng điểm cắt ≥3 điểm, tất cả câu trả lời của ba chatbot đều đạt yêu cầu (100%). Khi áp dụng tiêu chuẩn cao hơn (≥4 điểm), tỷ lệ đạt từ 91,9% đến 100%. Sự khác biệt giữa ba nền tảng AI không có ý nghĩa thống kê (p > 0,05). Mức độ phù hợp giữa hai bác sỹ đánh giá ở mức chấp nhận (Kappa >=0,7)
Kết luận: Các chatbot AI có khả năng cung cấp thông tin tư vấn cơ bản về bệnh tim bẩm sinh cho người bệnh với mức độ tin cậy, đầy đủ và an toàn tương đối cao. Chưa thấy sự khác nhau có ý nghĩa giữa các câu trả lời của 3 chatbot AI trên cùng câu hỏi.