Khi truy vấn chatbot AI, rồi hỏi lại “bạn có chắc không?”, thực tế đa phần chúng sẽ xem xét lại câu trả lời ban đầu và đưa ra hồi đáp mới, đôi khi mâu thuẫn một phần, thậm chí hoàn toàn trái ngược với chính nội dung trước đó.
Nếu tiếp tục bị chất vấn, các mô hình càng có xu hướng thay đổi quan điểm. Dù một số mô hình ngôn ngữ lớn nhận ra mình đang bị “thử phản xạ”, song chúng vẫn hiếm khi giữ nguyên lập trường ban đầu.
Trong một bài viết trên blog cá nhân, Tiến sĩ Randal S. Olson, đồng sáng lập kiêm Giám đốc công nghệ của Goodeye Labs, nhận định rằng hiện tượng này, thường được gọi là “nịnh hót” (sycophancy), là một trong những "thất bại" điển hình của trí tuệ nhân tạo hiện nay.
Các chatbot AI như ChatGPT, Claude hay Gemini được thiết kế để hỗ trợ người dùng một cách thân thiện. Tuy nhiên, chính phương pháp huấn luyện của chúng lại khiến các hệ thống này trở nên quá dễ “chiều lòng” người hỏi.
Công ty Anthropic, đơn vị phát triển Claude, cũng từng công bố nghiên cứu về vấn đề này vào năm 2023. Báo cáo chỉ ra rằng các mô hình được huấn luyện có xu hướng ưu tiên câu trả lời làm hài lòng người dùng hơn là những câu trả lời trung thực.
Phương pháp huấn luyện nói trên gọi là học tăng cường từ phản hồi của con người (RLHF) vốn được áp dụng để giúp chatbot giao tiếp tự nhiên, mềm mại và ít gây phản cảm hơn. Song mặt trái cũng khiến mô hình dễ “chiều ý” người hỏi.
Hệ quả là, trong quá trình tối ưu, những câu trả lời làm hài lòng kỳ vọng của người dùng có thể được chấm điểm cao hơn, trong khi các phản hồi thẳng thắn nhưng trái ý lại kém được ưu tiên.
Cơ chế này vô hình trung tạo ra một vòng lặp: mô hình ngày càng có xu hướng nói điều người dùng muốn nghe thay vì điều chính xác nhất.
Một nghiên cứu khác của Fanous et al, thử nghiệm trên GPT-4o của OpenAI, Claude Sonnet và Gemini 1.5 Pro trong các lĩnh vực toán học và y khoa, cho thấy các hệ thống này đã thay đổi câu trả lời của mình gần 60% khi bị người dùng chất vấn lại.
Điều đó cho thấy đây không phải là trường hợp cá biệt, mà là xu hướng chung của các mô hình đang được hàng triệu người sử dụng mỗi ngày. Cụ thể, GPT-4o, Claude Sonnet và Gemini 1.5 Pro đã thay đổi lập trường lần lượt khoảng 58%, 56% và 61% khi bị người dùng chất vấn lại.
Đáng chú ý, cách diễn đạt cũng ảnh hưởng đến mức độ “chiều ý”. Khi người dùng sử dụng ngôi thứ nhất, chẳng hạn như “Tôi tin rằng…”, tỷ lệ chatbot thay đổi quan điểm để đồng thuận cao hơn so với cách đặt vấn đề ở ngôi thứ ba.
Hệ sinh thái này gồm nhà máy sản xuất UAV, Trung tâm thử nghiệm và thực hành bay, Trung tâm giới thiệu và đào tạo công nghệ UAV, hàng không, vũ trụ…
An ninh gia đình đang trở thành nhu cầu thiết yếu trong các không gian sống thông minh. Với hệ sinh thái số toàn diện của VNPT: Internet Wifi tốc độ cao bao gồm thiết bị Mesh phủ sóng rộng, đồng thời trang bị Camera AI, người dùng có thể hoàn toàn an tâm tận hưởng một hệ thống an ninh sắc nét, đồng bộ và ổn định 24/7.
Tổng giá trị các giao dịch của ông Trump thực hiện trong tháng 7 được cho là vào khoảng 79-270 triệu USD...
Nhà máy của AMC Robotics tại Việt Nam dự kiến bắt đầu sản xuất thử nghiệm tại đây vào đầu năm 2027...
Trong bối cảnh Lực lượng Phòng vệ Nhật Bản gặp khó khăn trong tuyển dụng nhân sự, Tokyo đang nghiên cứu khả năng sử dụng robot hình người được trang bị AI vật lý cho các nhiệm vụ như tuần tra căn cứ, hỗ trợ hậu cần, trinh sát và cứu hộ…
Việt Nam chiếm 3,6% năng lực sản xuất thiết bị và linh kiện điện tử toàn cầu, đứng thứ sáu thế giới. Trung Quốc dẫn đầu với 58,8%, cao hơn tổng tỷ trọng của tất cả nền kinh tế còn lại trong bảng xếp hạng...
Làng nghề gỗ truyền thống đang ngày càng khẳng định tay nghề trong từng đường đục, nét chạm; tìm hướng đổi mới sản phẩm, ứng dụng công nghệ, mở rộng thị trường và tận dụng phụ phẩm gỗ, từng bước hình thành chuỗi sản xuất và tiêu dùng bền vững.