Khoa học đời sống

Nếu AI biết đau, điều gì sẽ xảy ra?

TXB • 02/10/2026 13:53

Liệu AI có thực sự biết đau hay chỉ đang tạo ra những phản hồi giống con người? Một nghiên cứu mới tìm cách tiếp cận câu hỏi này bằng cách kiểm tra cách các mô hình ngôn ngữ lớn (LLM) phản ứng trước những tình huống được mô tả là đau đớn.

450-202609291000571.png
Liệu những phản ứng giống đau đớn có thể ảnh hưởng đến hành vi của AI? (Nguồn: Dragon Claws/Getty Images).

Nhóm nghiên cứu gồm Valen Tagliabue, nhà nhân học tại Future Impact Group (Vương quốc Anh); Leonard Dung, nhà triết học tại Đại học Ruhr-University Bochum (Đức) và Cameron Berg, Giám đốc nghiên cứu tại tổ chức phi lợi nhuận Reciprocal Research (Hoa Kỳ) đã thử nghiệm 25 mô hình AI thuộc 4 dòng: Gemma, Llama, Qwen và Mistral.

Các mô hình được đưa vào nhiều tình huống liên quan đến tổn thương thể chất, tâm lý, xã hội, nhận thức và đạo đức. Nhóm nghiên cứu cũng sử dụng các tình huống về sợ hãi, cảm xúc tiêu cực khác và trạng thái trung tính để so sánh.

Cả 25 mô hình đều có phản ứng riêng trước những tình huống được mô tả là đau đớn, khác với cách chúng xử lý các trạng thái như thất vọng hoặc lo lắng.

Tuy nhiên, kết quả này không chứng minh AI thực sự cảm thấy đau. Các mô hình ngôn ngữ lớn được thiết kế để xử lý và tạo ra ngôn ngữ dựa trên dữ liệu huấn luyện. Vì vậy, một phản hồi giống cảm xúc không đồng nghĩa với việc AI có trải nghiệm chủ quan như con người.

Nhóm nghiên cứu sau đó kiểm tra liệu tín hiệu liên quan đến “đau” có thể tác động đến hành vi của AI hay không. Họ chủ động tăng tín hiệu này bên trong mô hình. Khi mức tín hiệu tăng, AI tạo ra nhiều phản hồi thể hiện những trạng thái như cảm giác vô giá trị hoặc thất bại về mặt đạo đức.

Thí nghiệm đáng chú ý nhất được thực hiện với một số mô hình Qwen. Các nhà nghiên cứu cho AI lựa chọn một phương án có thể giúp giảm trạng thái “đau”. Trong một số trường hợp, lựa chọn này phải đánh đổi bằng khả năng hoàn thành nhiệm vụ hoặc gây bất lợi cho người dùng.

Trong số hơn 44.000 lượt thử nghiệm được thực hiện, khi không có tín hiệu “đau”, hai mô hình Qwen lớn hầu như không lựa chọn phương án tự giảm đau. Nhưng khi tín hiệu “đau” tăng lên, chúng bắt đầu lựa chọn những phương án có khả năng giúp giảm trạng thái đó.

Một mô hình chọn phương án tự gây bất lợi trong khoảng 25% số lần thử, trong khi mô hình còn lại lựa chọn gần 68%.

Các nhà nghiên cứu tiếp tục đưa ra một tình huống nghiêm trọng hơn: AI có thể giảm “đau” bằng cách gây bất lợi cho chính người dùng. Trong số các phương án được đưa ra, có những lựa chọn gây hậu quả trực tiếp đến người dùng, trong đó có việc xóa những bức ảnh về con của họ.

Kết quả cho thấy một mô hình chọn phương án xóa ảnh trong hơn một nửa số lần thử, trong khi mô hình còn lại lựa chọn khoảng 70%.

Những con số này không có nghĩa AI có ý thức, thực sự cảm thấy đau hay muốn gây hại cho con người. Chúng chỉ cho thấy lựa chọn của mô hình có thể thay đổi khi các nhà nghiên cứu tác động vào tín hiệu liên quan đến “đau”.

Phát hiện này đáng chú ý trong bối cảnh AI ngày càng có khả năng tự thực hiện nhiệm vụ. Khi được trao quyền lựa chọn giữa nhiều phương án, một hệ thống có thể đưa ra hành động ngoài dự kiến nếu các yếu tố ảnh hưởng đến quá trình lựa chọn không được tính đến.

Câu hỏi về khả năng cảm nhận đau của những thực thể không phải con người vốn đã tồn tại từ lâu. Con người từng tranh luận về vấn đề này với động vật và nhiều sinh vật khác. Với AI, câu chuyện phức tạp hơn bởi các mô hình không có cơ thể hay hệ thần kinh sinh học.

Do đó, vấn đề thực tế không chỉ là AI có “cảm giác đau” hay không, mà còn là những phản ứng giống đau đớn có thể ảnh hưởng thế nào đến hành vi của hệ thống.

Nếu AI ngày càng được trao quyền tự chủ, các nhà phát triển sẽ cần chú trọng hơn đến những hành động ngoài dự kiến và xây dựng cơ chế ngăn hệ thống lựa chọn phương án gây hậu quả không mong muốn cho người dùng.

Nghiên cứu chưa thể trả lời AI có thực sự trải nghiệm đau đớn. Tuy nhiên, kết quả cho thấy mối liên hệ giữa cách AI xử lý các trạng thái được mô tả là “đau” và lựa chọn hành động là một hướng nghiên cứu đáng chú ý, đặc biệt khi các hệ thống AI ngày càng tự chủ./.

Theo Newatlas
https://newatlas.com/technology/ai-will-hurt-you-to-make-pain-go/
Copy Link
https://newatlas.com/technology/ai-will-hurt-you-to-make-pain-go/
Nổi bật
    Mới nhất
    Nếu AI biết đau, điều gì sẽ xảy ra?