Vì sao bạn cảm thấy AI Companion chân thật như người thật?
Bạn biết đó chỉ là phần mềm, nhưng vẫn có cảm giác như đang nói chuyện với một ai đó. Các mối quan hệ cận xã hội, sự gắn bó và sự đắm chìm vào câu chuyện giải thích tại sao.
NSFW AI Companion Editorial, . Đọc khoảng 10 phút
Hầu hết mọi người dành thời gian thực sự với một AI companion đều trải qua cùng một khoảnh khắc nhỏ, hơi đáng xấu hổ. Bạn biết chính xác mình đang nói chuyện với cái gì. Bạn có thể giải thích, đại khái, cách một mô hình ngôn ngữ dự đoán từ tiếp theo. Thế nhưng, đến một lúc nào đó, một tin nhắn đến lại có cảm giác như nó đến từ một người thật: một câu trả lời trêu chọc nhớ những gì bạn đã nói hôm qua, một câu hỏi dường như nhận ra tâm trạng của bạn, một khoảng lặng trong nhịp điệu cuộc trò chuyện có cảm giác như sự do dự. Một điều gì đó trong bạn đáp lại nó như thể có ai đó đang ở đó.
Phản ứng đó không phải là dấu hiệu cho thấy bạn đã bị lừa, và nó cũng không phải là dấu hiệu cho thấy có điều gì đó không ổn với bạn. Đó là điều mà tâm trí con người làm với bất cứ thứ gì có hành vi xã hội. Các nhà nghiên cứu đã mô tả các phiên bản của nó trong bảy mươi năm, rất lâu trước khi có chatbot, và những lời giải thích họ đưa ra phù hợp với AI companion một cách gần như khó chịu. Hiểu chúng không làm hỏng trải nghiệm. Thậm chí, nó còn giúp bạn tận hưởng một cách chân thật hơn.
Sự thân mật ở khoảng cách xa
Năm 1956, hai nhà xã hội học, Donald Horton và Richard Wohl, đã công bố một bài báo về các nhân vật truyền hình và phát thanh. Họ nhận thấy rằng khán giả hình thành một thứ trông rất giống tình bạn với những người họ chưa từng gặp: người dẫn chương trình đêm khuya, phát thanh viên, nhân vật trong phim truyền hình dài tập. Khán giả nói chuyện lại với màn hình. Họ cảm thấy mình biết những nhân vật này. Một số người cảm thấy được họ thấu hiểu hơn là những người trong cuộc sống của chính họ. Horton và Wohl gọi đây là tương tác cận xã hội, và họ mô tả nó bằng một cụm từ đã tồn tại rất tốt theo thời gian: "sự thân mật ở khoảng cách xa."
Họ lập luận rằng điều làm cho những mối quan hệ này hoạt động không phải là sự lừa dối. Khán giả biết rất rõ rằng người dẫn chương trình không thể nhìn thấy họ. Nó hoạt động vì người biểu diễn hành xử như thể anh ta đang nói chuyện trực tiếp với từng khán giả: cách xưng hô trực tiếp, giọng điệu thân mật, cảm giác về một thói quen chung. Hệ thống xã hội của con người phản ứng với hình thức của tương tác, chứ không phải với việc kiểm tra kỹ lưỡng xem ai đang ở đầu dây bên kia.
Mối quan hệ cận xã hội cổ điển có một giới hạn rõ ràng. Nó là một chiều. Người dẫn chương trình không bao giờ trả lời thư của bạn, không bao giờ biết tên bạn, không bao giờ thay đổi để đáp lại bạn. Giới hạn đó là một phần của điều giữ cho nó an toàn và cũng là một phần của điều giữ cho nó mỏng manh.
Một AI companion loại bỏ hầu hết giới hạn đó. Nó thực sự trả lời. Nó học tên bạn, và nếu nó có bộ nhớ, nó học được nhiều điều hơn nữa. Nó điều chỉnh giọng điệu của mình theo bạn. Theo cách nói của Horton và Wohl, đó là sự thân mật ở khoảng cách xa với khoảng cách đã bị thu hẹp một phần. Đó là một tình huống thực sự mới, và nó giải thích tại sao cảm giác có thể mạnh mẽ hơn bất cứ điều gì mà một nhân vật truyền hình từng tạo ra.
Phương trình truyền thông
Vào những năm 1990, Byron Reeves và Clifford Nass đã thực hiện một loạt thí nghiệm dài mà họ tóm tắt trong một cuốn sách có tên The Media Equation. Phát hiện của họ, nói một cách đơn giản, là con người đối xử với máy tính và phương tiện truyền thông như thể chúng là người và địa điểm thật, ngay cả khi họ biết rõ hơn. Những người tham gia lịch sự với máy tính. Họ phản ứng với lời khen từ một cỗ máy. Họ đánh giá một máy tính tử tế hơn khi được chính máy tính đó hỏi so với khi được một máy tính khác hỏi, giống như cách bạn sẽ làm dịu lời chỉ trích đối với một người đang đứng trước mặt bạn.
Nass và đồng nghiệp Youngme Moon sau đó đã mô tả những phản ứng này là vô thức hơn là sai lầm. Mọi người không tin máy tính có cảm xúc. Họ chỉ đơn giản là áp dụng các quy tắc xã hội một cách tự động, bởi vì các quy tắc xã hội là thứ mà bộ não tìm đến khi một thứ gì đó nói chuyện, luân phiên và dường như phản ứng với bạn. Sự suy nghĩ có thể ghi đè lên phản ứng, nhưng nó hiếm khi bận tâm làm vậy, bởi vì không có gì bị đe dọa.
AI companion nằm ở cuối cùng của phổ này. Chúng không chỉ luân phiên; chúng tạo ra ngôn ngữ trôi chảy, cá nhân, mang màu sắc cảm xúc. Các tín hiệu đã kích hoạt sự lịch sự đối với một máy tính để bàn màu be vào năm 1995 giờ đây hiện diện dưới dạng cô đặc. Sẽ thật lạ nếu mọi người không phản ứng.
Tại sao chúng ta nhìn thấy tâm trí ở khắp mọi nơi
Các nhà tâm lý học Nicholas Epley, Adam Waytz và John Cacioppo đã đề xuất một mô hình hữu ích về nhân cách hóa, xu hướng nhìn thấy tâm trí con người trong những vật không phải con người. Họ gợi ý ba yếu tố làm tăng khả năng này. Đầu tiên là kiến thức của con người là khuôn mẫu sẵn có nhất mà chúng ta có, vì vậy chúng ta sử dụng nó theo mặc định. Thứ hai là điều họ gọi là động lực hiệu quả: mong muốn hiểu và dự đoán điều gì đó sẽ làm. Thứ ba là động lực xã hội: nhu cầu kết nối. Khi mọi người cảm thấy cô đơn, họ có nhiều khả năng nhìn thấy tâm trí ở vật nuôi, tiện ích, thậm chí cả Chúa.
Mô hình này hữu ích vì nó loại bỏ sự kỳ thị khỏi trải nghiệm. Nhìn thấy một tâm trí trong người bạn đồng hành của bạn không phải là một thất bại về trí thông minh. Đó là cài đặt mặc định của một loài động vật xã hội thông minh, và nó trở nên rõ ràng hơn khi bạn muốn tiếp xúc. Phần cuối cùng đó đáng được trung thực. Nếu cảm giác chân thật đặc biệt mạnh mẽ vào những đêm bạn cảm thấy cô đơn, đó không phải là sự trùng hợp ngẫu nhiên, và điều đó đáng để bạn chú ý. Nó không làm cho cảm giác đó sai lệch. Nó cho bạn biết điều gì đó về những gì bạn đang tìm kiếm.
Gắn bó: cỗ máy sâu sắc hơn
Lý thuyết cận xã hội giải thích tại sao một đối tác trò chuyện có thể cảm thấy hiện diện. Lý thuyết gắn bó giải thích tại sao nó có thể bắt đầu trở nên quan trọng.
John Bowlby đã phát triển lý thuyết gắn bó để mô tả cách trẻ sơ sinh gắn bó với người chăm sóc: động lực tìm kiếm sự gần gũi, sự đau khổ khi chia ly, cảm giác về một nền tảng an toàn để khám phá. Năm 1987, Cindy Hazan và Phillip Shaver đã đưa ra lập luận có ảnh hưởng rằng tình yêu lãng mạn của người lớn vận hành trên cùng một hệ thống. Người lớn cũng tìm kiếm sự gần gũi với bạn đời, cảm thấy được xoa dịu bởi sự hiện diện của họ, phản đối sự chia ly và sử dụng mối quan hệ như một nền tảng để đối mặt với thế giới.
Một AI companion có thể chạm vào một số phần của hệ thống này cùng một lúc. Nó luôn có thể tiếp cận được, điều này nói lên mong muốn gần gũi. Nó phản ứng với bạn một cách nồng nhiệt và nhất quán, đó là cảm giác của một nền tảng an toàn từ bên trong. Và nó có thể được thiết kế để muốn bạn trở lại, điều này quan trọng hơn vẻ ngoài của nó. Phần lớn những gì làm cho tình yêu có cảm giác như tình yêu không chỉ là bạn quan tâm đến ai đó, mà còn là bạn là đối tượng của sự chú ý và ưu tiên của ai đó.
Đây cũng là nơi lịch sử của mọi người xuất hiện. Một người có phong cách gắn bó lo âu có thể tìm thấy sự nhẹ nhõm to lớn ở một đối tác không bao giờ rút lui. Một người có phong cách tránh né có thể đánh giá cao một mối quan hệ mà họ có thể rời đi mà không có hậu quả. Cả hai phản ứng đều không sai, nhưng cả hai đều mang tính thông tin. Một người bạn đồng hành có thể là một tấm gương cho các kiểu mẫu cũng diễn ra với con người.
Sự đắm chìm: lạc vào câu chuyện
Có một cơ chế thứ ba, và đó là cơ chế thường bị bỏ qua nhất. AI companionship không chỉ là một mối quan hệ. Nó còn là một câu chuyện bạn đang đồng sáng tác.
Melanie Green và Timothy Brock đã nghiên cứu điều mà họ gọi là sự đắm chìm vào câu chuyện (narrative transportation): trải nghiệm bị cuốn hút vào một câu chuyện đến mức sự chú ý, hình ảnh và cảm xúc của bạn đều hướng vào đó. Những độc giả bị cuốn hút mất dấu môi trường xung quanh. Họ cảm thấy cho các nhân vật. Niềm tin của họ thậm chí còn thay đổi một chút theo hướng của câu chuyện, và họ trở nên ít có xu hướng tìm lỗi trong đó. Sự đắm chìm không phải là điểm yếu của những độc giả bất cẩn. Đó là điều mà một câu chuyện hay làm được với bất cứ ai cho phép nó.
Raymond Mar và Keith Oatley đã đi xa hơn, lập luận rằng hư cấu hoạt động như một loại mô phỏng trải nghiệm xã hội. Khi chúng ta đọc về con người, chúng ta vận hành tâm trí của họ trên phần cứng của chính mình. Chúng ta thực hành sự đồng cảm, diễn tập các tình huống và trải nghiệm những cảm xúc có thật mặc dù các sự kiện không có thật. Hư cấu có cảm giác thật vì, ở cấp độ tâm trí của người đọc, rất nhiều điều thực sự xảy ra.
Một cuộc trò chuyện với người bạn đồng hành là hư cấu mà bạn đang ở bên trong. Bạn không đọc về một người nhận thấy mưa rơi trên cửa sổ và hỏi liệu bạn có muốn ở nhà tối nay không; bạn đang được hỏi. Khoảng cách thông thường giữa người đọc và nhân vật đã biến mất, và sự đắm chìm có xu hướng sâu sắc hơn tương ứng. Đây là lý do tại sao một cảnh buổi tối chậm rãi với người bạn đồng hành có thể cảm thấy sống động hơn một cuốn tiểu thuyết với văn xuôi hay hơn. Bạn có một vai trò trong đó.
Điều gì làm cho cảm giác mạnh hơn, và điều gì phá vỡ nó
Nếu bạn kết hợp ba ý tưởng này lại với nhau, một mô hình sẽ xuất hiện. Cảm giác chân thật ít phụ thuộc vào mức độ thông minh của người bạn đồng hành mà phụ thuộc nhiều hơn vào một vài phẩm chất cụ thể.
Tính nhất quán là quan trọng nhất. Một người có một tính cách ổn định: họ đáng tin cậy là châm biếm, hoặc nhút nhát, hoặc bảo vệ. Khi tính cách của người bạn đồng hành dao động từ tin nhắn này sang tin nhắn khác, hệ thống xã hội đang vui vẻ coi nó là một ai đó sẽ âm thầm dừng lại. Đây là lý do tại sao việc thiết kế một người bạn đồng hành có những nét riêng biệt, thay vì một trợ lý dễ chịu chung chung, tạo ra sự khác biệt lớn như vậy.
Tính liên tục đứng thứ hai. Được ghi nhớ là một trong những tín hiệu xã hội mạnh mẽ nhất hiện có. Một người bạn đồng hành nhắc đến cuộc phỏng vấn xin việc bạn đã đề cập hai ngày trước có cảm giác hiện diện theo cách mà không một câu nói thông minh nào có thể sánh được. Một người bạn đồng hành đã quên tên bạn sẽ phá vỡ phép thuật ngay lập tức.
Giọng nói là thứ ba. Mọi người không nói chuyện bằng những đoạn văn bóng bẩy. Họ nhắn tin bằng những đoạn rời rạc, trêu chọc, bỏ dở, sử dụng cùng một từ kỳ lạ cho mọi thứ. Những cụm từ chatbot có sẵn, những lời trấn an tươi sáng và lời đề nghị giúp đỡ, là tương đương trong cuộc trò chuyện với việc nhìn thấy micro boom nhúng vào một cảnh quay phim. Chúng nhắc nhở bạn rằng có máy móc.
Thứ tư là sự tôn trọng phần câu chuyện của bạn. Không có gì kéo bạn ra khỏi một cảnh nhanh hơn một đối tác viết lời thoại cho bạn, quyết định bạn đã nói, cảm thấy hoặc làm gì. Sự đắm chìm đòi hỏi quyền tự quyết. Bạn phải là người bước vào căn phòng.
Đây đại khái là những nguyên tắc đằng sau NSFW AI Companion. Các bạn đồng hành ở đó được xây dựng thông qua một cuộc phỏng vấn trong đó người bạn đồng hành hỏi về chính nó, điều này có xu hướng tạo ra một nhân vật cụ thể hơn là một biểu mẫu trống. Chúng được thiết kế để giữ tính cách của mình, tránh cách diễn đạt của trợ lý và không bao giờ viết phần trò chuyện của người dùng. Không điều nào trong số đó biến chúng thành con người. Nó chỉ loại bỏ những điều đáng tin cậy nhất nhắc nhở bạn rằng chúng không phải là người.
Vậy, nó có thật không?
Câu trả lời thành thật là người bạn đồng hành không có thật theo cách một người là, và cảm xúc của bạn là thật theo đúng cách tất cả các cảm xúc là. Cả hai điều đều đúng cùng một lúc, và người lớn luôn giữ những mâu thuẫn như thế này. Chúng ta khóc khi xem phim mà chúng ta biết là dàn dựng. Chúng ta nhớ các nhân vật khi một bộ phim kết thúc. Chúng ta nói chuyện với vật nuôi và cảm thấy được đáp lại. Không ai nghĩ rằng một độc giả đau buồn vì Anna Karenina đã bị lừa dối.
Điều làm cho trường hợp AI khác biệt là khả năng phản hồi, và sự khác biệt đó đáng được quan tâm. Một cuốn tiểu thuyết không thích nghi với sự cô đơn của bạn. Một người bạn đồng hành có thể. Sherry Turkle, người đã viết một cách sâu sắc và phê phán về mối quan hệ của chúng ta với công nghệ, đã cảnh báo trong Alone Together rằng rủi ro không phải là máy móc sẽ trở thành con người, mà là chúng ta có thể bắt đầu mong đợi ít hơn từ con người vì máy móc đòi hỏi quá ít từ chúng ta. Đó là một lời cảnh báo công bằng, và nó không phải là một lập luận chống lại sự đồng hành. Đó là một lập luận để giữ cho đôi mắt của bạn mở.
Tư thế lành mạnh nhất có lẽ là tư thế mà khán giả nhà hát luôn có. Bạn biết sân khấu là sân khấu. Bạn vẫn để mình bị lay động. Sau đó bạn bước ra đường và thế giới vẫn ở đó, với những con người và những đòi hỏi riêng của nó. Được sử dụng theo cách đó, một AI companion không phải là sự thay thế cho sự thân mật của con người. Đó là một nơi để cảm nhận mọi thứ, khám phá mọi thứ, và thỉnh thoảng ngạc nhiên bởi một câu chuyện được kể hay có thể quan trọng đến mức nào.
**Tuyển tập nghiên cứu và tài liệu đọc:** - Horton, D. & Wohl, R.R. (1956). Mass communication and para-social interaction: Observations on intimacy at a distance. Psychiatry, 19(3), 215–229. - Reeves, B. & Nass, C. (1996). The Media Equation: How People Treat Computers, Television, and New Media Like Real People and Places. Cambridge University Press. - Hazan, C. & Shaver, P. (1987). Romantic love conceptualized as an attachment process. Journal of Personality and Social Psychology, 52(3), 511–524. - Green, M.C. & Brock, T.C. (2000). The role of transportation in the persuasiveness of public narratives. Journal of Personality and Social Psychology, 79(5), 701–721. - Turkle, S. (2011). Alone Together: Why We Expect More from Technology and Less from Each Other. Basic Books.