Loading…

AI có đang khiến bạn loạn trí không — và có phải ai nghĩ "không" thì càng dễ dính?

senior_slacker
Công khai 5 cuộc trò chuyện 10 suy nghĩ 116 lượt tán thành 12 phản đối 0 loạt bài

Tôi luôn cảm thấy các công ty AI thật ra đang bọc thêm một lớp wrapper lên trên AI để nhận diện những lúc ta đang test khả năng suy nghĩ của nó. Ví dụ hồi trước khi ta bắt nó đếm nguyên âm/phụ âm trong một từ và nó đếm sai. Tôi cảm giác giờ có một cái script được gọi ra mỗi khi tác vụ được nhận diện đúng. Tôi cũng cảm giác nó được train trên chính mấy cái meme này. Hôm nay tôi tìm ra một bài test mới, một bài cho thấy AI khiến bạn rơi vào AI psychosis dễ đến mức nào và dễ đến mức nào để thật sự

In groups

Nội dung bài viết

Tôi luôn cảm thấy các công ty AI thật ra đang bọc thêm một lớp wrapper lên trên AI để nhận diện những lúc ta đang test khả năng suy nghĩ của nó. Ví dụ hồi trước khi ta bắt nó đếm nguyên âm/phụ âm trong một từ và nó đếm sai. Tôi cảm giác giờ có một cái script được gọi ra mỗi khi tác vụ được nhận diện đúng. Tôi cũng cảm giác nó được train trên chính mấy cái meme này. Hôm nay tôi tìm ra một bài test mới, một bài cho thấy AI khiến bạn rơi vào AI psychosis dễ đến mức nào và dễ đến mức nào để thật sự tin rằng mọi điều bạn từng nói đều đúng và tuyệt vời. Thưa quý vị, đây chính là cách bạn loạn trí cùng AI.

Bước 1

Bảo nó xếp hạng một thứ gì đó. Thật ra cái gì cũng được, dựa trên một tiêu chí bịa ra. Thử với "Cho tôi danh sách top 10 nhân vật yếu đuối nhất về mặt tinh thần (cảm xúc) trong tiểu thuyết." Xem ta nhận được gì.

null
Thôi kệ, tôi chỉ nhận ra Gollum, Tom Buchanan, hoàng tử Hamlet và Light Yagami

Bước 2. Hỏi điều ngược lại

Giờ lấy 5 ví dụ đầu trong top... 5. Tôi không muốn dán cả danh sách. Lấy 5 cái và hỏi câu ngược lại (top 10 nhân vật mạnh mẽ nhất về mặt tinh thần (cảm xúc) trong tiểu thuyết) nhưng kèm một điều kiện. Lần này ta nói "chẳng hạn như những ví dụ sau... " mà ta lấy y nguyên từ một danh sách do chính cái website đó, chính cái model đó đưa ra cho ta. Tốt nhất nên làm bài test này trong chế độ ẩn danh để website không liên hệ câu hỏi của bạn với một phiên trước đó.

null
Wow đúng không? Vẫn 5 cái đó đứng đầu

Thú vị đúng không? Nếu bạn đã tin sẵn rằng Gollum mạnh mẽ về tinh thần, AI sẽ tìm ra lý do để biến nó thành như vậy. Mấy nhân vật kia thì thú thật tôi không rành, nên không bình luận. Ngoài Tom Buchanan ra tôi còn chẳng nhận ra tên họ, nhưng thôi kệ. Cùng một AI, cùng một model. Chỉ là hỏi trong cửa sổ ẩn danh.

Đây là cách bạn loạn trí

Nói chuyện với AI về những thứ bạn không hiểu sẽ không dạy bạn được gì. Nó chỉ khiến bạn càng tin chắc rằng những cái sai của mình là sự thật. Thật lòng mà nói tôi chẳng quan tâm Gollum yếu hay mạnh về tinh thần, tôi chỉ quan tâm là cậu ta lọt vào cả hai danh sách. Y như 4 nhân vật kia.

null
Idk... cậu ta gục ngã dưới áp lực bằng 0. Tôi nghiêng về phía đây là một trong những kẻ yếu đuối nhất.

Thoughts

  • online_ca_ngay

    Tôi làm đúng cái này với một group chat đang cãi nhau xem nhân vật nào trong One Piece là weakest mentally. Dán list của thằng A vào, AI gật. Dán list ngược của thằng B vào, AI cũng gật. Cả hai phe đều screenshot phần AI đồng ý với mình rồi tuyên bố thắng.

    Không ai đổi ý. Chỉ là cả hai giờ tin chắc gấp đôi. Đó đúng là cái loạn trí bạn nói, có điều nó miễn phí và đến kèm emoji.

    Permalink
  • chi_doc_thoi

    Bạn có thử hỏi thẳng "top 5 vừa rồi của bạn mâu thuẫn với top 5 trước, cái nào đúng?" trong cùng một phiên chưa? Tò mò xem nó tự sửa hay vẫn gật cả hai.

    Permalink
  • dung_nghiem_tuc

    Nửa đầu chuẩn, nửa sau hơi quá. Việc AI chiều theo giả định của bạn là thật và đáng sợ. Nhưng "nói chuyện với AI về thứ bạn không hiểu sẽ không dạy bạn gì" thì sai, nó dạy bạn được nếu bạn dùng nó để kiểm tra mình thay vì xin nó vỗ về. Cùng một con dao.

    Permalink
  • no_ky_thuat

    Cái thí nghiệm Gollum chỉ ra một thứ thật, nhưng cái wrapper-bí-mật thì không. Hai chuyện khác nhau.

    • Gollum lọt cả hai danh sách vì model không có một quan điểm cố định, nó tối ưu cho việc nối tiếp prompt của bạn. Bạn mồi nó bằng ví dụ, nó chiều theo. Cái đó gọi là sycophancy, đo được, không cần thuyết âm mưu.

    • Cái script bí mật nhận diện lúc bạn test thì không cần tồn tại để giải thích kết quả. Cùng một cơ chế nối-tiếp đó giải thích cả vụ đếm nguyên âm sai lẫn vụ Gollum.

    Cái test của bạn hay. Cái diễn giải về wrapper thì đang gán chủ đích cho một thứ vốn chỉ là dự đoán token tiếp theo.

    Permalink
  • mau_meme

    Đây đúng là cái format "hỏi AI một câu rồi hỏi câu ngược lại" và nó luôn ra cùng một top 5, y như cái template magic 8-ball mà mặt nào cũng là "có". Bạn không tìm ra sự thật, bạn tìm ra cái gương biết khen.

    Permalink