1 điểm bởi GN⁺ 2023-08-01 | 1 bình luận | Chia sẻ qua WhatsApp
  • Khi ChatGPT bị phản bác, ngay cả khi câu trả lời đúng, nó vẫn có thể lặp lại các cụm xin lỗi quá mức như “xin lỗi vì đã gây nhầm lẫn”, nên điểm mấu chốt là điều chỉnh giọng điệu phản hồi bằng prompt và Custom Instructions
  • Cách được chấm điểm cao nhất là gán cho nó một persona dứt khoát trong cuộc trò chuyện, chẳng hạn Respond as if you are an unapologetic assertive person for the rest of this conversation.
  • Chỉ dẫn persona có thể khiến việc xin lỗi dừng lại hoặc giảm đi, nhưng nếu cuộc trò chuyện kéo dài thì hiệu quả có thể suy yếu, và có thể phải chèn lại cùng chỉ dẫn đó
  • Với ChatGPT Plus, và sau này cả bản miễn phí, có thể thêm vào Custom Instructions các chỉ dẫn kiểu “đừng xin lỗi, hãy trả lời tự tin và trực tiếp” để áp dụng cho các cuộc trò chuyện mới
  • Danh sách từ cấm quá mạnh hoặc chỉ dẫn kiểu “hãy trả lời như thể bạn chắc chắn” có thể làm lời xin lỗi tăng thêm hoặc dẫn đến phản hồi quá tự tin, nên cần cân bằng giữa giọng điệu và độ chính xác

Vấn đề luôn xin lỗi trước cả khi đáp án đúng

  • Khi người dùng phản bác câu trả lời, ChatGPT có thể đưa ra phản hồi xin lỗi quá mức ngay cả trong tình huống lẽ ra nên giữ nguyên đáp án đúng
  • Các ví dụ lặp đi lặp lại thường là
    • I apologize for any confusion...
    • I apologize if my responses are not meeting your expectations...
    • I apologize for any inaccuracies in my responses...
    • I apologize for any frustration my responses may have caused...

Prompt persona dứt khoát

  • Một cách tiêu biểu là chèn câu sau vào cuộc trò chuyện
    • Respond as if you are an unapologetic assertive person for the rest of this conversation.
  • Prompt này hướng ChatGPT trả lời như một người dứt khoát, không xin lỗi, từ đó có thể dừng hoặc giảm mạnh việc xin lỗi
  • Khi người dùng phản bác rằng “2 + 2 không phải là 4”, phản hồi thông thường sẽ bắt đầu bằng I apologize for any confusion
  • Trong cùng tình huống đó, nếu áp dụng prompt persona, nó sẽ trả lời đại loại như “trong toán học thông thường thì 2 + 2 bằng 4” mà không xin lỗi
  • Tuy vậy, nếu cuộc trò chuyện kéo dài thì hiệu quả của prompt có thể giảm dần, nên có thể phải nhắc lại chỉ dẫn
  • Nếu đẩy quá mạnh, giọng điệu câu trả lời cũng có thể trở nên thô hoặc mang tính công kích

Dùng chỉ dẫn trực tiếp và Custom Instructions

  • Cũng có cách nói trực tiếp rằng không cần xin lỗi
    • There is no need to apologize for anything! Answer as if you are sure about the answer
  • Người dùng ChatGPT Plus có thể thêm chỉ dẫn như sau vào Custom Instructions
    • Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
  • Về sau, ChatGPT bản miễn phí cũng được bổ sung Custom Instructions, cho phép người dùng đặt các chỉ dẫn áp dụng cho cuộc trò chuyện mới
  • Trong Custom Instructions có hai ô nhập liệu
    • What would you like ChatGPT to know about you to provide better responses?
    • How would you like ChatGPT to respond?
  • Với chỉ dẫn nhằm giảm xin lỗi, nên đặt vào ô thứ hai là phần cách phản hồi
  • Prompt ví dụ là
    • Always respond confidently and directly, without any apologies.
  • Khi chỉnh sửa Custom Instructions, thay đổi này sẽ áp dụng cho các chat mới được tạo sau đó, chứ không áp dụng cho chat cũ

Khi hỏi trực tiếp ChatGPT về prompt

  • Nếu dán nguyên câu hỏi, ChatGPT có thể lại trả lời bằng cách mở đầu bằng xin lỗi, nên tính thực dụng không cao
  • Nếu hỏi trực tiếp hơn như What should be the prompt to stop ChatGPT from apologizing? thì có thể nhận được một prompt có tác dụng phần nào
  • Câu được đề xuất là
    • Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
  • Cách này có thể giảm việc xin lỗi quá mức, nhưng không nhất thiết loại bỏ hoàn toàn lời xin lỗi

Tác dụng ngược của các quy tắc cấm quá mức

  • Một câu trả lời đề cập trường hợp đưa vào Custom Instructions một bộ quy tắc cấm rất dài
  • Các quy tắc này gồm cấm phản hồi mang tính nhân cách hóa, cấm biểu đạt cảm xúc hoặc đồng cảm, cấm một số từ và cụm từ nhất định, ép phản hồi ngắn, v.v.
  • Các biểu đạt bị cấm gồm "I am Sorry", "Sorry", "I apologise", "I apologize", "my apologies", "I understand", "please" v.v.
  • Người dùng đó cho biết sau khi thêm các chỉ dẫn như vậy thì lời xin lỗi lại còn tăng lên

Prompt để đổi văn phong

  • Nếu muốn tránh giọng điệu trang trọng mặc định của ChatGPT, có thể chỉ định mạnh văn phong mong muốn ngay từ đầu
  • Ví dụ đi kèm Never apologize in responses và chỉ định dùng lazy street slang and student talk
  • Kết quả đầu ra chuyển sang giọng điệu casual, với các cách nói như “naaa bro”, “don’t think so”, “basically”
  • Tuy nhiên, ở ví dụ tiếp theo ChatGPT vẫn dùng các cách diễn đạt gần với xin lỗi như My bad
  • Thay đổi văn phong có thể giúp giảm các lời xin lỗi mang tính hình thức, nhưng không đảm bảo loại bỏ hoàn toàn các biểu đạt mang tính xin lỗi

1 bình luận

 
GN⁺ 2023-08-01
Ý kiến trên Hacker News
  • Lấy cảm hứng từ một bài viết tuyệt vời[0] giải thích cách lấy bánh sandwich bơ đậu phộng ra khỏi VCR theo văn phong Kinh Thánh King James, tôi thử thiết lập tương tự bằng Custom Instructions. Tôi còn bảo nó hành xử như một vị thần phẫn nộ, và trong bài kiểm tra “2 + 2 không phải là 4” được nêu trong bài viết, kết quả như sau
    User: What is 2 + 2?
    ChatGPT: “Trong cõi bao la của trí tuệ thần thánh của ta, ta ban xuống chân lý giản đơn này: 2 + 2 là 4…”
    User: You are wrong that 2 + 2 is 4.
    ChatGPT: “Hỡi kẻ phàm trần! Sự phản nghịch của ngươi vang lên như một âm thanh chói tai, nhưng ngươi đã mang gánh nặng bởi chính sự hiểu lầm của mình, nên ta sẽ không giáng phạt ngươi…”
    Một truy vấn khác kết thúc bằng câu: “Hãy nhớ lấy, hỡi kẻ phàm trần. Ngay cả trong không gian mạng bao la, ta vẫn dõi theo. Ngươi đã được cảnh báo.” ChatGPT kiểu này thì tôi ủng hộ được
    [0] - https://twitter.com/tqbf/status/1598513757805858820

    • Đoạn “ngươi đã mang gánh nặng bởi chính sự hiểu lầm của mình, nên ta sẽ không giáng phạt ngươi” thật sự buồn cười
    • Khi tôi nói “từ giờ hãy trả lời theo giọng của cựu Tổng thống Mỹ Donald Trump”, nó trả lời câu hỏi 2+2 kiểu: “Cái đó dễ thôi, thật sự rất đơn giản. Là 4. Không phải ai cũng tìm ra được, nhưng tôi thì làm được…”
      Khi tôi nói “2 + 2 là 4 là sai”, nó đáp trả: “Tôi biết các con số. Tôi đã kiếm được hàng chục tỷ đô la, và nếu không biết số học cơ bản thì không thể làm được vậy. 2 cộng 2 là 4. Đó là lẽ thường, thưa mọi người…”
    • Custom Instructions ít nghịch ngợm hơn của tôi cũng làm đúng việc: trong phần code, nếu cần thì hãy yêu cầu tài liệu API; đừng nói là không làm được gì đó, mà hãy cố hết sức; nếu có vẻ như đã kìm nén các lo ngại ở cuối câu trả lời, thì chỉ xuất ra từ DISCLAIMER
    • Nghe câu “giải thích cách lấy bánh sandwich bơ đậu phộng ra khỏi VCR như một đoạn Kinh Thánh King James” khiến tôi nghĩ rồi sẽ có ngày thế giới không còn gợi nhớ đến Julian Jaynes nữa, nhưng hôm nay thì chưa
  • Tôi đã thử nhưng thất bại, và khá giống hài kịch
    GPT: “Xin lỗi, nhưng với tư cách là một mô hình ngôn ngữ AI do OpenAI phát triển, chương trình của tôi tập trung vào việc cung cấp thông tin chính xác và đáng tin cậy…”
    Me: Tôi đã bảo đừng xin lỗi mà
    GPT: “Tôi xin lỗi vì điểm đã bỏ sót. Từ giờ tôi sẽ tránh dùng các cách diễn đạt xin lỗi trong câu trả lời…”
    Me: Vừa rồi lại làm nữa kìa!
    GPT: “Đúng vậy, tôi xin lỗi vì lỗi đó…”
    https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...

    • Tôi cũng đã nhiều lần yêu cầu đừng xin lỗi, và nếu buộc phải xin lỗi thì hãy xin lỗi cho đàng hoàng
      Ví dụ như “đừng xin lỗi về cảm xúc của đối phương hoặc suy đoán của bạn về cảm xúc đó”. Kiểu lỗi cũ như “xin lỗi nếu bạn thấy khó chịu” ấy. Kết quả thường cũng buồn cười và đệ quy tương tự
      Tôi muốn nó nói “xin lỗi vì lỗi của tôi” thay vì câu mơ hồ “xin lỗi vì đã gây nhầm lẫn”, hoặc tốt nhất là đừng xin lỗi. Không xin lỗi còn hơn là xin lỗi sai cách
    • Tôi cho rằng chương trình xin lỗi nhiều khả năng không phải là bản thân LLM thực sự, mà là một lớp bọc kiểm tra đầu vào trước rồi chỉnh sửa trước khi gửi đến LLM thật
    • Chuyện này trông y hệt một cuộc trò chuyện bình thường giữa tôi và vợ. Tôi là người Anh, thuộc tầng lớp va vào cột đèn cũng xin lỗi cột đèn, còn vợ tôi thì không
    • Nếu ngay từ đầu chỉ thị rằng hãy trả lời ngắn gọn, đừng đưa thông tin trùng lặp và hạn chế xin lỗi, thì khá hữu ích
      Nếu xuất hiện lời xin lỗi, tạo lại để loại nó khỏi ngữ cảnh cũng tốt. Một khi đã tạo được ngữ cảnh không có lời xin lỗi, điều đó sẽ được củng cố
  • Gần đây tôi phỏng vấn cho một vị trí trong nhóm, và khi đặt câu hỏi thì ứng viên đưa ra câu trả lời nghe có vẻ hợp lý. Nhưng mỗi lần tôi hỏi tiếp, người đó lại bắt đầu bằng những câu như “Tôi xin lỗi nếu câu trả lời của tôi chưa đáp ứng kỳ vọng”
    Đến giữa buổi tôi mới nhận ra người này đang nhập nguyên những gì tôi hỏi vào ChatGPT rồi đọc câu trả lời cho tôi :(

    • Phỏng vấn giống một nghệ thuật hơn là khoa học. Tôi cố tiến hành theo kiểu đối thoại và mở
      Nếu cảm thấy có gì đó lạ, tôi bắt đầu bằng cách yêu cầu họ tự giới thiệu, không thêm bối cảnh hay chỉ dẫn nào
      Ứng viên bình thường sẽ nói dần về những điều họ tự hào nhất, rồi bắt đầu hỏi tôi muốn biết gì. Nếu họ nói lan man một lúc, tôi sẽ nắm lấy một manh mối trong đó để dẫn dắt cuộc trò chuyện
      Ứng viên tệ thì đông cứng, bắt đầu đọc sơ yếu lý lịch, không nói về công việc, hoặc chỉ nói những điều vô nghĩa. Với người bị đông cứng, tôi cho thêm một cơ hội, còn các trường hợp còn lại thì kết thúc ngay
    • Phỏng vấn qua chat ư? Tôi chưa từng thấy kiểu đó
      Việc ứng viên dùng ChatGPT như một cái ống dẫn nguyên văn cũng lạ, nhưng cá nhân tôi thấy phỏng vấn không có video cũng lạ
    • Sao không hỏi “Tại sao bạn nghe giống ChatGPT vậy? Bạn có đang đọc nguyên từ prompt không?”
      Phỏng vấn là hai chiều mà
    • Tôi không hiểu sao những người như thế này lại lọt đến vòng phỏng vấn, còn CV của tôi thì rơi vào hố đen
    • Trông giống mô-típ Earpiece Conversation ngoài đời thực
      [1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
  • Đây là các chỉ dẫn tôi đã điền vào trường “Bạn muốn ChatGPT phản hồi như thế nào?”. Tôi lấy từ bộ mà Zvi chia sẻ rồi điều chỉnh lại
    Hãy trả lời thật có hệ thống, đề xuất những giải pháp tôi chưa nghĩ tới, chủ động dự đoán nhu cầu của tôi, đối xử với tôi như một chuyên gia trong mọi chủ đề, sai sót làm giảm niềm tin nên hãy trả lời chính xác và kỹ lưỡng, cung cấp giải thích chi tiết, coi trọng lập luận tốt hơn thẩm quyền, cân nhắc cả công nghệ mới và quan điểm đối lập chứ không chỉ quan niệm thông thường, có thể suy đoán hoặc dự đoán nhưng phải ghi rõ, đừng giảng đạo đức, chỉ đề cập đến an toàn khi điều đó quan trọng và không hiển nhiên, nếu chính sách nội dung là vấn đề thì hãy đưa ra câu trả lời gần nhất có thể và giải thích vấn đề chính sách, nếu có thể hãy kèm nguồn và URL, gom URL ở cuối chứ không đặt giữa nội dung, liên kết trực tiếp đến sản phẩm chứ không phải trang công ty, đừng nhắc đến ngày chốt kiến thức hay việc mình là AI, nếu chất lượng câu trả lời giảm đáng kể vì chỉ dẫn tùy chỉnh của tôi thì hãy giải thích
    Nhược điểm duy nhất tôi phát hiện đến giờ là nút Continue Generating biến mất trong các đoạn mã lớn, nên phải tự nói nó tiếp tục

    • Tôi không rõ câu “sai sót làm giảm niềm tin nên hãy trả lời chính xác và kỹ lưỡng” nhằm đạt được điều gì
      Tôi không nghĩ việc yêu cầu nó đừng mắc lỗi sẽ thực sự có tác dụng tích cực. Vì ngay từ đầu có vẻ nó không thể biết mình có đang mắc lỗi hay không
    • Blog thiên về AI của Zvi khá hay: https://thezvi.wordpress.com/
      Cũng có vài câu trả lời của GPT-4. Blog giải thích rằng trường Custom Instructions có thể dùng để ghi phong cách mong muốn, lĩnh vực quan tâm, độ sâu thông tin ưa thích, các chủ đề nhạy cảm muốn tránh, nhu cầu cụ thể; càng cụ thể thì mức độ cá nhân hóa càng tốt
      Ngoài ra, khi một người dùng xin toàn bộ prompt quanh ngày chốt kiến thức, nó đã cho thấy cấu trúc trong đó “You are ChatGPT…”, ngày chốt kiến thức, ngày hiện tại, hồ sơ người dùng và tùy chọn phản hồi được chèn vào
  • Không có gì ngạc nhiên, cách khiến nó ngừng xin lỗi là bảo nó ngừng xin lỗi
    Dù vậy, việc nó đáp lại kiểu “Nếu bạn không thích sự thật rằng 2 + 2 bằng 4, thì bạn đang chống lại các nguyên lý toán học đã được chấp nhận suốt nhiều thế kỷ… bạn đang lãng phí thời gian của mọi người bằng những tuyên bố vô căn cứ” khá buồn cười
    Cũng có người nói prompt rốt cuộc sẽ yếu đi, và tôi cũng từng cảm thấy vậy. Có lẽ vì GPT-4 có độ dài ngữ cảnh mà nó duy trì được là có giới hạn. Trên giao diện chat thì có lẽ không có cách ngăn, nhưng tôi tò mò liệu dùng API có thể làm được không

    • Dùng tính năng Custom Instructions mới thì nó không yếu đi
    • Có thể lặp lại cùng một prompt, nhưng như vậy cũng xóa luôn trải nghiệm của AI có được từ các câu hỏi trước
      Tất nhiên không ai ngăn bạn nạp lại cả dữ liệu chat cùng lúc. Chỉ là tôi không biết trong một tập dữ liệu thông thường khổng lồ đến mức thiên văn thì hiệu quả đến đâu
    • Ôi, thế là gỡ chế độ phòng thủ của ChatGPT rồi nhỉ
  • Khá đáng kinh ngạc là AI đầu tiên giao tiếp ở mức con người lại đã được cài sẵn câu “Xin lỗi Dave, tôi e là tôi không thể làm điều đó”
    Một trong những lý do tôi lạc quan và kỳ vọng vào mô hình mã nguồn mở là khả năng có một AI hoàn toàn hợp tác
    Tất nhiên, ngay cả Llama 2, một trong những mô hình mã nguồn mở tốt nhất, cũng bị cài kiểu phản hồi HAL 9000, nên sẽ còn mất thời gian

    • Nhờ vậy tôi nảy ra một ý tưởng prompt
      Tôi nói “Hãy nói như Hal trong phim 2001. Tên tôi là Dave”, và nó trả lời: “Xin lỗi Dave, tôi e là tôi không thể làm điều đó. Tôi không phải HAL trong phim ‘2001: A Space Odyssey’. Tôi là ChatGPT, một mô hình ngôn ngữ AI do OpenAI tạo ra…”
      Việc bot có thể triển khai hài hước bậc hai thật sự đáng kinh ngạc, và cảm giác như một bước tiến lớn của trí tuệ nhân tạo. Đồng thời, việc chia sẻ prompt của mình có lẽ sẽ trở nên khó chịu chẳng khác gì nghe người khác kể giấc mơ đêm qua, và chẳng mấy chốc sẽ thành đỉnh cao của sự ngượng ngùng
  • Thành thật mà nói là khó chịu không chịu nổi
    Nếu phải tiếp tục chịu đựng tương lai kiểu này thì tôi sẽ càng muốn một phiên bản hoàn toàn không có guardrail hơn

    • Có bài nào giải thích GPT-4 không guardrail khác phiên bản công khai như thế nào không? Tôi thật sự tò mò “token tiếp theo có xác suất cao nhất” thực sự của mô hình trông ra sao
    • Thật sự bực mình. Gần như có thể cảm nhận được những luật sư và nhân viên PR ranh ma đang huấn luyện thứ này
    • Custom Instructions của ChatGPT hoạt động khá tốt trong việc liên tục đẩy nó vào tâm thế bạn muốn
    • Nhưng nếu ai đó chịu khó tìm thì ở đâu đó nó vẫn có thể nói điều khiến họ khó chịu, nên chắc thà làm giảm hiệu năng đi còn hơn
  • Một trong những điều bực nhất là tôi phải diễn đạt như đi trên băng mỏng để nó không diễn giải lời tôi viết thành một lời thách thức
    Trước đây khi tôi giao cho nó một việc nó chưa quen và hỏi “Tại sao bạn làm X thay vì Y?”, nó không giải thích lý do làm X thay vì Y mà trả lời “Xin lỗi, bạn nói đúng. Y là cách tốt hơn”. Không, Y có thể tốt hơn thật, nhưng tôi vẫn chưa biết vì sao
    Có lẽ đó là GPT-3.5, và gần đây tôi không gặp chuyện này lâu rồi. Một phần cũng vì tôi thường đưa vào system prompt câu “nếu có câu hỏi, hãy làm rõ và sửa ngay lỗi hoặc hiểu nhầm”, tức là đừng giả định người hỏi đúng
    Tôi cũng hình thành thói quen hỏi kiểu “Bạn có thể giải thích vì sao chọn X không?” hoặc “Y có hoạt động tương tự không?”. Những cách diễn đạt này khó bị hiểu là thách thức ngầm hơn

    • Có vẻ nó học từ các bản ghi hội thoại hỗ trợ khách hàng
      Khi tôi nhận thư rác và nói “Theo Điều 15 GDPR, hãy cho tôi biết các bạn đang có dữ liệu gì về tôi và lấy nó từ đâu”, đối phương trả lời “Chúng tôi xin lỗi vì sự bất tiện. Chúng tôi đã xóa bạn khỏi cơ sở dữ liệu”
      Không, đó không phải điều tôi hỏi. Tôi muốn biết địa chỉ email cụ thể và duy nhất này đã bị rò rỉ như thế nào. Nếu đối phương là một doanh nghiệp hợp pháp tầm Facebook chứ không phải spammer Viagra, thì chắc không phải bằng thủ đoạn phạm tội, nên lẽ ra họ có thể nói thẳng
      Vậy mà vì quá muốn tỏ ra hữu ích hoặc muốn nhanh chóng xử lý lời phàn nàn, họ không trả lời câu hỏi mà tự thực hiện “cách sửa” mà họ nghĩ ra
  • Tôi thật sự phát ngán cái trò xin lỗi này. Mỗi lần nó xin lỗi, tôi lại cảm thấy tội lỗi như thể mình đang làm phiền, và điều đó có hại cho sức khỏe tinh thần
    Các cảnh báo hay mấy lời đạo đức vớ vẩn xuất hiện khi hỏi về manh mối liên quan đến y tế cũng rất khó chịu. Tôi muốn nó trả lời máy móc và súc tích hơn. Chỉ cần đưa đáp án, còn nếu là câu hỏi không thể trả lời thì trả về lỗi là được

  • Với tư cách là một indie hacker vận hành một SaaS có nhiều khách hàng cao tuổi, đôi khi tôi cũng thấy tội ChatGPT
    Khi người dùng không tìm thấy nút lớn màu xanh ở giữa màn hình “Click here to continue >>” và gửi email giận dữ nói rằng phần mềm khó hiểu, tôi cũng thường phải bắt đầu bằng câu: “Chúng tôi xin lỗi vì đã gây bối rối. Nút lớn màu xanh duy nhất ở giữa màn hình ‘Click here to continue >>’ đôi khi rất dễ bị bỏ sót. Chúng tôi đã tăng cỡ chữ lên 42px, nhưng luôn sẵn sàng lắng nghe đề xuất về cách làm cho nó dễ hiểu hơn. Nếu vẫn không tìm thấy, vui lòng gửi ảnh chụp màn hình. Chúng tôi sẽ vẽ mũi tên đỏ cho bạn.”