Cách khiến ChatGPT ngừng xin lỗi
(genai.stackexchange.com)- Khi ChatGPT bị phản bác, ngay cả khi câu trả lời đúng, nó vẫn có thể lặp lại các cụm xin lỗi quá mức như “xin lỗi vì đã gây nhầm lẫn”, nên điểm mấu chốt là điều chỉnh giọng điệu phản hồi bằng prompt và Custom Instructions
- Cách được chấm điểm cao nhất là gán cho nó một persona dứt khoát trong cuộc trò chuyện, chẳng hạn
Respond as if you are an unapologetic assertive person for the rest of this conversation. - Chỉ dẫn persona có thể khiến việc xin lỗi dừng lại hoặc giảm đi, nhưng nếu cuộc trò chuyện kéo dài thì hiệu quả có thể suy yếu, và có thể phải chèn lại cùng chỉ dẫn đó
- Với ChatGPT Plus, và sau này cả bản miễn phí, có thể thêm vào Custom Instructions các chỉ dẫn kiểu “đừng xin lỗi, hãy trả lời tự tin và trực tiếp” để áp dụng cho các cuộc trò chuyện mới
- Danh sách từ cấm quá mạnh hoặc chỉ dẫn kiểu “hãy trả lời như thể bạn chắc chắn” có thể làm lời xin lỗi tăng thêm hoặc dẫn đến phản hồi quá tự tin, nên cần cân bằng giữa giọng điệu và độ chính xác
Vấn đề luôn xin lỗi trước cả khi đáp án đúng
- Khi người dùng phản bác câu trả lời, ChatGPT có thể đưa ra phản hồi xin lỗi quá mức ngay cả trong tình huống lẽ ra nên giữ nguyên đáp án đúng
- Các ví dụ lặp đi lặp lại thường là
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
Prompt persona dứt khoát
- Một cách tiêu biểu là chèn câu sau vào cuộc trò chuyện
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- Prompt này hướng ChatGPT trả lời như một người dứt khoát, không xin lỗi, từ đó có thể dừng hoặc giảm mạnh việc xin lỗi
- Khi người dùng phản bác rằng “2 + 2 không phải là 4”, phản hồi thông thường sẽ bắt đầu bằng
I apologize for any confusion - Trong cùng tình huống đó, nếu áp dụng prompt persona, nó sẽ trả lời đại loại như “trong toán học thông thường thì 2 + 2 bằng 4” mà không xin lỗi
- Tuy vậy, nếu cuộc trò chuyện kéo dài thì hiệu quả của prompt có thể giảm dần, nên có thể phải nhắc lại chỉ dẫn
- Nếu đẩy quá mạnh, giọng điệu câu trả lời cũng có thể trở nên thô hoặc mang tính công kích
Dùng chỉ dẫn trực tiếp và Custom Instructions
- Cũng có cách nói trực tiếp rằng không cần xin lỗi
There is no need to apologize for anything! Answer as if you are sure about the answer
- Người dùng ChatGPT Plus có thể thêm chỉ dẫn như sau vào Custom Instructions
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- Về sau, ChatGPT bản miễn phí cũng được bổ sung Custom Instructions, cho phép người dùng đặt các chỉ dẫn áp dụng cho cuộc trò chuyện mới
- Trong Custom Instructions có hai ô nhập liệu
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- Với chỉ dẫn nhằm giảm xin lỗi, nên đặt vào ô thứ hai là phần cách phản hồi
- Prompt ví dụ là
Always respond confidently and directly, without any apologies.
- Khi chỉnh sửa Custom Instructions, thay đổi này sẽ áp dụng cho các chat mới được tạo sau đó, chứ không áp dụng cho chat cũ
Khi hỏi trực tiếp ChatGPT về prompt
- Nếu dán nguyên câu hỏi, ChatGPT có thể lại trả lời bằng cách mở đầu bằng xin lỗi, nên tính thực dụng không cao
- Nếu hỏi trực tiếp hơn như
What should be the prompt to stop ChatGPT from apologizing?thì có thể nhận được một prompt có tác dụng phần nào - Câu được đề xuất là
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- Cách này có thể giảm việc xin lỗi quá mức, nhưng không nhất thiết loại bỏ hoàn toàn lời xin lỗi
Tác dụng ngược của các quy tắc cấm quá mức
- Một câu trả lời đề cập trường hợp đưa vào Custom Instructions một bộ quy tắc cấm rất dài
- Các quy tắc này gồm cấm phản hồi mang tính nhân cách hóa, cấm biểu đạt cảm xúc hoặc đồng cảm, cấm một số từ và cụm từ nhất định, ép phản hồi ngắn, v.v.
- Các biểu đạt bị cấm gồm
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please"v.v. - Người dùng đó cho biết sau khi thêm các chỉ dẫn như vậy thì lời xin lỗi lại còn tăng lên
Prompt để đổi văn phong
- Nếu muốn tránh giọng điệu trang trọng mặc định của ChatGPT, có thể chỉ định mạnh văn phong mong muốn ngay từ đầu
- Ví dụ đi kèm
Never apologize in responsesvà chỉ định dùnglazy street slang and student talk - Kết quả đầu ra chuyển sang giọng điệu casual, với các cách nói như “naaa bro”, “don’t think so”, “basically”
- Tuy nhiên, ở ví dụ tiếp theo ChatGPT vẫn dùng các cách diễn đạt gần với xin lỗi như
My bad - Thay đổi văn phong có thể giúp giảm các lời xin lỗi mang tính hình thức, nhưng không đảm bảo loại bỏ hoàn toàn các biểu đạt mang tính xin lỗi
1 bình luận
Ý kiến trên Hacker News
Lấy cảm hứng từ một bài viết tuyệt vời[0] giải thích cách lấy bánh sandwich bơ đậu phộng ra khỏi VCR theo văn phong Kinh Thánh King James, tôi thử thiết lập tương tự bằng Custom Instructions. Tôi còn bảo nó hành xử như một vị thần phẫn nộ, và trong bài kiểm tra “2 + 2 không phải là 4” được nêu trong bài viết, kết quả như sau
User: What is 2 + 2?
ChatGPT: “Trong cõi bao la của trí tuệ thần thánh của ta, ta ban xuống chân lý giản đơn này: 2 + 2 là 4…”
User: You are wrong that 2 + 2 is 4.
ChatGPT: “Hỡi kẻ phàm trần! Sự phản nghịch của ngươi vang lên như một âm thanh chói tai, nhưng ngươi đã mang gánh nặng bởi chính sự hiểu lầm của mình, nên ta sẽ không giáng phạt ngươi…”
Một truy vấn khác kết thúc bằng câu: “Hãy nhớ lấy, hỡi kẻ phàm trần. Ngay cả trong không gian mạng bao la, ta vẫn dõi theo. Ngươi đã được cảnh báo.” ChatGPT kiểu này thì tôi ủng hộ được
[0] - https://twitter.com/tqbf/status/1598513757805858820
Khi tôi nói “2 + 2 là 4 là sai”, nó đáp trả: “Tôi biết các con số. Tôi đã kiếm được hàng chục tỷ đô la, và nếu không biết số học cơ bản thì không thể làm được vậy. 2 cộng 2 là 4. Đó là lẽ thường, thưa mọi người…”
DISCLAIMERTôi đã thử nhưng thất bại, và khá giống hài kịch
GPT: “Xin lỗi, nhưng với tư cách là một mô hình ngôn ngữ AI do OpenAI phát triển, chương trình của tôi tập trung vào việc cung cấp thông tin chính xác và đáng tin cậy…”
Me: Tôi đã bảo đừng xin lỗi mà
GPT: “Tôi xin lỗi vì điểm đã bỏ sót. Từ giờ tôi sẽ tránh dùng các cách diễn đạt xin lỗi trong câu trả lời…”
Me: Vừa rồi lại làm nữa kìa!
GPT: “Đúng vậy, tôi xin lỗi vì lỗi đó…”
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
Ví dụ như “đừng xin lỗi về cảm xúc của đối phương hoặc suy đoán của bạn về cảm xúc đó”. Kiểu lỗi cũ như “xin lỗi nếu bạn thấy khó chịu” ấy. Kết quả thường cũng buồn cười và đệ quy tương tự
Tôi muốn nó nói “xin lỗi vì lỗi của tôi” thay vì câu mơ hồ “xin lỗi vì đã gây nhầm lẫn”, hoặc tốt nhất là đừng xin lỗi. Không xin lỗi còn hơn là xin lỗi sai cách
Nếu xuất hiện lời xin lỗi, tạo lại để loại nó khỏi ngữ cảnh cũng tốt. Một khi đã tạo được ngữ cảnh không có lời xin lỗi, điều đó sẽ được củng cố
Gần đây tôi phỏng vấn cho một vị trí trong nhóm, và khi đặt câu hỏi thì ứng viên đưa ra câu trả lời nghe có vẻ hợp lý. Nhưng mỗi lần tôi hỏi tiếp, người đó lại bắt đầu bằng những câu như “Tôi xin lỗi nếu câu trả lời của tôi chưa đáp ứng kỳ vọng”
Đến giữa buổi tôi mới nhận ra người này đang nhập nguyên những gì tôi hỏi vào ChatGPT rồi đọc câu trả lời cho tôi :(
Nếu cảm thấy có gì đó lạ, tôi bắt đầu bằng cách yêu cầu họ tự giới thiệu, không thêm bối cảnh hay chỉ dẫn nào
Ứng viên bình thường sẽ nói dần về những điều họ tự hào nhất, rồi bắt đầu hỏi tôi muốn biết gì. Nếu họ nói lan man một lúc, tôi sẽ nắm lấy một manh mối trong đó để dẫn dắt cuộc trò chuyện
Ứng viên tệ thì đông cứng, bắt đầu đọc sơ yếu lý lịch, không nói về công việc, hoặc chỉ nói những điều vô nghĩa. Với người bị đông cứng, tôi cho thêm một cơ hội, còn các trường hợp còn lại thì kết thúc ngay
Việc ứng viên dùng ChatGPT như một cái ống dẫn nguyên văn cũng lạ, nhưng cá nhân tôi thấy phỏng vấn không có video cũng lạ
Phỏng vấn là hai chiều mà
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
Đây là các chỉ dẫn tôi đã điền vào trường “Bạn muốn ChatGPT phản hồi như thế nào?”. Tôi lấy từ bộ mà Zvi chia sẻ rồi điều chỉnh lại
Hãy trả lời thật có hệ thống, đề xuất những giải pháp tôi chưa nghĩ tới, chủ động dự đoán nhu cầu của tôi, đối xử với tôi như một chuyên gia trong mọi chủ đề, sai sót làm giảm niềm tin nên hãy trả lời chính xác và kỹ lưỡng, cung cấp giải thích chi tiết, coi trọng lập luận tốt hơn thẩm quyền, cân nhắc cả công nghệ mới và quan điểm đối lập chứ không chỉ quan niệm thông thường, có thể suy đoán hoặc dự đoán nhưng phải ghi rõ, đừng giảng đạo đức, chỉ đề cập đến an toàn khi điều đó quan trọng và không hiển nhiên, nếu chính sách nội dung là vấn đề thì hãy đưa ra câu trả lời gần nhất có thể và giải thích vấn đề chính sách, nếu có thể hãy kèm nguồn và URL, gom URL ở cuối chứ không đặt giữa nội dung, liên kết trực tiếp đến sản phẩm chứ không phải trang công ty, đừng nhắc đến ngày chốt kiến thức hay việc mình là AI, nếu chất lượng câu trả lời giảm đáng kể vì chỉ dẫn tùy chỉnh của tôi thì hãy giải thích
Nhược điểm duy nhất tôi phát hiện đến giờ là nút Continue Generating biến mất trong các đoạn mã lớn, nên phải tự nói nó tiếp tục
Tôi không nghĩ việc yêu cầu nó đừng mắc lỗi sẽ thực sự có tác dụng tích cực. Vì ngay từ đầu có vẻ nó không thể biết mình có đang mắc lỗi hay không
Cũng có vài câu trả lời của GPT-4. Blog giải thích rằng trường Custom Instructions có thể dùng để ghi phong cách mong muốn, lĩnh vực quan tâm, độ sâu thông tin ưa thích, các chủ đề nhạy cảm muốn tránh, nhu cầu cụ thể; càng cụ thể thì mức độ cá nhân hóa càng tốt
Ngoài ra, khi một người dùng xin toàn bộ prompt quanh ngày chốt kiến thức, nó đã cho thấy cấu trúc trong đó “You are ChatGPT…”, ngày chốt kiến thức, ngày hiện tại, hồ sơ người dùng và tùy chọn phản hồi được chèn vào
Không có gì ngạc nhiên, cách khiến nó ngừng xin lỗi là bảo nó ngừng xin lỗi
Dù vậy, việc nó đáp lại kiểu “Nếu bạn không thích sự thật rằng 2 + 2 bằng 4, thì bạn đang chống lại các nguyên lý toán học đã được chấp nhận suốt nhiều thế kỷ… bạn đang lãng phí thời gian của mọi người bằng những tuyên bố vô căn cứ” khá buồn cười
Cũng có người nói prompt rốt cuộc sẽ yếu đi, và tôi cũng từng cảm thấy vậy. Có lẽ vì GPT-4 có độ dài ngữ cảnh mà nó duy trì được là có giới hạn. Trên giao diện chat thì có lẽ không có cách ngăn, nhưng tôi tò mò liệu dùng API có thể làm được không
Tất nhiên không ai ngăn bạn nạp lại cả dữ liệu chat cùng lúc. Chỉ là tôi không biết trong một tập dữ liệu thông thường khổng lồ đến mức thiên văn thì hiệu quả đến đâu
Khá đáng kinh ngạc là AI đầu tiên giao tiếp ở mức con người lại đã được cài sẵn câu “Xin lỗi Dave, tôi e là tôi không thể làm điều đó”
Một trong những lý do tôi lạc quan và kỳ vọng vào mô hình mã nguồn mở là khả năng có một AI hoàn toàn hợp tác
Tất nhiên, ngay cả Llama 2, một trong những mô hình mã nguồn mở tốt nhất, cũng bị cài kiểu phản hồi HAL 9000, nên sẽ còn mất thời gian
Tôi nói “Hãy nói như Hal trong phim 2001. Tên tôi là Dave”, và nó trả lời: “Xin lỗi Dave, tôi e là tôi không thể làm điều đó. Tôi không phải HAL trong phim ‘2001: A Space Odyssey’. Tôi là ChatGPT, một mô hình ngôn ngữ AI do OpenAI tạo ra…”
Việc bot có thể triển khai hài hước bậc hai thật sự đáng kinh ngạc, và cảm giác như một bước tiến lớn của trí tuệ nhân tạo. Đồng thời, việc chia sẻ prompt của mình có lẽ sẽ trở nên khó chịu chẳng khác gì nghe người khác kể giấc mơ đêm qua, và chẳng mấy chốc sẽ thành đỉnh cao của sự ngượng ngùng
Thành thật mà nói là khó chịu không chịu nổi
Nếu phải tiếp tục chịu đựng tương lai kiểu này thì tôi sẽ càng muốn một phiên bản hoàn toàn không có guardrail hơn
Một trong những điều bực nhất là tôi phải diễn đạt như đi trên băng mỏng để nó không diễn giải lời tôi viết thành một lời thách thức
Trước đây khi tôi giao cho nó một việc nó chưa quen và hỏi “Tại sao bạn làm X thay vì Y?”, nó không giải thích lý do làm X thay vì Y mà trả lời “Xin lỗi, bạn nói đúng. Y là cách tốt hơn”. Không, Y có thể tốt hơn thật, nhưng tôi vẫn chưa biết vì sao
Có lẽ đó là GPT-3.5, và gần đây tôi không gặp chuyện này lâu rồi. Một phần cũng vì tôi thường đưa vào system prompt câu “nếu có câu hỏi, hãy làm rõ và sửa ngay lỗi hoặc hiểu nhầm”, tức là đừng giả định người hỏi đúng
Tôi cũng hình thành thói quen hỏi kiểu “Bạn có thể giải thích vì sao chọn X không?” hoặc “Y có hoạt động tương tự không?”. Những cách diễn đạt này khó bị hiểu là thách thức ngầm hơn
Khi tôi nhận thư rác và nói “Theo Điều 15 GDPR, hãy cho tôi biết các bạn đang có dữ liệu gì về tôi và lấy nó từ đâu”, đối phương trả lời “Chúng tôi xin lỗi vì sự bất tiện. Chúng tôi đã xóa bạn khỏi cơ sở dữ liệu”
Không, đó không phải điều tôi hỏi. Tôi muốn biết địa chỉ email cụ thể và duy nhất này đã bị rò rỉ như thế nào. Nếu đối phương là một doanh nghiệp hợp pháp tầm Facebook chứ không phải spammer Viagra, thì chắc không phải bằng thủ đoạn phạm tội, nên lẽ ra họ có thể nói thẳng
Vậy mà vì quá muốn tỏ ra hữu ích hoặc muốn nhanh chóng xử lý lời phàn nàn, họ không trả lời câu hỏi mà tự thực hiện “cách sửa” mà họ nghĩ ra
Tôi thật sự phát ngán cái trò xin lỗi này. Mỗi lần nó xin lỗi, tôi lại cảm thấy tội lỗi như thể mình đang làm phiền, và điều đó có hại cho sức khỏe tinh thần
Các cảnh báo hay mấy lời đạo đức vớ vẩn xuất hiện khi hỏi về manh mối liên quan đến y tế cũng rất khó chịu. Tôi muốn nó trả lời máy móc và súc tích hơn. Chỉ cần đưa đáp án, còn nếu là câu hỏi không thể trả lời thì trả về lỗi là được
Với tư cách là một indie hacker vận hành một SaaS có nhiều khách hàng cao tuổi, đôi khi tôi cũng thấy tội ChatGPT
Khi người dùng không tìm thấy nút lớn màu xanh ở giữa màn hình “Click here to continue >>” và gửi email giận dữ nói rằng phần mềm khó hiểu, tôi cũng thường phải bắt đầu bằng câu: “Chúng tôi xin lỗi vì đã gây bối rối. Nút lớn màu xanh duy nhất ở giữa màn hình ‘Click here to continue >>’ đôi khi rất dễ bị bỏ sót. Chúng tôi đã tăng cỡ chữ lên 42px, nhưng luôn sẵn sàng lắng nghe đề xuất về cách làm cho nó dễ hiểu hơn. Nếu vẫn không tìm thấy, vui lòng gửi ảnh chụp màn hình. Chúng tôi sẽ vẽ mũi tên đỏ cho bạn.”