Quay lại blog

Ba nguyên nhân khiến chất lượng trả lời của ChatGPT giảm và cách kiểm tra

Nếu cùng một prompt bỗng cho câu trả lời ngắn và nông hơn, chưa chắc bản thân mô hình đã yếu đi. Bài viết phân tích ba hướng gồm đường ra mạng, trạng thái tài khoản và môi trường trình duyệt, đồng thời đưa ra thứ tự kiểm tra hợp lý.

Với cùng một bộ prompt, trước đây câu trả lời có thể khá chi tiết nhưng gần đây lại ngắn và nông hơn rõ rệt, thậm chí tính năng tạo mã hoặc phân tích hình ảnh cũng không dùng được. Tình trạng này thường được gọi là “degradation”. Trong đa số trường hợp, không phải bản thân mô hình yếu đi mà tài khoản có thể đang bị hạn chế hơn trong môi trường mạng và trình duyệt hiện tại.

ChatGPT 回答质量下降的三类原因与排查的关键步骤与判断维度示意图

Yếu tố mạng và đường ra

Điều đầu tiên nên kiểm tra là đường ra mạng. Các node thường được nhiều người dùng chung, nên một IP có thể tích lũy tín hiệu hành vi từ nhiều tài khoản và dễ bị đánh giá là lưu lượng bất thường hơn. Một khả năng khác là IP đó có lịch sử xấu hoặc từng nằm trong blacklist; người dùng về sau vẫn có thể bị hạn chế dù sử dụng bình thường. Một yếu tố dễ bị bỏ qua khác là lệch khu vực: tài khoản thường được dùng ở một quốc gia nhưng đường ra lại ở quốc gia khác, hoặc đường ra chuyển qua lại giữa nhiều quốc gia trong thời gian ngắn. Cả hai trường hợp đều có thể kích hoạt kiểm tra bảo mật.

Loại vấn đề này tương đối dễ nhận biết. Nếu chuyển sang một đường ra được đánh giá là sạch và chất lượng trả lời của cùng tài khoản trở lại bình thường, hoặc nếu chỉ đổi node mà không đổi tài khoản nhưng hiệu năng thay đổi rõ rệt, thì phía mạng là một yếu tố có khả năng liên quan.

Yếu tố tài khoản

Một hướng khác là giới hạn của chính tài khoản. Các quota như số lần gọi mỗi ngày hay số yêu cầu đồng thời đều có giới hạn. Hỏi dồn dập trong thời gian ngắn có thể chạm rate limit, khiến câu trả lời trở nên qua loa hoặc kết thúc sớm. Ngoài ra còn có model routing: nền tảng có thể chuyển yêu cầu tới các model tier khác nhau dựa trên trạng thái tài khoản, tải hiện tại hoặc khu vực, và mỗi tier vốn có thể khác nhau về mức độ chi tiết. Nếu tài khoản từng có đăng nhập bất thường, xác minh hoặc bị hạn chế, nó cũng có thể vẫn đang ở trạng thái giới hạn.

Để kiểm tra, hãy giảm tần suất đặt câu hỏi rồi sau một thời gian hỏi lại cùng một câu. Tiếp theo, chạy cùng prompt trên một tài khoản khác để so sánh. Nếu tài khoản đối chứng luôn hoạt động bình thường, vấn đề có khả năng nằm ở phía tài khoản hơn là ở prompt.

Yếu tố môi trường

Sự cố cũng thường xuất hiện ở cấp độ cuộc trò chuyện. Các cuộc hội thoại dài tiêu tốn context, và khi có quá nhiều lượt trao đổi, nội dung phía trước có thể bị cắt. Mô hình không còn thấy đầy đủ thông tin nên có thể bắt đầu trả lời lệch hướng, lặp lại hoặc chỉ nêu kết luận. Ở phía trình duyệt, cache và cookie lâu không được dọn, extension gây can thiệp, cùng việc thường xuyên chuyển cùng một tài khoản giữa nhiều thiết bị đều có thể khiến môi trường trông thiếu ổn định.

Có thể phân biệt qua biểu hiện. Nếu mở một cuộc trò chuyện mới và bỏ lịch sử dài mà chất lượng trả lời tăng lên, vấn đề nhiều khả năng nằm ở cấp độ session. Nếu cùng một thiết bị trở lại bình thường khi đổi trình duyệt, nguyên nhân có khả năng nằm ở môi trường cục bộ.

Nên bắt đầu kiểm tra từ đâu

Đừng thay đổi nhiều biến cùng lúc, vì sau đó bạn sẽ không biết bước nào thực sự có tác dụng. Hãy làm theo thứ tự này: trước tiên xác định egress IP và kiểm tra địa chỉ cùng vị trí có đúng như kỳ vọng không. Sau đó xem độ uy tín của IP và liệu nó có bị gắn nhãn là địa chỉ data center hoặc high-risk hay không. Tiếp theo kiểm tra tính nhất quán của môi trường đăng nhập: time zone, language và UA có thay đổi sau mỗi lần đăng nhập không? Chỉ cuối cùng mới cân nhắc đổi môi trường và đăng nhập lại.

Tính nhất quán quan trọng hơn việc thay đổi thường xuyên

Có một điểm khá ngược trực giác: thay fingerprint mỗi lần đăng nhập có thể trông bất thường hơn so với giữ một cấu hình cố định. Người dùng thật không đổi thiết bị mỗi ngày; hệ thống kiểm soát rủi ro xem tài khoản có liên tục đến từ cùng một môi trường hay không. Nếu cần dùng một dịch vụ AI ổn định lâu dài, giữ cố định các tham số như time zone, language và WebRTC có thể ổn định hơn việc liên tục đổi môi trường. Các công cụ như PurpleMark cung cấp chính khả năng gán cho tài khoản một môi trường độc lập và cố định.

Nguồn gốc của việc bị hạn chế thường liên quan đến mức độ đáng tin của môi trường. Thứ tự kiểm tra là egress IP, độ uy tín của IP, tính nhất quán của môi trường và cuối cùng mới xây dựng lại môi trường. Biến “mỗi lần một kiểu” thành “lần nào cũng giống nhau” thường hữu ích hơn việc đổi công cụ.