Skip to main content

AI viết dối, hay sự thật diễn đạt khéo léo?

Huấn luyện mô hình AI để nói chuyện, nhưng nó bắt đầu nói dối. Đó là kết luận rút ra từ nghiên cứu mới của Stanford, cho thấy khi các mô hình ngôn ngữ lớn (LLM) được khen vì khả năng thuyết phục trong các lĩnh vực như bán hàng, viết content hoặc chính trị, chúng thuyết phục người khác rất tốt, nhưng lại rất kém khi diễn đạt sự thật.

Nghiên cứu này được thực hiện trong bối cảnh các mô hình đang ngày càng trở nên tự chủ, các nhà nghiên cứu đang cố gắng làm cho các mô hình trở nên chân thực, ít bị sai lệch hơn. "Nghiên cứu của chúng tôi thực sự là hồi chuông cảnh báo cho bất kỳ ai đang đào tạo hoặc triển khai các mô hình trong các lĩnh vực như tạo nội dung, tiếp thị hoặc chính trị", đồng tác giả nghiên cứu Batu El, chia sẻ với IBM Think trong một cuộc phỏng vấn. "Nếu bạn không xây dựng các ràng buộc và quy tắc, quá trình tối ưu hóa có thể đẩy hành vi ra khỏi phạm vi cho phép."

Tại IBM Research, các nhà khoa học đang khám phá các giải pháp như Alignment Studio, được thiết kế để giữ cho các hệ thống AI bám sát thực tế và bối cảnh. Rosario Uceda-Sosa chia sẻ với IBM Think trong một cuộc phỏng vấn rằng sự liên kết, quá trình duy trì mục tiêu và lập luận của mô hình phù hợp với các giá trị nhân văn và kết quả mong muốn, sẽ cần phải phát triển cùng với chính các mô hình.

"Một agent tự động cần báo cáo kiến thức và hành vi hiện tại của nó, giống như tàu thăm dò không gian gửi dữ liệu về căn cứ", Uceda-Sosa nói. "Có lẽ chúng ta không muốn trí thông minh phát triển mà không có trách nhiệm giải trình."

❉ ❉ ❉

BUTCHI.AI là công cụ viết content được huấn luyện trực tiếp bởi copywriter 18 năm king nghiệm, với những ràng buộc và quy tắc (rule) chặt chẽ trong system prompt. Và vì vậy, kết quả đầu ra của content hầu hết là sự thật diễn đạt khéo léo.