Quan điểm
Kỹ sư Anthropic lý giải vì sao văn phong Claude ngày càng 'máy móc': Do được huấn luyện để giao tiếp với AI
(giờ Việt Nam)
Tóm tắt AI
Kỹ sư Jackson Kernion từ Anthropic cho biết việc tối ưu hóa Claude cho toán học và code, cùng lượng lớn dữ liệu huấn luyện dành cho AI, đã tạo ra 'giọng văn Claude' xa rời ngôn ngữ tự nhiên của con người.
Chính văn · Bản dịch AI
IT ngày 23 tháng 9 đưa tin, các mô hình AI đang tiến bộ nhanh chóng về khả năng toán học, lập trình và suy luận, nhưng trình độ viết lách lại dậm chân tại chỗ, thậm chí còn thụt lùi; Claude của Anthropic cũng gặp phải vấn đề tương tự.
Tại sao Opus 4.6 lại trở thành mô hình cuối cùng của Anthropic có khả năng viết lách xuất sắc? Jackson Kernion, kỹ sư Anthropic phụ trách tinh chỉnh Claude, hôm nay (23/9) đã đưa ra lời giải thích: Trọng tâm tối ưu hóa của các mô hình sau này được đặt nhiều hơn vào khả năng toán học và viết mã.
Những mô hình này còn được huấn luyện với lượng lớn dữ liệu giải thích kỹ thuật dành cho các mô hình AI khác, và đây chính là nguyên nhân chính khiến Claude dần hình thành lối diễn đạt kỳ lạ, hay còn gọi là "Claude-ish" (giọng điệu Claude). Kernion cho biết, mô hình đã được "điều chỉnh để thích nghi với tâm lý LLM", cuối cùng học cách viết cho mô hình AI đọc thay vì viết cho con người.
Kernion ví hiện tượng này giống như những người chỉ giao tiếp với những người tự kỷ khác. Nhóm này sẽ dần hình thành một cách diễn đạt trôi chảy trong nội bộ nhưng người ngoài lại khó hiểu. LLM sở hữu bộ nhớ làm việc vượt xa con người và có thể nắm bắt những thông tin tinh vi hơn, do đó trong quá trình huấn luyện, chúng dần hình thành lối viết rất phù hợp để các mô hình AI thấu hiểu, nhưng trong mắt độc giả là con người, cách diễn đạt này lại trở thành sự chồng chất thông tin quá dày đặc.

[IT](#L1) được biết, Kernion cho rằng gốc rễ của vấn đề nằm ở cơ chế phần thưởng của học tăng cường (reinforcement learning). Một số cơ chế phần thưởng tập trung vào việc nâng cao hiệu quả thấu hiểu của mô hình AI, trong khi một số khác lại tập trung vào việc giúp con người dễ hiểu hơn. Càng huấn luyện nhiều về toán học và lập trình thì càng cần chủ động triệt tiêu xu hướng này, đồng thời dành nhiều phần thưởng hơn cho những lời giải thích ngắn gọn, dễ đọc.
Kernion cho biết, Anthropic đã tìm thấy sự cân bằng tốt hơn trên Opus 5.5: "Kể từ Opus 4.6 đến nay, tôi chưa từng hài lòng với khả năng viết lách của một mô hình nào như vậy."
Tất nhiên, điều này không có nghĩa là Opus 5.5 đã vượt qua Opus 4.6. "Đây là một vấn đề khó giải quyết, chúng tôi sẽ tiếp tục cải thiện."

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.