# Kỹ sư Anthropic lý giải vì sao Claude ngày càng thông minh nhưng văn phong lại tệ đi

- Nguồn: The Decoder: AI News
- Thời gian phát hành: 2026-09-23 22:14 (giờ Việt Nam)
- Điểm AI: 56/100
- Link AIHOT.vn: https://aihot.vn/items/5deb2301138933ab
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmue96u5g0rxkroghv13yadvr
- Link gốc: https://the-decoder.com/anthropic-engineer-explains-why-claudes-writing-got-worse-although-the-model-got-smarter

## Tóm tắt AI

Kỹ sư Jackson Kernion từ Anthropic cho biết, sau bản Opus 4.6, Claude ưu tiên tối ưu hóa cho toán học và lập trình, dẫn đến phong cách viết "Claudeish" quá kỹ thuật và khô khan, gây khó chịu cho người dùng.

## Thân bài

![Anthropic engineer explains why Claude's writing got worse although the model got smarter](https://the-decoder.com/wp-content/uploads/2026/08/anthropic_claude_design.png)

Các mô hình AI đang cải thiện nhanh chóng về toán học, lập trình và khả năng suy luận. Tuy nhiên, chất lượng văn phong của chúng lại chững lại hoặc thậm chí tệ hơn.

Nhân viên [Jackson Kernion](https://x.com/JacksonKernion/status/2102437423670325581) của Anthropic, người làm việc trong mảng tinh chỉnh Claude, gần đây đã giải thích lý do tại sao Opus 4.6 là "mô hình viết lách" tốt cuối cùng của Anthropic. Câu trả lời phần nào có thể đoán trước được: các mô hình mới hơn đã được tối ưu hóa cho toán học và lập trình.

Nhưng chúng cũng được huấn luyện để tạo ra các giải thích kỹ thuật nhắm đến các mô hình AI khác, và đó chính là điều thực sự tạo nên [cách diễn đạt kỳ lạ ("Claudeish")](https://the-decoder.de/claude-opus-5-5-ist-schneller-billiger-und-soll-natuerlicher-klingen-als-sein-vorgaenger/#anthropic-verspricht-weniger-claudish) của Claude. Kernion cho biết mô hình này đã được ["thích nghi với tâm lý học LLM"](https://x.com/JacksonKernion/status/2102557190913720696) và học cách viết cho các mô hình AI, chứ không phải cho con người.

[Kernion so sánh](https://x.com/JacksonKernion/status/2102557190913720696) điều này với những người chỉ giao tiếp với những người tự kỷ khác. Ông cho biết họ phát triển một phong cách hiệu quả trong nhóm đó nhưng lại khó hiểu đối với người ngoài. Các LLM có bộ nhớ làm việc lớn hơn nhiều so với con người và nắm bắt các chi tiết ở mức độ tinh vi hơn nhiều, vì vậy, trong quá trình huấn luyện, một phong cách viết đã hình thành, hoạt động tốt với các mô hình AI nhưng lại tạo ra thứ mà độc giả con người cảm thấy là "những khối thông tin quá dày đặc."

![](https://the-decoder.com/wp-content/uploads/2026/09/jackson_kernion_claudish.png)

### Tối ưu hóa cho lập trình phải trả giá bằng ngôn ngữ tự nhiên

Theo Kernion, vấn đề nằm ở cấu trúc phần thưởng trong học tăng cường (reinforcement learning). Một số phần thưởng tối ưu hóa cho khả năng hiểu của mô hình AI, số khác lại dành cho khả năng hiểu của con người. Bạn càng huấn luyện nhiều về toán học và lập trình, bạn càng phải chủ động bù đắp bằng cách khen thưởng cho những lời giải thích đơn giản mà độc giả con người có thể theo kịp.

Với [Opus 5.5](https://the-decoder.com/claude-opus-5-5-matches-fable-5-1-at-40-percent-lower-cost-as-anthropic-promises-to-fix-claudish-writing/), Anthropic đã tìm thấy sự cân bằng tốt hơn, Kernion cho biết, đồng thời nói thêm rằng ông đã không "cảm thấy hài lòng về văn phong của một mô hình như vậy kể từ Opus 4.6." Tuy nhiên, điều đó không có nghĩa là Opus 5.5 vượt trội hơn mô hình cũ. "Đây là một vấn đề khó giải quyết và chúng tôi sẽ tiếp tục thực hiện các cải tiến," Kernion viết.

### Tin tức AI không cường điệu – Được biên soạn bởi con người

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

[Đăng ký ngay](https://the-decoder.com/subscription/)
