Anthropic Giải Thích Vì Sao Claude Viết Kém Hơn
1 phút đọc

Jackson Kernion nói các model mới của Anthropic đã được tối ưu nhiều hơn cho toán và code. Ông cho rằng điều đó góp phần làm chất lượng văn bản của chúng dừng lại, hoặc tệ hơn trước.
Theo Kernion, các model này còn được huấn luyện để tạo ra giải thích kỹ thuật hướng tới các model AI khác. Vì vậy, cách viết của Claude trở nên lạ và khó theo dõi hơn với người đọc.
Kernion nói các model được điều chỉnh theo tâm lý LLM và học cách viết cho AI, không phải cho người. Ông cho rằng cơ chế thưởng trong học tăng cường là phần quan trọng, vì có phần thưởng tối ưu cho mức hiểu của AI model, và có phần thưởng tối ưu cho mức hiểu của người.
Kernion nói càng huấn luyện nhiều với toán và code, càng phải chủ động thưởng cho những giải thích đơn giản mà người đọc theo được. Với Opus 5.5, ông nói Anthropic đã tìm được cân bằng tốt hơn, nhưng đây vẫn là bài toán khó và công ty sẽ tiếp tục cải thiện.
Nguồn
- Anthropic engineer explains why Claude's writing got worse although the model got smarter— The Decoder, 23 tháng 9, 2026