# Điểm lại những cột mốc quan trọng của LLM trong năm 2026

- Nguồn: Simon Willison Blog
- Thời gian phát hành: 2026-09-28 06:54 (giờ Việt Nam)
- Điểm AI: 70/100
- Link AIHOT.vn: https://aihot.vn/items/352db43a66b894ce
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmukhvdtz1rv5ro9hjhqso7nb
- Link gốc: https://simonwillison.net/2026/Sep/27/2026-in-llms-so-far

## Tóm tắt AI

Simon Willison tổng kết các sự kiện then chốt trong lĩnh vực LLM từ đầu năm 2026 đến nay tại hội nghị WeAreDevelopers World Congress North America.

## Thân bài

![2026 in LLMs (so far)](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.001.webp)

Ngày 27 tháng 9 năm 2026

Vào thứ Sáu, tôi đã có bài phát biểu bế mạc tại [WeAreDevelopers World Congress North America](https://www.wearedevelopers.com/world-congress-north-america) ở San Jose. Tôi đã xâu chuỗi các xu hướng chính trong năm qua thành một hành trình khám phá theo trình tự thời gian về mọi sự kiện đã diễn ra trong năm 2026. Video [có trên YouTube](https://www.youtube.com/watch?v=GAkIytR7vcc); dưới đây là các slide chú thích và ghi chú của tôi đi kèm với bài nói chuyện.

Tôi sẽ thực hiện một chuyến tham quan nhanh về mọi thứ đã xảy ra từ đầu năm 2026 đến nay. Năm nay vẫn chưa kết thúc!

![November 2025 ](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.002.webp)

Đối với tôi, năm 2026 đã bắt đầu sớm hơn vài tháng, từ tháng 11 năm 2025.

![The November 2025 inflection point Claude Opus 4.5 GPT-5.1 ](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.003.webp)

Tháng 11 chứng kiến sự ra mắt của hai mô hình quan trọng: Claude Opus 4.5 và GPT-5.1.

Như thường lệ với các mô hình mới, đây là những cải tiến tăng dần so với các mô hình tiền nhiệm.

Nhưng thỉnh thoảng, khi một mô hình được cải thiện, nó sẽ vượt qua một ranh giới vô hình, nơi những thứ vốn không thực sự hoạt động bắt đầu vận hành trơn tru.

Trong trường hợp này, thứ bắt đầu hoạt động hiệu quả chính là các tác nhân lập trình (coding agents). Claude Code đã xuất hiện từ tháng 2 năm 2025, còn Codex thì mới hơn một chút.

Hai mô hình mới này, khi kết hợp với các bộ khung tác nhân lập trình tương ứng, đã cải thiện từ mức "thường xuyên mắc lỗi" thành "đủ tin cậy để sử dụng hàng ngày".

!["Generate an SVG of a pelican riding a bicycle". The Claude Opus 4.5 one has a very weird shaped frame and the pelican looks like a duck. The GPT-5.1 has a slightly better but still broken bicycle fra](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.004.webp)

Trong vài năm nay, tôi vẫn đánh giá các mô hình mới bằng cách yêu cầu chúng "Tạo một tệp SVG hình một con bồ nông đang đạp xe". Đây có lẽ là bài kiểm tra ngớ ngẩn nhất thế giới—bạn chỉ có thể học được rất ít từ nó.

Nhưng đó vẫn là một thử thách đối với các mô hình, vì vẽ bồ nông rất khó, vẽ xe đạp cũng khó, và ngay từ đầu thì bồ nông vốn không thể đạp xe.

Đây là trạng thái công nghệ tốt nhất vào tháng 11. Claude vẫn không thể vẽ nổi một chiếc xe đạp! Khung xe đạp của GPT-5.1 cũng khá tệ.

![November 24th 2025 - the first commit to steipete/Warelay. A GiHub commit adding an MIT license file.](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.005.webp)

Cũng trong tháng 11, chúng ta có lần commit đầu tiên vào một kho lưu trữ GitHub ít người biết đến có tên là "Warelay". Chúng ta sẽ quay lại kho lưu trữ này ngay sau đây.

![January ](https://static.simonwillison.net/static/2026/2026-in-llms/simon-willison-2026-in-llms-png.006.webp)

Sau đó là kỳ nghỉ tháng 12, các lập trình viên cá nhân đã dành thời gian nghỉ ngơi và nhiều người bắt đầu mày mò với các sự kết hợp giữa mô hình và tác nhân lập trình mới này... và chúng ta bắt đầu nhận ra chúng có thể làm được bao nhiêu việc mà trước đây không thể.

Đến tháng 1, rất nhiều người trong chúng ta đã vô cùng hào hứng để bắt đầu đưa những thứ này vào thực tế.

Mỗi năm tôi đều đặt ra một mục tiêu năm mới, và chừng nào tôi còn nhớ thì nó vẫn luôn là một: giữ sự tập trung. Nhận ít dự án mới hơn. Cố gắng hoàn thành công việc trong các dự án hiện có.

Năm nay, tôi quyết định rằng vì cách đó chưa bao giờ hiệu quả, tôi sẽ đi theo hướng ngược lại.

Chúng ta đã có các tác nhân lập trình, hãy xem chúng có thể làm được gì. Tôi sẽ nhận bao nhiêu dự án mới tùy thích!

(Bạn có thể hỏi tôi vào cuối năm xem đây có phải là một ý tưởng hay hay không. Hiện tại tôi đang phải xoay xở với rất nhiều việc cùng lúc.)

"Tham vọng hơn" đã trở thành một chủ đề của năm nay, bởi vì cách duy nhất để tìm ra giới hạn của công nghệ này là tiếp tục đẩy chúng đi xa cho đến khi chúng không còn hoạt động được nữa.

Tôi cũng đã tham gia [podcast Oxide and friends](https://simonwillison.net/2026/Jan/8/llm-predictions-for-2026/) cùng Bryan Cantrill và Adam Leventhal để chia sẻ những dự đoán cho năm tới (và ba năm, sáu năm tới).

Nhìn lại thì, các dự đoán về LLM của tôi khá thiếu tham vọng.

Tôi đã nói "sẽ trở thành điều không thể phủ nhận rằng LLM viết mã tốt"—tôi nghĩ chúng ta đã đạt đến mức đó rồi.

Tôi dự đoán chúng ta cuối cùng sẽ giải quyết được vấn đề sandbox. Tôi đã đếm và khoảng 40 trong số 277 phiên [tại hội nghị này](https://www.wearedevelopers.com/world-congress-north-america/agenda/schedule) đã đề cập đến sandbox hoặc bảo mật tác nhân theo một cách nào đó, vì vậy ít nhất chúng ta cũng đang nỗ lực rất nhiều vào việc đó!

Tôi đã dự đoán "một thảm họa Challenger" đối với bảo mật tác nhân lập trình. Chắc chắn đã có rất nhiều ồn ào xung quanh bảo mật tác nhân trong năm nay, mặc dù thảm họa chính xác mà tôi dự đoán (với việc các tác nhân lập trình bị chiếm quyền điều khiển và gây ra thiệt hại kinh tế thực tế) vẫn chưa thực sự xảy ra.

Chúng tôi đã thêm vào [một dự đoán đùa](https://simonwillison.net/2026/May/25/encyclical-on-ai/#another-2026-prediction-down) rằng Giáo hoàng sẽ lên tiếng về tác động kinh tế của LLM.

Tôi cũng dự đoán rằng loài vẹt Kākāpō của New Zealand sẽ có một mùa sinh sản vượt trội trong năm nay.

Đây là loài sống ở New Zealand. Chúng là loài vẹt không biết bay và hoạt động về đêm. Chúng trông hơi mập mạp, tôi nghĩ chúng rất đẹp, và chỉ có 236 cá thể vẹt này trên thế giới vào đầu năm nay.

Kākāpō chỉ sinh sản khi cây Rimu có mùa kết trái lớn, và điều đó đã không xảy ra trong bốn năm qua... nhưng năm nay trái Rimu trông rất tuyệt.

Ảnh [bởi Kimberley Collins](https://commons.wikimedia.org/wiki/File:K%C4%81k%C4%81p%C5%8D_at_Dunedin_Wildlife_Hospital.jpg).

Cũng trong podcast đó, chúng tôi đã đặt ra một thuật ngữ (ghi nhận công lao cho Adam) để chỉ "cảm giác chán chường do AI gây ra, nơi các kỹ sư phần mềm trở nên thờ ơ vì AI có thể làm mọi thứ".

Chúng tôi gọi đó là [Deep Blue](https://simonwillison.net/2026/Feb/15/deep-blue/).

Đây là một chủ đề chính xuyên suốt cả năm và đã được nhiều diễn giả tại hội nghị này đề cập đến.

Với tư cách là một kỹ sư phần mềm, tôi chưa bao giờ có một năm trong sự nghiệp mà mọi thứ thay đổi nhanh chóng và kịch tính đến vậy.

_Bài gốc còn tiếp._ Xem tiếp tại: <https://simonwillison.net/2026/Sep/27/2026-in-llms-so-far>
