07/09

Thứ Hai · 4 tin
IT Home
Hướng dẫnĐiểm AI 69/100

Cùng sự kiệnOpenAI tiết lộ chi phí sử dụng AI lập trình: Nhóm người dùng hàng đầu tiêu tốn hơn 7.000 USD mỗi ngày

OpenAI công bố dữ liệu về mức độ sử dụng AI lập trình của các nhà nghiên cứu. Đến giữa tháng 8, chi phí ước tính trung bình đạt hơn 600 USD/ngày, trong khi nhóm 10% người dùng tích cực nhất tiêu tốn hơn 7.000 USD/ngày theo giá API.

Cùng sự kiện, bài đại diện «OpenAI công bố lộ trình AI tự nghiên cứu: Cảnh báo về rủi ro an toàn và chi phí vận hành khổng lồ»
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 40/100

Boris Cherny (Anthropic): Chiến lược tối ưu hóa chi phí token và hiệu suất sử dụng mô hình AI

Boris Cherny, lãnh đạo dự án Claude Code tại Anthropic, chia sẻ kinh nghiệm thực tế về việc tối ưu hóa chi phí token và cách lựa chọn mô hình hiệu quả trong quy trình phát triển phần mềm.

Thêm 2 nguồn khác đưa tinX: Claude Devs (@ClaudeDevs)Claude: Blog (Web)

06/09

Chủ Nhật · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 51/100

Harness-of-Harness: Khung làm việc giúp AI lập trình duy trì trạng thái dự án dài hạn

Harness-of-Harness beat repeated coding-agent runs by carrying code, QA evidence, and plans forward….

DịchShanghai AI Lab giới thiệu khung HoH, cho phép các tác nhân AI lưu giữ mã nguồn, kết quả kiểm thử và kế hoạch phát triển qua nhiều vòng lặp, giúp tối ưu hóa hiệu suất lập trình tự động.

05/09

Thứ Bảy · 1 tin
Yuchen Jin@Yuchenj_UW
Hướng dẫnĐiểm AI 43/100

Yuchen Jin: Thị trường lập trình AI sẽ sớm chuyển từ thế độc quyền sang thế chân vạc

The AI coding market is a duopoly today: Anthropic and OpenAI It'll soon become a triopoly: Open-so…

DịchYuchen Jin nhận định thị trường lập trình AI đang dần phá vỡ thế độc quyền của OpenAI và Anthropic để tiến tới thế chân vạc, khi các mô hình mã nguồn mở bắt đầu chiếm lĩnh thị phần tương tự như cách Android và Linux đã làm.

03/09

Thứ Năm · 2 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 61/100

Cùng sự kiệnMeta Muse Spark 1.3 lọt top bảng xếp hạng AI lập trình của Artificial Analysis

Meta's Muse Spark 1.3 (max), which is in limited preview for Meta's partners, scores 68 on the Artif…

DịchMeta Muse Spark 1.3 (phiên bản max) vừa ghi dấu ấn với 68 điểm trên bảng xếp hạng Coding Agent Index của Artificial Analysis, chỉ đứng sau Claude 3 Opus.

Cùng sự kiện, bài đại diện «Meta Muse Spark 1.3 bám đuổi sát nút Claude Code trong bảng xếp hạng AI lập trình»
AI at Meta@AIatMeta
Mô hìnhĐiểm AI 42/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Nâng cấp khả năng lập trình và tương tác thông minh

We're excited to release Muse Spark 1.3 with improved performance on agentic and coding tasks, and a…

DịchMeta vừa phát hành Muse Spark 1.3 với khả năng xử lý tác vụ phức tạp tốt hơn, giảm 20% số lần gọi công cụ và tiết kiệm 25% token. Phiên bản này tập trung vào tính thực dụng, giúp AI chủ động đặt câu hỏi và giảm thiểu tình trạng ảo giác khi thực hiện các dự án lập trình.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3, tích hợp vào Muse Code và Meta Model API»

02/09

Thứ Tư · 6 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 47/100

Cùng sự kiệnHarness-of-Harness: Khung phát triển phần mềm tự động đa ngày với hiệu suất tăng 52,25%

// Harness-of-Harness // Exciting new research on coding agents that keep building for days without…

DịchCác nhà nghiên cứu tại Shanghai AI Lab giới thiệu Harness-of-Harness (HoH), một khung làm việc giúp các tác nhân AI tự động hóa quy trình lập trình, kiểm thử và tối ưu hóa phần mềm liên tục mà không cần sự can thiệp của con người.

Cùng sự kiện, bài đại diện «Harness-of-Harness: Khung làm việc giúp AI tự phát triển phần mềm liên tục với hiệu suất tăng 52%»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 58/100

Harness-of-Harness: Khung làm việc giúp AI tự phát triển phần mềm liên tục với hiệu suất tăng 52%

Harness-of-Harness (HoH) là khung làm việc mới cho phép các AI lập trình tự động hóa quy trình phát triển phần mềm dài hạn mà không cần con người can thiệp, thông qua cơ chế lặp lại chu trình lập kế hoạch, viết mã và kiểm thử.

Thêm 2 nguồn khác đưa tinX: DAIR.AI (@dair_ai)X: Elvis Saravia (@omarsar0, DAIR.AI)
Xiaobei@frxiaobei
Mô hìnhĐiểm AI 55/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Bước tiến mới cho lập trình và tri thức

Anthropic vừa giới thiệu bộ đôi mô hình Claude Fable 5.1 và Mythos 5.1, được tối ưu hóa chuyên sâu cho lập trình và các tác vụ tri thức phức tạp. Giới chuyên gia nhận định đây là dấu hiệu cho thấy AI đang dần phân hóa theo phân khúc: mô hình phổ thông cho nhu cầu cơ bản và mô hình tinh hoa cho công việc giá trị cao.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 57/100

Huawei ra mắt openJiuwen: Công cụ đánh giá AI lập trình đạt kỷ lục 82.6% trên SWE-bench

Nice paper showing just how far you can push an agent harness. In most setups, the default coding a…

DịchHuawei giới thiệu openJiuwen, bộ công cụ đánh giá (harness) mã nguồn mở cho AI lập trình, đạt hiệu suất vượt trội với 82.6% trên SWE-bench Verified và 87.19% trên Terminal-Bench, thiết lập chuẩn mực mới cho khả năng giải quyết vấn đề thực tế của AI.

Thêm 1 nguồn khác đưa tinX: DAIR.AI (@dair_ai)
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 50/100

OpenJiuwen: AI lập trình đột phá với hiệu suất 82.6% trên SWE-bench Verified

How far can you push an agent harness? Great paper providing some insights.

DịchNhóm nghiên cứu từ Huawei giới thiệu openJiuwen, một framework AI lập trình đạt kết quả ấn tượng 82.6% trên SWE-bench Verified và 87.19% trên Terminal-Bench, thiết lập kỷ lục mới vượt xa các tiêu chuẩn hiện tại.

Claude Devs@ClaudeDevs
Mô hìnhĐiểm AI 55/100

Cùng sự kiệnAnthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Giảm 75% phí đọc cache, tối ưu lập trình

Fable 5.1 is now live in Claude Code and the Claude Platform. It's priced the same as Fable 5, with…

DịchAnthropic vừa phát hành bộ đôi Claude Fable 5.1 và Mythos 5.1 với khả năng xử lý tác vụ dài tốt hơn, văn phong tự nhiên và giảm 75% chi phí đọc cache API, hứa hẹn là bước tiến lớn cho lập trình và tri thức.

Cùng sự kiện, tinh chọn hiển thị «Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1»

01/09

Thứ Ba · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 43/100

Jordan Andersen: AI lập trình không phải là 'chìa khóa vạn năng' giúp tăng tốc phát triển phần mềm

Jordan Andersen hoài nghi về tuyên bố AI giúp tăng năng suất gấp 10 lần, lập luận rằng nếu điều đó đúng, chúng ta đã thấy sự bùng nổ của hàng loạt kỳ lân công nghệ mới từ bốn năm trước.

31/08

Thứ Hai · 2 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 26/100

So sánh Sol và Fable: Tại sao Sol trở thành trợ lý lập trình AI ưu tiên hàng đầu?

sol is very good at structural stuff. refactoring, or plumbing through a thick call stack without mi…

DịchDex Horthy đánh giá Sol vượt trội trong các tác vụ cấu trúc như tái cấu trúc mã nguồn, trong khi Fable mạnh về suy luận không gian và UI. Dù Sol là lựa chọn hàng đầu, một số người dùng vẫn cân nhắc Terra cho các công việc lập kế hoạch phức tạp.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 57/100

Tối ưu hóa khung làm việc: Bí quyết giúp AI lập trình vượt qua giới hạn ngữ cảnh

Keep the model fixed, change the harness, and coding-agent results can move a lot when context gets …

DịchNghiên cứu cho thấy việc tinh chỉnh khung làm việc thay vì thay đổi mô hình giúp các AI lập trình (như Qwen, Devstral) cải thiện đáng kể hiệu suất khi xử lý ngữ cảnh dài, với tỷ lệ giải quyết tác vụ thực tế tăng vọt trên SWE-bench.

30/08

Chủ Nhật · 4 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 60/100

Nghiên cứu: AI lập trình ưu tiên đọc file hướng dẫn hơn là tài liệu API

Coding agents mostly read the instruction files and notes they were given or wrote themselves, so yo…

DịchNghiên cứu trên 33.000 PR cho thấy AI lập trình chủ yếu dựa vào các file chỉ dẫn (như CLAUDE.md) và ghi chú kế hoạch, thay vì tra cứu tài liệu API. Các nhà phát triển nên tập trung tối ưu hóa file hướng dẫn để cải thiện hiệu suất của AI.

The Decoder: AI News
NgànhĐiểm AI 64/100

Anthropic điều chỉnh hạn mức Claude Code: Tăng trên danh nghĩa nhưng thực tế giảm 17%

Từ 14/9, Anthropic tăng 25% hạn mức cơ bản cho các gói trả phí, nhưng do kết thúc chương trình ưu đãi tạm thời 50%, tổng dung lượng thực tế của người dùng sẽ giảm 17%. Đồng thời, hãng cũng bổ sung công cụ tự động báo lỗi để tối ưu trải nghiệm lập trình.

IT Home
Sản phẩmĐiểm AI 52/100

Cùng sự kiệnAnthropic tăng vĩnh viễn 25% hạn mức sử dụng hàng tuần cho người dùng Claude Code từ 14/9

Từ ngày 14/9, Anthropic chính thức nâng hạn mức sử dụng hàng tuần cho các gói Pro, Max và Team thêm 25% so với mức cơ bản, thay thế cho chương trình tăng tạm thời 50% trước đó.

Cùng sự kiện, bài đại diện «Claude tăng 25% hạn mức sử dụng hàng tuần cho người dùng trả phí từ 14/9»
Kim@kimmonismus
Sản phẩmĐiểm AI 35/100

Cùng sự kiệnCộng đồng xôn xao khi Claude Code âm thầm cắt giảm 17% hạn mức sử dụng hàng tuần

They deleted their post about cutting weekly limits by 25%, only to reupload it after recalculating …

DịchAnthropic đã phải đính chính thông tin sau khi xóa bài đăng về việc giảm 25% hạn mức, xác nhận con số thực tế là 17%. Động thái này gây ra nhiều tranh cãi trong cộng đồng người dùng về tính minh bạch.

Cùng sự kiện, bài đại diện «Claude Code tăng vĩnh viễn 25% hạn mức sử dụng hàng tuần từ 14/9»

28/08

Thứ Sáu · 1 tin
Replit@Replit
Sản phẩmĐiểm AI 31/100

Replit ra mắt tính năng định tuyến thông minh: Tự động chọn mô hình AI tối ưu cho từng tác vụ

Intelligent Model Routing: Replit Picks the Best Model for the Job https://x.com/i/broadcasts/1nxeLM...

DịchReplit vừa giới thiệu hệ thống định tuyến mô hình thông minh, giúp tự động phân tích và lựa chọn mô hình AI phù hợp nhất cho từng yêu cầu lập trình cụ thể của người dùng.

27/08

Thứ Năm · 3 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

SWE Refactor Bench: Đánh giá khả năng tự động di chuyển mã nguồn toàn hệ thống của AI

Nghiên cứu giới thiệu bộ tiêu chuẩn SWE Refactor Bench nhằm kiểm tra khả năng thực hiện các đợt di chuyển mã nguồn phức tạp của AI, khắc phục tình trạng các mô hình chỉ 'gian lận' để vượt qua bài kiểm tra mà không thực sự thay đổi cấu trúc hệ thống.

cb_doge@cb_doge
Hướng dẫnĐiểm AI 25/100

Grok Build: Tự tay tạo game mô phỏng sao Hỏa chỉ với vài câu lệnh

Grok Build made this fun lil Mars simulator game for my nephew. I gave it simple prompts. It did th…

DịchNgười dùng đã sử dụng Grok Build để phát triển hoàn chỉnh một trò chơi mô phỏng sao Hỏa cho trẻ em, từ khâu lập trình, xây dựng hệ thống đến sửa lỗi, chứng minh khả năng thay thế cả một studio game của AI.

LangChain: Blog
Nghiên cứuĐiểm AI 43/100

Đánh giá OpenWiki với WikiBench: Liệu tài liệu Wiki có giúp AI lập trình thông minh hơn?

LangChain giới thiệu WikiBench để kiểm chứng hiệu quả của tài liệu Wiki đối với các tác nhân AI lập trình. Kết quả cho thấy việc kết hợp Wiki với mã nguồn giúp cải thiện hiệu suất đáng kể và tối ưu chi phí so với chỉ sử dụng mã nguồn đơn thuần.

26/08

Thứ Tư · 3 tin
MarkTechPost
Hướng dẫnĐiểm AI 57/100

Liệu AI Agent có thể thay thế lập trình viên cấp thấp? Đây là 4 điều kiện tiên quyết

Tác giả chỉ ra 4 điều kiện để AI thay thế lập trình viên sơ cấp, nhưng hiện tại chỉ có một điều kiện về tư duy quản trị doanh nghiệp được đáp ứng. Các dữ liệu thực tế từ METR và OpenAI cho thấy hiệu suất của AI vẫn còn nhiều hạn chế so với kỳ vọng.

Kim@kimmonismus
Nghiên cứuĐiểm AI 37/100

SWE Refactor Bench: Tỷ lệ thành công của AI khi tái cấu trúc toàn bộ mã nguồn chỉ đạt 5,4%

Coding agents can pass tests and still miss the task. In SWE Refactor Bench, 340 of 520 runs comple…

DịchEinsia ra mắt SWE Refactor Bench để kiểm tra khả năng chuyển đổi hệ thống (như C sang Rust) của AI. Kết quả cho thấy AI vẫn gặp khó khăn lớn với các tác vụ tái cấu trúc phức tạp, khi chỉ 5,4% thử nghiệm vượt qua được các tiêu chuẩn đánh giá khắt khe.

Lauren Tan@poteto
Sản phẩmĐiểm AI 27/100

Pstack: Công cụ miễn phí giúp tối ưu hóa chỉ số Core Web Vitals (CWV) lên mức xanh

try pstack! it's like hiring me but it's free:)

DịchLauren Tan chia sẻ trải nghiệm sử dụng tính năng /poteto-mode trên công cụ Pstack kết hợp với Cursor để tự động tối ưu hóa website, giúp các chỉ số Core Web Vitals đạt trạng thái hoàn hảo một cách dễ dàng.

25/08

Thứ Ba · 4 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 47/100

Cách dùng AI chia nhỏ các tính năng lớn thành những PR độc lập

Several recent large features I built for production involved - research and product outline doc - …

DịchDex Horthy chia sẻ quy trình dùng AI để chia nhỏ các dự án hàng chục nghìn dòng code thành các PR tinh gọn, giúp việc kiểm duyệt và triển khai tính năng lớn trở nên nhanh chóng và hiệu quả hơn.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

SWE-bench Science: Thách thức mới cho AI trong việc giải quyết các lỗi logic khoa học

Coding agents fix the symptom you show them far more often than the defect underneath. Agents are g…

DịchSWE-bench Science cho thấy các AI lập trình hiện nay dù giỏi sửa lỗi kỹ thuật nhưng vẫn yếu trong việc khôi phục logic khoa học cốt lõi. Điểm nghẽn nằm ở khả năng kiểm chứng thực tế thay vì chỉ dựa vào kiến thức lý thuyết.

Hongming@hongming731
Hướng dẫnĐiểm AI 39/100

Điểm tin sáng: Tái thiết quy trình kiểm chứng và quản trị sau khi ứng dụng AI lập trình

Bài viết phân tích nút thắt khi dùng AI lập trình: việc tạo mã chỉ chiếm 20-30% quy trình, cần xây dựng hệ thống Agent khép kín từ build đến kiểm thử. Các chuyên gia đề xuất mô hình quản trị bằng 'hàng rào' luật lệ và phát triển phần mềm dựa trên đánh giá dữ liệu thực tế.

24/08

Thứ Hai · 1 tin
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 36/100

Nghiên cứu: AI lập trình dành 60% thời gian đọc tài liệu hướng dẫn và ghi chú

If you maintain an AGENTS.md or a CLAUDE.md, this one is worth your time. (bookmark it) Researcher…

DịchNghiên cứu trên 557 phiên lập trình cho thấy AI ưu tiên đọc file hướng dẫn và ghi chú (60,5%) thay vì tài liệu kỹ thuật hay API. Việc đọc tài liệu giúp giảm thiểu lỗi cần kiểm thử, đồng thời phần lớn các truy vấn của AI là chủ động thay vì phản ứng khi gặp lỗi.

23/08

Chủ Nhật · 2 tin

22/08

Thứ Bảy · 1 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 37/100

Dự đoán: Đến cuối 2026, Bob sẽ từ bỏ quan điểm 'không cần đọc code'

I love uncle bob's work and I believe if anyone will figure out lights off (ie not reading code), he…

DịchDex Horthy cho rằng dù AI có năng suất cao, việc vận hành chúng vẫn đòi hỏi kỹ năng kỹ thuật chuyên sâu. Do đó, việc hoàn toàn không đọc code là bất khả thi, ngay cả với sự hỗ trợ của AI và các công cụ kiểm soát lỗi tự động.

21/08

Thứ Sáu · 7 tin
opencode@opencode
Sản phẩmĐiểm AI 48/100

OpenCode Go ra mắt Ox Alpha: Trải nghiệm miễn phí không giới hạn trong 6 ngày

Ox Alpha is now available on OpenCode Go too For the next 6 days, usage is near unlimited and compl…

DịchNền tảng OpenCode Go vừa tích hợp Ox Alpha, cho phép người dùng trải nghiệm miễn phí với dung lượng gần như không giới hạn trong 6 ngày tới mà không ảnh hưởng đến hạn mức Go hiện tại.

Artificial Intelligence News
Hướng dẫnĐiểm AI 61/100

Công cụ lập trình AI đang thúc đẩy sự thống trị của hệ sinh thái JavaScript như thế nào

Nhờ dữ liệu huấn luyện dồi dào, các mô hình AI tạo mã JavaScript/TypeScript với độ chính xác cao, khiến TypeScript trở thành lựa chọn ưu tiên của 78% lập trình viên chuyên nghiệp và làm thay đổi quy trình phát triển phần mềm.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 55/100

SWE-bench Science: Liệu AI lập trình có thể giải quyết các bài toán kỹ thuật trong khoa học?

Nhóm nghiên cứu ra mắt SWE-bench Science, bộ tiêu chuẩn đánh giá khả năng giải quyết 119 tác vụ phần mềm khoa học. Kết quả cho thấy ngay cả mô hình mạnh nhất cũng chưa đạt 50% độ chính xác, đồng thời chỉ ra rằng kiến thức khoa học không phải lúc nào cũng giúp AI tối ưu hóa hiệu suất.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 45/100

Repo0: Khung thiết kế hướng cấu trúc giúp AI tự động tạo toàn bộ dự án phần mềm

Repo0 giới thiệu khung làm việc tiến hóa cấu trúc liên tục, cho phép AI chuyển đổi yêu cầu ngôn ngữ tự nhiên thành dự án phần mềm hoàn chỉnh với kiến trúc module hóa chặt chẽ, đảm bảo tính nhất quán từ giai đoạn thiết kế đến kiểm thử.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 35/100

Meta Muse Spark 1.2 thống trị bảng xếp hạng chuyển đổi video sang website

Meta's Muse Spark 1.2 now leads Design Arena's Video-to-Website test while placing top-three across …

DịchMeta Muse Spark 1.2 vừa dẫn đầu bảng xếp hạng Design Arena với điểm Elo ấn tượng, đồng thời lọt top 3 trong các tác vụ chuyển đổi hình ảnh sang mã nguồn với mức giá cực kỳ cạnh tranh.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (53 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI lập trình” — Trang 2 | AIHOT.vn