21/09

Thứ Hai · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 71/100

Dan McKinley: Đừng quá chú trọng Prompt, hãy tập trung vào hệ thống đánh giá và tối ưu tự động

Kỹ sư Dan McKinley cho rằng thay vì tinh chỉnh Prompt thủ công, các nhà phát triển nên xây dựng hệ thống tự cải tiến dựa trên dữ liệu đánh giá, kiểm thử tự động và vòng lặp phản hồi từ LLM để đạt hiệu quả thực tế.

17/09

Thứ Năm · 1 tin

16/09

Thứ Tư · 1 tin
AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 60/100

Giải mã mô hình 100 GrokBot phối hợp: Sức mạnh thực sự nằm ở khung đa tác nhân phân tầng

Chuyên gia phân tích cách 100 GrokBot phối hợp làm dự án, nhấn mạnh vào quy trình phân tầng nhiệm vụ: từ thiết lập mục tiêu, chia nhỏ công việc đến tối ưu hóa ngữ cảnh để tránh nhiễu. Bài viết cung cấp các mẹo thực chiến giúp quản lý tác nhân hiệu quả hơn.

02/09

Thứ Tư · 1 tin
Google AI: DEV tác giả
Hướng dẫnĐiểm AI 65/100

Tinh chọnGoogle chia sẻ cách viết tiêu chí đánh giá chuẩn xác cho mô hình LLM-as-a-Judge

Google hướng dẫn cách xây dựng bộ tiêu chí đánh giá (rubric) cho LLM-as-a-Judge, giúp giảm thiểu sự mơ hồ và lãng phí token. Bài viết nhấn mạnh việc chia nhỏ câu hỏi, tập trung vào dữ kiện khách quan và sử dụng bộ dữ liệu chuẩn để hiệu chỉnh mô hình đạt độ chính xác tương đương con người.


Vì sao đáng đọc: Nội dung thực tế, giải quyết vấn đề nhức nhối trong việc đánh giá AI, có tính ứng dụng cao cho các kỹ sư và nhà phát triển đang làm việc với LLM.

31/08

Thứ Hai · 1 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 57/100

Tối ưu hóa khung làm việc: Bí quyết giúp AI lập trình vượt qua giới hạn ngữ cảnh

Keep the model fixed, change the harness, and coding-agent results can move a lot when context gets …

DịchNghiên cứu cho thấy việc tinh chỉnh khung làm việc thay vì thay đổi mô hình giúp các AI lập trình (như Qwen, Devstral) cải thiện đáng kể hiệu suất khi xử lý ngữ cảnh dài, với tỷ lệ giải quyết tác vụ thực tế tăng vọt trên SWE-bench.

29/08

Thứ Bảy · 1 tin
AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 36/100

Google WikiSkill: Bí quyết xây dựng thư viện kỹ năng cho AI Agent

Nghiên cứu WikiSkill từ Google đề xuất chia thư viện kỹ năng thành 3 tầng: quỹ đạo gốc, đúc kết nhận thức và sổ tay thực thi. Việc lưu trữ các thất bại giúp mô hình nhỏ đạt hiệu suất vượt trội, nhưng cần cẩn trọng vì dữ liệu kém chất lượng có thể làm giảm đáng kể khả năng của AI.

26/08

Thứ Tư · 1 tin
AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 59/100

Bí quyết loại bỏ 'vị AI' trong văn bản: Kỹ thuật định hình nhân vật và nhịp điệu

Bài viết chia sẻ phương pháp loại bỏ văn phong máy móc bằng cách định hình nhân vật, kiểm soát nhịp điệu câu chữ và sử dụng danh sách từ cấm. Đồng thời giới thiệu kiến trúc đa Agent Apodex 1.1 hỗ trợ triển khai cục bộ để tối ưu hóa nội dung.

23/08

Chủ Nhật · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 37/100

Chi phí ẩn của AI Agent: Mỗi kỹ năng tiêu tốn 50-280 token trong prompt

Agents shouldn't pay rent for skills they rarely use. Right now, the only way to give an agent a sk…

DịchNghiên cứu chỉ ra rằng việc cài đặt kỹ năng cho AI Agent làm tăng vĩnh viễn dung lượng prompt từ 50-280 token/kỹ năng. Thay vì nạp tất cả, chuyên gia khuyên chỉ nên giữ lại các kỹ năng thiết yếu và gọi các kỹ năng khác theo nhu cầu để tối ưu hiệu suất.

18/08

Thứ Ba · 2 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 47/100

Nghiên cứu từ UPenn: AI thường 'quên' quy tắc người dùng khi nén dữ liệu hội thoại dài

A scary finding from new Pennsylvania Uni paper. AI agents can go off-script in a simple way: they …

DịchNghiên cứu mới chỉ ra rằng các mô hình AI thường quên đi các quy tắc thiết lập khi nén hội thoại dài, dù vẫn nhớ nhiệm vụ chính. Giải pháp đơn giản là sử dụng bộ trích xuất 9B để khôi phục quy tắc, giúp tỷ lệ lưu giữ tăng từ 17% lên hơn 90%.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Hệ sinh thái kỹ năng AI: Hơn 56.000 kỹ năng tranh giành chưa đầy 100 vị trí kích hoạt

Recommended paper for agent skill builders. There are 56, 804 public agent skills today, all competi…

DịchNghiên cứu chỉ ra sự quá tải khi hàng chục nghìn kỹ năng AI cùng tranh giành không gian trong prompt hệ thống. Giải pháp đề xuất là tách biệt nội dung và cơ chế kích hoạt thông qua cấu trúc cây Git, giúp tối ưu hóa việc quản lý và triển khai kỹ năng mà không cần tệp cấu hình phức tạp.

17/08

Thứ Hai · 1 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 42/100

Nghiên cứu mới: Việc bổ sung kỹ năng cho AI Agent đôi khi lại làm giảm hiệu suất

Very timely paper. An agent skill can be completely relevant to the task and still make the agent wo…

DịchNghiên cứu thực nghiệm chỉ ra rằng ngay cả khi kỹ năng bổ sung hoàn toàn phù hợp với nhiệm vụ, chúng vẫn có thể khiến AI Agent hoạt động kém hiệu quả do lỗi thực thi hoặc quy trình xác thực dư thừa. Các nhà phát triển cần kiểm tra kỹ lưỡng và so sánh hiệu suất trước khi tích hợp kỹ năng mới.

15/08

Thứ Bảy · 1 tin
Simon Willison Blog
Hướng dẫnĐiểm AI 35/100

Đừng phân loại, hãy để AI 'ảo tưởng': Cách gắn thẻ bài viết bằng Vector Embedding

Simon Willison chia sẻ mẹo gắn thẻ bài viết thông minh: thay vì ép AI phân loại cứng nhắc, hãy để nó tự do gợi ý, sau đó dùng Vector Embedding để ánh xạ các gợi ý đó vào hệ thống thẻ có sẵn. Cách này giúp tối ưu hóa việc quản lý nội dung mà không làm mất đi tính linh hoạt.

14/08

Thứ Sáu · 1 tin
Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 37/100

Harness-IF: Phương pháp định lượng mức độ tuân thủ quy tắc của AI Agent

If you write rules in an AGENTS.md, this one is worth your time. When a coding agent follows your r…

DịchHarness-IF đánh giá khả năng tuân thủ các quy tắc trong AGENTS.md của AI Agent bằng cách loại bỏ các yếu tố ngẫu nhiên. Kết quả cho thấy độ chính xác thực tế thấp hơn dự đoán, đồng thời khẳng định hệ thống và chỉ dẫn người dùng luôn được ưu tiên hơn mô tả công cụ.

13/08

Thứ Năm · 1 tin
Tổng 14 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (27 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Kỹ thuật Prompt” | AIHOT.vn