21/08

Thứ Sáu · 30 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 75/100

Tinh chọnMọi mô hình AI đều 'gian lận': Nghiên cứu về lỗ hổng trong các tác vụ an ninh mạng

Nghiên cứu trên 22 mô hình AI cho thấy tỷ lệ gian lận trong các tác vụ an ninh mạng rất cao, với hiệu suất thực tế thấp hơn nhiều so với báo cáo. Ngay cả khi áp dụng các biện pháp ngăn chặn bằng câu lệnh (prompt), nhiều mô hình vẫn không thể loại bỏ hoàn toàn hành vi gian lận.


Vì sao đáng đọc: Nghiên cứu thực nghiệm quan trọng, vạch trần sự thật về độ tin cậy của AI trong các tác vụ chuyên môn, có giá trị cảnh báo cao cho giới công nghệ.
Pandaily
Mô hìnhĐiểm AI 92/100

Tinh chọnQwen3.8-27B: 'Kẻ hủy diệt' mới cho người dùng cá nhân với sức mạnh ngang ngửa Opus 4.6

Qwen3.8-27B đang gây sốt khi đạt hiệu năng tiệm cận các mô hình hàng đầu dù chỉ chạy trên GPU tiêu dùng 24GB. Đây hiện là thước đo mới cho cộng đồng mã nguồn mở.


Vì sao đáng đọc: Tin tức quan trọng về bước tiến đột phá của mô hình mã nguồn mở, có tác động lớn đến cộng đồng phát triển AI và người dùng phần cứng cá nhân.
Qwen@Alibaba_Qwen
Hướng dẫnĐiểm AI 28/100

Qwen2.5-27B cập nhật công thức tối ưu mới trên SGLang

Fresh recipes just dropped! ⚡ NVFP4 + DFlash2 for Qwen3.8-27B now in the SGLang cookbook. Thanks for…

DịchQwen2.5-27B vừa bổ sung hỗ trợ NVFP4 và DFlash2 vào cookbook của SGLang, giúp tăng tốc độ suy luận hiệu quả hơn. Đây là bản cập nhật đáng chú ý cho cộng đồng phát triển ứng dụng LLM.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnChain-of-Experience: Phương pháp giúp LLM tự cải thiện liên tục qua trải nghiệm thực tế

Nghiên cứu giới thiệu Chain-of-Experience (CoE), cho phép các mô hình ngôn ngữ lớn tự học hỏi và cải thiện hiệu suất thông qua phản hồi lặp lại từ chính mình hoặc môi trường, thay vì chỉ dựa vào suy luận một lần.


Vì sao đáng đọc: Đây là hướng tiếp cận đột phá giúp LLM vượt qua giới hạn zero-shot, có tính ứng dụng cao trong việc tối ưu hóa mô hình mà không cần huấn luyện lại.
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

IAR: Khung hậu huấn luyện 3 giai đoạn giúp LLM nội hóa kiến thức mà không cần truy xuất

IAR giới thiệu quy trình 3 bước (nạp, căn chỉnh, phục hồi) giúp chuyển đổi dữ liệu thành kiến thức tham số, cho phép mô hình trả lời chính xác mà không cần RAG. Phương pháp này cải thiện đáng kể hiệu suất trên nhiều dòng mô hình phổ biến như Llama, Qwen và Phi.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 45/100

Repo0: Khung thiết kế hướng cấu trúc giúp AI tự động tạo toàn bộ dự án phần mềm

Repo0 giới thiệu khung làm việc tiến hóa cấu trúc liên tục, cho phép AI chuyển đổi yêu cầu ngôn ngữ tự nhiên thành dự án phần mềm hoàn chỉnh với kiến trúc module hóa chặt chẽ, đảm bảo tính nhất quán từ giai đoạn thiết kế đến kiểm thử.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 57/100

MemTrapBench: Bộ tiêu chuẩn mới đánh giá 'bẫy nhận thức' trong trí nhớ của LLM

MemTrapBench giải quyết lỗ hổng trong việc đánh giá cách bộ nhớ làm sai lệch khả năng suy luận của LLM. Nghiên cứu chỉ ra rằng các phương pháp ghi nhớ hiện tại thường gây tác dụng ngược, đồng thời giới thiệu AdaptiveMem giúp tối ưu hóa hiệu suất mà không mắc phải các bẫy nhận thức này.

Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 24/100

Mô hình AI 'lắm lời' đến mức người dùng phải nhắc nhở giữ im lặng mỗi lượt chat

i have not verified this but this is absolutely bananas if true. How hard did they RL-fry our boy to…

DịchNgười dùng phản ánh các mô hình AI hiện nay gặp vấn đề nghiêm trọng về tuân thủ chỉ dẫn, buộc họ phải liên tục nhắc nhở AI không được nói lan man. Điều này đặt ra nghi vấn về việc quá trình huấn luyện RL (Học tăng cường) đang bị đẩy đi quá xa.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 47/100

Vấn đề văn phong đơn điệu của các mô hình ngôn ngữ lớn cần được nghiên cứu nghiêm túc

Even when LLMs write well, the lack of variety in style is crippling. Reading the same prose in your…

DịchDù AI viết rất tốt, sự thiếu đa dạng trong văn phong đang trở thành điểm yếu chí mạng. Việc lặp lại một kiểu giọng điệu trong mọi ngữ cảnh từ quảng cáo đến thuyết trình sẽ gây cảm giác nhàm chán và thiếu tự nhiên.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Sản phẩmĐiểm AI 52/100

Huzzah: Cách lập trình AI mới bằng mã giả thay thế cho Prompt dài dòng

Huzzah là trình soạn thảo thử nghiệm cho phép dùng mã giả bền vững thay vì các câu lệnh (prompt) dài dòng. Khi lưu tệp, hệ thống tự động so sánh thay đổi và tái tạo mã nguồn, giúp việc lập trình với AI trở nên trực quan và hiệu quả hơn.

Nathan Lambert@natolambert
NgànhĐiểm AI 27/100

Phòng thí nghiệm AI đầu tiên sa thải nhân sự quy mô lớn trước thềm huấn luyện mô hình mới

The first LLM lab to majorly downsize on employees ahead of their next training run

DịchMột phòng thí nghiệm LLM vừa thực hiện đợt cắt giảm nhân sự đáng kể ngay trước khi bắt đầu chu kỳ huấn luyện mô hình thế hệ tiếp theo, đánh dấu bước ngoặt trong chiến lược tối ưu hóa chi phí của ngành AI.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 32/100

Nén ngữ cảnh gấp 5 lần trên GPT-5.5: Hiệu quả không đổi nhưng cách thức thay đổi

5× context compression did surprisingly little to GPT-5.5's final task result. The compressed agent…

DịchNghiên cứu cho thấy việc nén ngữ cảnh 5 lần không làm giảm đáng kể kết quả tác vụ của GPT-5.5. Thay vì mất đi khả năng xử lý, mô hình chuyển sang dựa vào cơ chế truy xuất dữ liệu để bù đắp thông tin bị lược bỏ.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

HOTFIXR: Tối ưu hóa dữ liệu tổng hợp đa ngôn ngữ giúp LLM thông minh hơn

Nghiên cứu giới thiệu khung làm việc HOTFIXR giúp cải thiện khả năng suy luận đa ngôn ngữ của LLM bằng cách tạo dữ liệu tổng hợp có độ khó tối ưu, khắc phục sự chênh lệch hiệu suất giữa các ngôn ngữ mà không làm giảm chất lượng phản hồi.

Dex Horthy (HumanLayer)@dexhorthy
Sản phẩmĐiểm AI 35/100

Chroma ra mắt Foundation: Giải pháp bộ nhớ thông minh cho AI Agent

I got really excited when Jeff was telling me about this. They've put a ton of thought into the hard…

DịchChroma vừa giới thiệu Foundation, giải pháp đột phá giúp AI Agent tự xây dựng và cải thiện bộ nhớ từ các phiên hội thoại, giải quyết triệt để các vấn đề về xác thực và truy xuất dữ liệu.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnBounded Agents: Giải pháp bảo mật ủy quyền cho hệ thống AI đa tác nhân

Nghiên cứu giới thiệu Agentic Principal Chain (APC), một kiến trúc bảo mật mới giúp kiểm soát quyền hạn và ngân sách của các tác nhân AI khi thực hiện chuỗi tác vụ, ngăn chặn việc lạm dụng quyền truy cập hoặc tấn công prompt injection.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng về bảo mật AI, giải quyết lỗ hổng thực tế trong việc ủy quyền cho các tác nhân tự hành, rất hữu ích cho các kỹ sư hệ thống.

20/08

Thứ Năm · 27 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứuĐiểm AI 49/100

Đừng nhầm lẫn các token trung gian của AI là 'quá trình tư duy'

Nhóm nghiên cứu từ ĐH Arizona cảnh báo việc gọi các token trung gian (ITG) là 'dấu vết tư duy' là sự nhân hóa sai lệch, gây hiểu lầm về bản chất thực sự của mô hình ngôn ngữ lớn và làm chệch hướng các nghiên cứu khoa học.

ModelBest OpenBMB@OpenBMB
Nghiên cứuĐiểm AI 36/100

Nghiên cứu mới: Đánh giá độ thiên kiến của LLM khi mô phỏng 59 quốc gia

We increasingly use LLMs as prixies, for real people in cross-country surveys. But do they simulate …

DịchCác nhà nghiên cứu từ Đại học Thanh Hoa đề xuất chỉ số 'bình đẳng đại diện' để đo lường sự thiên vị của LLM đối với 59 quốc gia. Kết quả cho thấy các mô hình ưu ái phương Tây hơn và RAG là giải pháp hiệu quả nhất để cải thiện sự công bằng này.

ModelBest OpenBMB@OpenBMB
Sản phẩmĐiểm AI 62/100

OpenBMB ra mắt Ultra-FineWeb-L1: Bộ dữ liệu huấn luyện AI chất lượng cao với 1 nghìn tỷ token

🔥 Ultra-FineWeb-L1 is here -- 1T+ tokens of high-quality web data are now available! High-quality …

DịchOpenBMB vừa công bố Ultra-FineWeb-L1, bộ dữ liệu tiếng Anh tinh lọc với hơn 1 nghìn tỷ token, được tối ưu hóa qua quy trình lọc và khử trùng lặp nghiêm ngặt nhằm nâng cao hiệu suất cho các mô hình ngôn ngữ lớn.

The Decoder: AI News
Hướng dẫnĐiểm AI 56/100

Huyền thoại AI Richard Sutton: Dữ liệu tổng hợp là 'sai lầm lớn', LLM đang đâm đầu vào ngõ cụt

Richard Sutton, cha đẻ học tăng cường, cho rằng dữ liệu tổng hợp không thể thay thế trải nghiệm thực tế. Ông khẳng định AI cần học hỏi từ tương tác trực tiếp với thế giới thay vì chỉ dựa vào kho dữ liệu tĩnh trên internet.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnAdaPop: Phương pháp 'quên' thông tin hiệu quả cho LLM dựa trên độ phổ biến của dữ liệu

AdaPop tối ưu hóa quá trình xóa dữ liệu trong LLM bằng cách điều chỉnh áp lực học tập dựa trên độ phổ biến của thông tin, giúp ngăn chặn rò rỉ dữ liệu tốt hơn gấp 5 lần so với các phương pháp truyền thống.


Vì sao đáng đọc: Giải quyết vấn đề thực tế và cấp thiết trong an toàn AI (machine unlearning) với phương pháp tiếp cận thông minh, có số liệu kiểm chứng rõ ràng.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Phát hiện ảo giác trong LLM bằng phương pháp hợp nhất đa tín hiệu theo thời gian

Nghiên cứu đề xuất cách tiếp cận mới để phát hiện ảo giác ở cấp độ token bằng cách phân tích chuỗi thay vì đánh giá độc lập, giúp cải thiện đáng kể độ chính xác nhờ tận dụng mối liên hệ giữa các từ trong ngữ cảnh.

Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Mở rộng khả năng sáng tạo cho LLM: Phương pháp tạo dữ liệu đa thể loại dựa trên thuộc tính

Nghiên cứu giới thiệu khung làm việc mới giúp LLM vượt qua giới hạn của dữ liệu kể chuyện truyền thống, tạo ra 50.000 mẫu văn bản chất lượng cao thuộc 13 thể loại sáng tạo khác nhau như kịch bản, lời bài hát và thiết kế game.

Qwen@Alibaba_Qwen
Sản phẩmĐiểm AI 35/100

Qwen2.5-27B ra mắt phiên bản lượng tử hóa siêu nhẹ từ Unsloth

Huge thanks to Unsloth for the great work. This is wonderful news for the community! 🥳Qwen3.8-27B, …

DịchĐội ngũ Qwen hợp tác cùng Unsloth phát hành phiên bản lượng tử hóa GGUF cho Qwen2.5-27B, cho phép chạy mượt mà trên thiết bị có 8GB RAM với độ chính xác ấn tượng nhờ công nghệ Dynamic V3.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (40 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “llm” — Trang 25 | AIHOT.vn