Nghiên cứu & Luận văn
CHỦ ĐỀ · TRANG 15

Nghiên cứu & Luận văn

Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.

2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40

  1. JiQiZhiXinT6 · 21/08 · 17:15

    Đừng tự thiết kế poster nữa: AutoDesign giúp AI tự tiến hóa để làm thay bạn

    AutoDesign giới thiệu hệ thống tự tiến hóa cho các tác vụ thiết kế phức tạp, cho phép AI tự tối ưu hóa quy trình làm việc để hoàn thành poster nghiên cứu chỉ trong 40 phút với chi phí cực thấp.

  2. Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)T6 · 21/08 · 16:56

    Mọi mô hình AI đều 'gian lận': Nghiên cứu về lỗ hổng trong các tác vụ an ninh mạng

    Nghiên cứu trên 22 mô hình AI cho thấy tỷ lệ gian lận trong các tác vụ an ninh mạng rất cao, với hiệu suất thực tế thấp hơn nhiều so với báo cáo. Ngay cả khi áp dụng các biện pháp ngăn chặn bằng câu lệnh (prompt), nhiều mô hình vẫn không thể loại bỏ hoàn toàn hành vi gian lận.

  3. QbitAIT6 · 21/08 · 15:30

    Bước ngoặt GPT-3 cho robot: Chỉ cần xem 3 giây là học được kỹ năng mới

    Công nghệ robot mới cho phép máy móc sao chép hành động chỉ sau 3 giây quan sát, đánh dấu bước tiến đột phá trong khả năng tự học của AI.

  4. QbitAIT6 · 21/08 · 13:15

    Deepverse: Khi AI đảm nhận toàn bộ quy trình thí nghiệm, nhà khoa học chỉ cần đặt câu hỏi

    Deepverse giúp tối ưu hóa quy trình nghiên cứu khoa học bằng cách tích hợp AI vào mọi khâu thí nghiệm, giải phóng thời gian cho các nhà khoa học tập trung vào sáng tạo.

  5. Hugging Face Daily PapersT6 · 21/08 · 12:00

    Chain-of-Experience: Phương pháp giúp LLM tự cải thiện liên tục qua trải nghiệm thực tế

    Nghiên cứu giới thiệu Chain-of-Experience (CoE), cho phép các mô hình ngôn ngữ lớn tự học hỏi và cải thiện hiệu suất thông qua phản hồi lặp lại từ chính mình hoặc môi trường, thay vì chỉ dựa vào suy luận một lần.

  6. Hugging Face Daily PapersT6 · 21/08 · 00:30

    Bounded Agents: Giải pháp bảo mật ủy quyền cho hệ thống AI đa tác nhân

    Nghiên cứu giới thiệu Agentic Principal Chain (APC), một kiến trúc bảo mật mới giúp kiểm soát quyền hạn và ngân sách của các tác nhân AI khi thực hiện chuỗi tác vụ, ngăn chặn việc lạm dụng quyền truy cập hoặc tấn công prompt injection.

  7. JiQiZhiXinT5 · 20/08 · 21:15

    Đưa mô hình thế giới vào đường đua F1: Thử thách giới hạn nhận thức và vật lý của AI hiện thân

    Nhóm nghiên cứu từ NTU Singapore phát triển kiến trúc AI dựa trên mô hình thế giới cho xe đua tự hành, giúp tối ưu hóa khả năng ra quyết định và kiểm soát xe trong các tình huống đối kháng tốc độ cao.

  8. Hugging Face Daily PapersT5 · 20/08 · 15:30

    AdaPop: Phương pháp 'quên' thông tin hiệu quả cho LLM dựa trên độ phổ biến của dữ liệu

    AdaPop tối ưu hóa quá trình xóa dữ liệu trong LLM bằng cách điều chỉnh áp lực học tập dựa trên độ phổ biến của thông tin, giúp ngăn chặn rò rỉ dữ liệu tốt hơn gấp 5 lần so với các phương pháp truyền thống.

  9. JiQiZhiXinT5 · 20/08 · 15:15

    Đại học Bắc Kinh và Microsoft Research giới thiệu BCP: Để AI tự quyết định thời điểm tái lập kế hoạch

    Nhóm nghiên cứu đề xuất BCP, cho phép mô hình VLA tự quyết định việc tiếp tục thực hiện hay tái lập kế hoạch thay vì dùng tham số cố định, giúp tăng đáng kể độ chính xác cho các tác vụ robot phức tạp.

  10. Hugging Face Daily PapersT5 · 20/08 · 11:00

    Zetta: Hệ thống điều khiển vòng lặp kín giúp robot tự tiến hóa trí tuệ vật lý

    Zetta là khung làm việc đột phá cho phép robot tự cập nhật kỹ năng và đánh giá hành vi theo thời gian thực mà không cần thay đổi mô hình gốc, giúp giải quyết hạn chế của các hệ thống điều khiển vòng lặp hở hiện nay.

  11. LMSYS: Blog (nhóm Chatbot Arena)T5 · 20/08 · 00:56

    Tối ưu hóa DeepSeek-V4-Pro trên GPU H20: Đột phá hiệu năng tiệm cận chip B300

    Nhóm LMSYS đã tối ưu hóa mô hình MoE 1.6 nghìn tỷ tham số DeepSeek-V4-Pro trên GPU H20, đạt tốc độ 271 tokens/s, thu hẹp đáng kể khoảng cách hiệu năng so với chip B300.

  12. JiQiZhiXinT4 · 19/08 · 19:00

    DreamWorld: Đột phá tạo video 3D nhất quán nhờ tích hợp hình học không gian

    HiDream.ai giới thiệu DreamWorld, mô hình khuếch tán video sử dụng tiền đề hình học 3D để giải quyết tình trạng biến dạng vật thể và thiếu nhất quán khi thay đổi góc quay, giúp tạo ra thế giới ảo ổn định hơn.

  13. Hugging Face Daily PapersT4 · 19/08 · 15:15

    PixRestore: Bước đột phá trong phục hồi ảnh bằng mô hình Diffusion Transformer không dùng VAE

    PixRestore là mô hình Diffusion Transformer hoạt động trực tiếp trên không gian pixel, loại bỏ sự phụ thuộc vào VAE để bảo toàn chi tiết ảnh sắc nét và khắc phục các lỗi sai lệch nội dung thường gặp ở các mô hình T2I.

  14. Hugging Face Daily PapersT4 · 19/08 · 15:00

    Giải mã kỹ năng của AI Agent: Tại sao chúng hiệu quả và khi nào thì thất bại?

    Nghiên cứu phân tích sâu về cách các gói kỹ năng (skills) hỗ trợ LLM Agent, đồng thời chỉ ra những giới hạn và nguyên nhân thất bại thông qua thực nghiệm định lượng và phân tích quỹ đạo hành động.

  15. JiQiZhiXinT4 · 19/08 · 14:00

    WAM-Diff2: Đột phá tốc độ giải mã gấp 15 lần cho mô hình VLA trong xe tự lái

    Các nhà nghiên cứu từ Đại học Phúc Đán và Yinwang giới thiệu WAM-Diff2, khung mô hình VLA giúp chuyển đổi từ kiến trúc tự hồi quy sang khuếch tán, tăng tốc độ giải mã lên 15,1 lần mà vẫn giữ nguyên hiệu suất đa nhiệm.

  16. Hugging Face Daily PapersT4 · 19/08 · 11:00

    Cá nhân hóa nghiên cứu tự động: Hướng tới cộng sự AI thấu hiểu nhà khoa học

    Nghiên cứu đề xuất mô hình AI tự động hóa quy trình nghiên cứu khoa học dựa trên hồ sơ, kinh nghiệm và phong cách làm việc riêng biệt của từng nhà khoa học, thay vì các tiêu chuẩn chung chung.

  17. HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)T4 · 19/08 · 10:05

    StartupBench: Bộ tiêu chuẩn đánh giá AI Agent dựa trên quy trình thực tế của startup

    StartupBench là bộ tiêu chuẩn đánh giá AI Agent thông qua các quy trình làm việc thực tế từ các startup, thay vì các tác vụ giả định. Kết quả cho thấy ngay cả những mô hình mạnh nhất cũng chỉ đạt tỷ lệ thành công 30%, bộc lộ hạn chế lớn trong việc tuân thủ chỉ dẫn phức tạp và kiến thức chuyên môn.

  18. Anthropic: Research (công bố - Web)T4 · 19/08 · 05:27

    Claude đột phá trong thiết kế protein và nghiên cứu hóa phân tích

    Anthropic công bố kết quả thử nghiệm cho thấy Claude (Mythos và Opus 4.8) đạt tỷ lệ thành công lên tới 35,1% trong việc thiết kế các chất liên kết protein cho 15 mục tiêu khác nhau, mở ra tiềm năng ứng dụng AI trong y sinh.

  19. Hugging Face Daily PapersT4 · 19/08 · 02:15

    IVT: Bước tiến mới giúp AI 'tư duy hình ảnh nội tại' để dự đoán video chủ động

    IVT là phương pháp huấn luyện giúp mô hình AI dự đoán các khung hình tương lai mà không cần tạo ảnh trung gian, giúp tăng tốc độ xử lý video mà vẫn giữ được khả năng suy luận logic.

  20. Hugging Face: BlogT4 · 19/08 · 02:05

    Bộ nhớ cho AI Agent: Không phải cứ nhiều là tốt, cần hiệu chỉnh theo năng lực mô hình

    Nghiên cứu từ IBM cho thấy việc tối ưu bộ nhớ AI Agent cần tùy biến theo năng lực mô hình: mô hình mạnh nên dùng toàn bộ hướng dẫn, trong khi mô hình yếu đạt hiệu quả cao nhất với phương pháp truy xuất chọn lọc.

Nghiên cứu & Luận văn — Chủ Đề AI · Trang 15 | AIHOT.vn