Nghiên cứu & Luận văn
CHỦ ĐỀ · TRANG 5

Nghiên cứu & Luận văn

Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.

2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40

  1. JiQiZhiXinT4 · 16/09 · 15:15

    Đừng để AI Agent 'tự biên tự diễn': Bí quyết cân bằng giữa tư duy nội tại và công cụ ngoại vi

    Tổng hợp từ 600 nghiên cứu, bài viết đề xuất khung lý thuyết 'Theory of Agent' giúp tối ưu hóa việc phân bổ năng lực cho AI Agent, tránh tình trạng lạm dụng công cụ hoặc suy diễn sai lệch.

  2. JiQiZhiXinT4 · 16/09 · 15:15

    Nghiên cứu từ Thanh Hoa: Chỉ cần một bài toán để huấn luyện mô hình ngôn ngữ lớn?

    Nhóm nghiên cứu từ ĐH Thanh Hoa phát hiện On-Policy Distillation (OPD) có thể đạt 70% hiệu suất dù chỉ huấn luyện trên một mẫu dữ liệu duy nhất, cho thấy thuật toán hiện tại vẫn chưa khai thác hết tiềm năng của dữ liệu.

  3. Hugging Face Daily PapersT4 · 16/09 · 14:00

    StepAudio 3: Bước tiến đột phá trong mô hình AI hội thoại thời gian thực

    StepAudio 3 giới thiệu cơ chế 'Think-While-Speaking' cho phép AI suy luận chuyên sâu song song với việc phản hồi bằng giọng nói, tạo ra trải nghiệm hội thoại tự nhiên, mượt mà và có độ trễ cực thấp.

  4. Hugging Face Daily PapersT4 · 16/09 · 10:45

    AI cuối cùng do con người tạo ra: Hướng tới khả năng tự cải tiến đệ quy thực thụ

    Bài viết đề xuất lộ trình phát triển AI tự cải tiến đệ quy (RSI), từ việc tự chủ thực thi đến khả năng tự tối ưu hóa meta, nhằm giải quyết các hạn chế của mô hình ngôn ngữ hiện tại.

  5. Hugging Face Daily PapersT4 · 16/09 · 09:00

    Gavel: Tối ưu hóa điều hướng kỹ năng cho LLM mà không cần nhồi nhét ngữ cảnh

    Gavel là phương pháp mới giúp LLM tự chọn kỹ năng phù hợp thông qua các ánh xạ tuyến tính thay vì nhồi nhét metadata vào ngữ cảnh, giúp mở rộng thư viện kỹ năng mà không làm giảm hiệu suất của mô hình.

  6. Hugging Face Daily PapersT4 · 16/09 · 02:15

    Never Give Up: Tối ưu hóa học tăng cường cho LLM bằng cách tập trung vào các bài toán khó

    Nghiên cứu chỉ ra rằng RL hiện nay thường lãng phí tài nguyên vào các bài toán dễ. Phương pháp Never Give Up (NGU) đề xuất cơ chế lấy mẫu thích ứng, giúp phân bổ lại tài nguyên tính toán để giải quyết hiệu quả các bài toán khó mà mô hình chưa làm tốt.

  7. JiQiZhiXinT3 · 15/09 · 19:15

    Từ Chat, Code đến Discovery: Khi AI bắt đầu học cách làm nhà khoa học

    AI đang tiến hóa từ việc trò chuyện và lập trình sang khả năng tự thực hiện các khám phá khoa học. Các phòng thí nghiệm hàng đầu đang đặt cược vào việc để AI tự đề xuất, thực hiện thí nghiệm và phân tích kết quả, mở ra kỷ nguyên mới cho tri thức nhân loại.

  8. JiQiZhiXinT3 · 15/09 · 19:15

    ECCV 2026: REAL - Bước tiến mới giúp robot tự chủ trong thế giới thực mà không cần 'góc nhìn thượng đế'

    Nhóm nghiên cứu từ Thượng Hải giới thiệu REAL, khung làm việc cho robot giúp giải quyết các yêu cầu mơ hồ và môi trường chưa biết, cho phép robot chủ động khám phá và tương tác với người dùng thay vì dựa vào dữ liệu hoàn hảo.

  9. JiQiZhiXinT3 · 15/09 · 19:15

    RSIAgent: Bước đột phá giúp mô hình mã nguồn mở tự khám phá và thích nghi với môi trường mới

    RSIAgent giới thiệu khung làm việc RSI cho phép AI tự học hỏi từ kinh nghiệm thực tế và hiểu rõ quan hệ nhân quả trong môi trường mới mà không cần tái huấn luyện tham số, vượt qua cả GPT-6 Astra trong nhiều bài kiểm tra khó.

  10. JiQiZhiXinT3 · 15/09 · 19:15

    Cơ hội nhận học bổng toàn phần tại MBZUAI: Đại học AI top 10 thế giới chính thức mở đơn tuyển sinh

    Đại học Trí tuệ Nhân tạo Mohamed bin Zayed (MBZUAI) vừa mở đơn tuyển sinh cho kỳ nhập học mùa thu 2027 với chính sách học bổng toàn phần hấp dẫn. Đây là cơ hội hiếm có để theo học tại ngôi trường đang dẫn đầu thế giới về nghiên cứu AI và hợp tác chiến lược với các tên tuổi lớn như OpenAI hay MIT.

  11. QbitAIT3 · 15/09 · 15:15

    Nghiên cứu mới từ Meta: Chưng cất mô hình Byte giúp phá vỡ giới hạn hiệu năng

    Meta vừa công bố phương pháp chưng cất mô hình mới giúp các mô hình Byte vượt qua giới hạn hiệu suất truyền thống, mở ra hướng đi đột phá cho việc tối ưu hóa AI.

  12. Hugging Face Daily PapersT3 · 15/09 · 14:00

    AlayaVista: Mô hình thế giới video streaming kết hợp toàn cảnh và góc nhìn chi tiết

    AlayaVista là mô hình thế giới video mới giúp tách biệt quá trình tiến hóa của bối cảnh toàn cảnh 360 độ với việc tổng hợp hình ảnh góc nhìn chi tiết, cho phép điều khiển camera mượt mà và duy trì độ trung thực cao.

  13. QbitAIT3 · 15/09 · 13:15

    Cựu VP OpenAI phản hồi Terence Tao: AI không hủy hoại toán học, nó còn làm được nhiều hơn thế

    Cựu lãnh đạo OpenAI khẳng định AI không chỉ giải toán mà còn có khả năng tạo ra các khung khái niệm mới, mở ra kỷ nguyên hợp tác sâu sắc giữa máy móc và các nhà toán học.

  14. Hugging Face Daily PapersT3 · 15/09 · 11:45

    Realtime-Venus: Hệ thống tương tác song công thời gian thực với cơ chế ủy quyền bất đồng bộ

    Realtime-Venus là hệ thống tương tác đa phương thức sử dụng mô hình 9B, cho phép duy trì hội thoại liên tục trong khi thực hiện các tác vụ phức tạp ở chế độ nền nhờ cơ chế ủy quyền bất đồng bộ.

  15. Hugging Face Daily PapersT3 · 15/09 · 11:45

    Agent as Policy (AGP): Bước tiến mới trong điều khiển robot tự hành không cần huấn luyện chuyên biệt

    Nghiên cứu giới thiệu AGP, một tác nhân AI có khả năng điều khiển robot thực hiện các tác vụ phức tạp từ lắp ráp đến thao tác vật thể biến dạng mà không cần huấn luyện riêng cho từng môi trường, nhờ khả năng lập trình và phản hồi thời gian thực.

  16. Hugging Face Daily PapersT3 · 15/09 · 10:30

    ZGCM-1: Mô hình nền tảng 7B mã nguồn mở tối ưu cho toán học và tìm kiếm tác tử

    ZGCM-1 là mô hình 7B đột phá, kết hợp tư duy nội tại với công cụ bên ngoài để vượt qua giới hạn dung lượng tham số. Với kiến trúc FP8 và quy trình huấn luyện hiệu quả, mô hình hỗ trợ ngữ cảnh 256K, cho phép tác tử tự vận hành và tối ưu hóa dữ liệu.

  17. QbitAIT3 · 15/09 · 10:15

    7 nghiên cứu sinh đào tạo mô hình 7B từ con số 0 chỉ trong 3 tháng: Công khai toàn bộ mã nguồn và dữ liệu

    Một nhóm nghiên cứu sinh đã huy động hàng trăm AI Agent để tự động hóa quy trình phát triển, đánh dấu bước tiến mới trong việc dùng AI để tạo ra AI.

  18. Hugging Face Daily PapersT3 · 15/09 · 08:00

    MobileVLA-R1 2.0: Bước tiến mới trong điều khiển robot di động nhờ suy luận tăng cường RL

    MobileVLA-R1 2.0 kết hợp suy luận có cấu trúc với học tăng cường (RL) để thu hẹp khoảng cách giữa tư duy ngôn ngữ cấp cao và hành động điều khiển robot chính xác, giúp robot thực hiện các nhiệm vụ phức tạp hiệu quả hơn.

  19. MarkTechPostT3 · 15/09 · 07:36

    DeepSeek ra mắt DeepSeek-V4.1-Flash: Cửa sổ 1M token, tối ưu bộ nhớ KV Cache cực đỉnh

    DeepSeek-V4.1-Flash là mô hình MoE đa phương thức mới với 748B tham số, nổi bật nhờ khả năng xử lý 1 triệu token và giảm dung lượng KV Cache xuống chỉ còn 890 byte mỗi token, tối ưu hiệu suất vượt trội so với các thế hệ trước.

  20. Hugging Face Daily PapersT3 · 15/09 · 06:45

    ReactHuman: Bộ tiêu chuẩn đánh giá khả năng phản xạ vật lý như con người cho robot AI

    ReactHuman là bộ tiêu chuẩn đầu tiên đánh giá khả năng phản ứng tức thời của các mô hình đa phương thức (MLLM) trước các tình huống nguy hiểm trong môi trường gia đình, giúp robot đưa ra quyết định an toàn và chính xác hơn.

Nghiên cứu & Luận văn — Chủ Đề AI · Trang 5 | AIHOT.vn