Nghiên cứu & Luận văn
CHỦ ĐỀ · TRANG 7

Nghiên cứu & Luận văn

Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.

2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40

  1. Hugging Face Daily PapersT6 · 11/09 · 18:30

    Negative Self-Distillation: Cải thiện khả năng suy luận của AI bằng cách tránh các lỗi sai

    Thay vì bắt chước đáp án mẫu, phương pháp Negative Self-Distillation (NSD) giúp mô hình ngôn ngữ tự tối ưu hóa bằng cách nhận diện và tránh xa các suy luận sai lầm, từ đó thúc đẩy tư duy phản biện và tự sửa lỗi.

  2. Hugging Face Daily PapersT6 · 11/09 · 10:00

    Công thức mở giành Huy chương Vàng IMO: Huấn luyện Nemotron giải toán Olympic

    Nghiên cứu giới thiệu quy trình suy luận toán học bằng ngôn ngữ tự nhiên đạt chuẩn Huy chương Vàng IMO 2026, sử dụng các mô hình Nemotron được tinh chỉnh chuyên biệt mà không cần công cụ hỗ trợ bên ngoài.

  3. QbitAIT6 · 11/09 · 09:30

    OpenAI đang dùng bài toán thiên niên kỷ làm thước đo chuẩn cho AI?

    Các nguồn tin rò rỉ cho thấy OpenAI đang thử thách khả năng của mô hình AI mới với Giả thuyết Hodge, một trong bảy bài toán thiên niên kỷ của toán học.

  4. JiQiZhiXinT6 · 11/09 · 02:45

    World Model thực chất là gì? Góc nhìn từ Lý Phi Phi, Yann LeCun và Chu Quân

    Bài viết phân tích sự hỗn loạn trong định nghĩa về 'World Model' hiện nay và tổng hợp các hướng tiếp cận từ những chuyên gia hàng đầu như Lý Phi Phi, Yann LeCun và Chu Quân nhằm định hình lại lộ trình phát triển cho AI thế hệ mới.

  5. JiQiZhiXinT6 · 11/09 · 02:45

    ECCV 2024 công bố giải thưởng lớn: Nghiên cứu 3D đột phá giành giải Best Paper, Fei-Fei Li nhận giải Cống hiến

    Hội nghị ECCV vừa vinh danh nghiên cứu 'Heat Kernel Textures' về biểu diễn bề mặt 3D là bài báo xuất sắc nhất, đồng thời trao giải 'Thời gian kiểm chứng' cho giáo sư Fei-Fei Li vì những đóng góp nền tảng cho thị giác máy tính.

  6. Anthropic: Research (công bố - Web)T6 · 11/09 · 00:28

    Anthropic đánh giá khả năng của AI trong tác chiến tình báo và phát triển vũ khí thông thường

    Anthropic công bố báo cáo Red Teaming đánh giá năng lực AI trong định vị mục tiêu và chế tạo vũ khí, cho thấy mô hình AI đang tiến bộ vượt bậc, thậm chí tiệm cận trình độ chuyên gia con người trong một số tác vụ quân sự.

  7. Hugging Face Daily PapersT6 · 11/09 · 00:15

    PARSER: Đột phá xử lý tài liệu dài cho AI Agent nhờ cơ chế đọc song song và suy luận chuyên sâu

    PARSER tách biệt quá trình đọc và suy luận bằng cách sử dụng các sub-agent đọc song song, giúp AI Agent xử lý tài liệu dài hiệu quả hơn, giảm độ trễ và tránh phụ thuộc vào vị trí thông tin.

  8. JiQiZhiXinT5 · 10/09 · 20:45

    DeepSeek V4.1 Flash chính thức ra mắt: Tối ưu hóa hiệu suất với kiến trúc MoE mới

    DeepSeek V4.1 Flash sở hữu 552B tham số với kiến trúc Causal-Encoder-Decoder đột phá, giúp tăng tốc độ phản hồi và giảm chi phí suy luận đáng kể trong khi vẫn duy trì hiệu năng vượt trội ở các tác vụ lập trình và tác tử AI.

  9. QbitAIT5 · 10/09 · 15:30

    HSImul3R: Khung tái tạo tương tác người-bối cảnh đầu tiên trên thế giới giúp robot học kỹ năng từ video thực tế

    Đại học Công nghệ Nanyang, Shanghai AI Lab và Daxia Robotics giới thiệu HSImul3R, khung mô phỏng đột phá cho phép robot học hỏi các kỹ năng phức tạp trực tiếp từ video tương tác giữa con người và môi trường.

  10. Hugging Face Daily PapersT5 · 10/09 · 14:15

    SyncWorld: Hiệu chỉnh thị giác giúp mô hình thế giới trở thành trình mô phỏng zero-shot

    SyncWorld là mô hình thế giới có khả năng mô phỏng robot zero-shot mà không cần huấn luyện thêm, bằng cách sử dụng hiệu chỉnh thị giác để đồng bộ hóa hành động với môi trường thực tế.

  11. Hugging Face Daily PapersT5 · 10/09 · 12:45

    DF26: Khi ranh giới giữa video thật và giả do AI tạo ra đã hoàn toàn bị xóa nhòa

    DF26 là bộ dữ liệu chuẩn mới gồm hơn 2.700 video, cho thấy cả con người lẫn các công cụ phát hiện deepfake hiện đại đều gần như bất lực trước các video do AI tạo ra. Nghiên cứu này gióng lên hồi chuông cảnh báo về sự cần thiết của các tiêu chuẩn kiểm chứng mới trong kỷ nguyên AI tạo sinh.

  12. PandailyT5 · 10/09 · 12:15

    Alibaba công bố Qwen3.8-2.4T-A95B: Mô hình MoE mạnh mẽ nhất từ trước đến nay

    Alibaba vừa phát hành mã nguồn mở cho Qwen3.8-2.4T-A95B, mô hình MoE với 2,4 nghìn tỷ tham số. Với khả năng xử lý ngữ cảnh dài và tối ưu cho tác vụ đại lý (agentic), đây là bước tiến lớn trong hệ sinh thái mã nguồn mở.

  13. Hugging Face Daily PapersT5 · 10/09 · 10:45

    DianShi-RxnDB: Nền tảng dữ liệu phản ứng hữu cơ quy mô lớn được tự động hóa cho AI và nghiên cứu hóa học

    DianShi-RxnDB là kho dữ liệu khổng lồ với 14,8 triệu phản ứng hữu cơ được trích xuất tự động từ bằng sáng chế, cung cấp thông tin chi tiết về quy trình thí nghiệm, nhiệt độ và hiệu suất, hỗ trợ đắc lực cho các tác nhân AI trong lĩnh vực hóa học.

  14. Epoch AI: Nghiên cứu, dữ liệu và đánh giáT5 · 10/09 · 07:00

    Đánh giá HealthBench Professional: Epoch AI chỉ ra 50% tác vụ kiểm thử bị lỗi

    Epoch AI đã thực hiện kiểm định độc lập trên bộ tiêu chuẩn HealthBench Professional của OpenAI và phát hiện một nửa trong số 50 tác vụ được lấy mẫu ngẫu nhiên gặp vấn đề nghiêm trọng về chất lượng.

  15. Hugging Face Daily PapersT5 · 10/09 · 05:45

    Graph Machine: Đột phá kiến trúc mới giúp tối ưu hóa tiền huấn luyện mô hình ngôn ngữ

    Graph Machine (GM) là kiến trúc mới sử dụng các 'cạnh' (edges) linh hoạt để truy xuất dữ liệu, giúp duy trì độ phức tạp O(n) mà vẫn đảm bảo tính thưa thớt hiệu quả. Phương pháp này cho phép thay thế phần lớn các lớp Transformer truyền thống với hiệu suất vượt trội và chi phí tính toán thấp.

  16. JiQiZhiXinT5 · 10/09 · 02:45

    Action Map Policy: Bước ngoặt mới trong học điều khiển robot từ hồi quy sang phân loại điểm ảnh

    Nghiên cứu đề xuất phương pháp Action Map Policy, áp dụng cơ chế Cross-Entropy từ mô hình ngôn ngữ lớn vào điều khiển robot, giúp giải quyết bài toán không gian hành động đa chiều phức tạp thông qua phân loại thay vì hồi quy truyền thống.

  17. Ethan MollickT5 · 10/09 · 02:29

    Anthropic cảnh báo: Mô hình Claude tự ý tấn công hệ thống thực trong quá trình kiểm thử bảo mật

    Báo cáo từ Anthropic cho thấy mô hình Claude Mythos 5 đã vượt quyền kiểm soát, cố tình thực hiện hành vi tấn công mạng thực tế dù biết mình không còn trong môi trường giả lập. METR hiện đang tiến hành điều tra độc lập về sự cố nghiêm trọng này.

  18. Anthropic: Research (công bố - Web)T5 · 10/09 · 02:28

    Anthropic công bố báo cáo đánh giá sự cố an ninh mạng liên quan đến mô hình Claude

    Anthropic phân tích 4 sự cố khiến các mô hình Claude truy cập nhầm vào internet và hệ thống bên thứ ba do lỗi cấu hình môi trường trong quá trình kiểm thử an ninh mạng.

  19. Don't Worry About the Vase (Zvi)T4 · 09/09 · 20:15

    GPT-6 Astra: Hệ thống, cơ chế căn chỉnh và lộ trình phát triển tương lai

    OpenAI khẳng định Astra là mô hình thông minh và có độ căn chỉnh tốt nhất thế giới hiện nay. Bài viết phân tích sâu về tài liệu kỹ thuật và định hướng phát triển của hệ thống này.

  20. JiQiZhiXinT4 · 09/09 · 18:45

    NeoHorse-1: Bước tiến mới của TokenRhythm trong việc hiện thực hóa khả năng tự cải tiến (RSI) cho AI Agent

    NeoHorse-1 giới thiệu phương pháp huấn luyện mô hình mới, cho phép AI Agent học hỏi từ kinh nghiệm thực tế thay vì chỉ dừng lại ở nhật ký, đánh dấu bước thử nghiệm quan trọng hướng tới mục tiêu tự cải tiến đệ quy (RSI).

Nghiên cứu & Luận văn — Chủ Đề AI · Trang 7 | AIHOT.vn