Nghiên cứu & Luận văn
CHỦ ĐỀ · TRANG 14

Nghiên cứu & Luận văn

Các bài báo AI đáng chú ý: Kiến trúc mới, phương pháp huấn luyện và đo lường năng lực mô hình.

2.415 bài thu thập349 tinh chọncập nhật đến 28/09 02:40

  1. smol.ai AI NewsT2 · 24/08 · 12:44

    Bùng nổ mô hình MoE: Z.ai, Tencent và Alibaba đồng loạt tung siêu phẩm AI mới

    Thị trường AI chứng kiến sự ra mắt của loạt mô hình MoE mạnh mẽ từ Z.ai, Tencent và Alibaba với cửa sổ ngữ cảnh lên tới 1 triệu token, tập trung vào lập trình và bảo mật. Đồng thời, vLLM cũng công bố các tiêu chuẩn mới về hiệu suất suy luận cho các mô hình quy mô lớn.

  2. QbitAIT2 · 24/08 · 12:15

    WRC 2026: Mô hình thế giới toàn phương thức nguyên bản – Từ mô phỏng đến tương tác thực tế

    Tại WRC 2026, các chuyên gia đã giới thiệu mô hình thế giới toàn phương thức (native omni-modal) thế hệ mới, cho phép AI không chỉ mô phỏng môi trường mà còn tương tác trực tiếp với thế giới thực một cách tự nhiên.

  3. Hugging Face Daily PapersT2 · 24/08 · 10:30

    AgentMercury: Khung tổng hợp môi trường thực thi quy mô lớn cho các kịch bản kinh doanh

    AgentMercury là khung làm việc đột phá giúp tự động tạo ra các môi trường kinh doanh thực tế, có thể kiểm chứng thay vì dựa vào các tác vụ thủ công, cho phép huấn luyện AI trong các quy trình công việc phức tạp và đa dạng.

  4. Hugging Face Daily PapersT2 · 24/08 · 10:00

    Kỹ thuật Đồ thị trong kỷ nguyên Tác nhân LLM: Từ trí tuệ cá thể đến trí tuệ hệ thống

    Bài viết đề xuất chuyển dịch từ việc tối ưu hóa các tác nhân đơn lẻ sang xây dựng 'Trí tuệ hệ thống', nơi các tác nhân chuyên biệt phối hợp với nhau để giải quyết các nhiệm vụ phức tạp vượt quá khả năng của một mô hình duy nhất.

  5. Hugging Face Daily PapersT2 · 24/08 · 09:15

    CLEAR: Phương pháp định tuyến bộ điều hợp tiềm ẩn giúp LLM an toàn mà không làm giảm hiệu năng

    CLEAR là khung điều chỉnh an toàn mới sử dụng cổng điều khiển ẩn để kích hoạt bộ điều hợp LoRA linh hoạt, giúp giảm phản hồi độc hại mà vẫn giữ nguyên chất lượng câu trả lời cho các truy vấn thông thường.

  6. Hugging Face Daily PapersT2 · 24/08 · 09:00

    Llama-Mobile: Đột phá nén mô hình thị giác ngôn ngữ xuống 2.7-bit cho thiết bị di động

    Llama-Mobile giới thiệu phương pháp nén mô hình VLMs xuống định dạng 2.7-bit, cho phép chạy mượt mà trên chip Arm mà vẫn giữ vững hiệu suất, giúp đưa các mô hình lớn như Llama 3.2 11B lên smartphone.

  7. JiQiZhiXinT2 · 24/08 · 01:30

    PlayWorld: Bước tiến mới trong đánh giá mô hình thế giới thông qua AI Agent

    Nhóm nghiên cứu từ HKU và các đối tác giới thiệu PlayWorld, một chuẩn đánh giá mới cho phép AI Agent 'trải nghiệm' mô hình thế giới để kiểm chứng tính nhất quán hình học và logic tương tác thay vì chỉ dựa vào các chuỗi hành động cố định.

  8. JiQiZhiXinCN · 23/08 · 21:30

    Đại học Princeton công bố i1: Công thức mở hoàn chỉnh cho mô hình tạo ảnh từ văn bản

    Nhóm nghiên cứu tại Princeton đã thực hiện hơn 300 thí nghiệm với 700.000 giờ TPU để tạo ra i1, một mô hình tạo ảnh 3B tham số hoàn toàn mở, vượt trội hơn các mô hình mã nguồn mở hiện có tới 29,5% trên các bài kiểm tra tiêu chuẩn.

  9. JiQiZhiXinCN · 23/08 · 01:15

    Đột phá: Chạy DeepSeek V4-Flash 'full lực' trên một card RTX 5090 với FreeToken

    Nhóm nghiên cứu từ Berkeley và MIT vừa ra mắt FreeToken, hệ thống suy luận tối ưu cho phép chạy các mô hình MoE khổng lồ trên phần cứng tiêu dùng với tốc độ cực nhanh, xóa bỏ rào cản về hạ tầng máy chủ.

  10. JiQiZhiXinT7 · 22/08 · 21:15

    Đối thoại cùng Vita Dynamics: Thách thức thực sự của AI hiện thân không nằm ở việc 'học', mà là khả năng 'kế thừa' giữa các thực thể

    Vita Dynamics giới thiệu hệ thống 'Bộ gen hiện thân' (Embodied Genome), cho phép robot chia sẻ trí tuệ và kỹ năng giữa các hình thái cơ thể khác nhau, thay vì phải huấn luyện lại từ đầu cho mỗi thiết bị.

  11. JiQiZhiXinT7 · 22/08 · 19:15

    AI tự cải tiến chỉ đạt 0.16 điểm? Einsia AI ra mắt AI4AI-Bench: Liệu AI có thể tự thiết kế thuật toán tốt hơn?

    Einsia AI giới thiệu AI4AI-Bench, bộ tiêu chuẩn đánh giá khả năng của AI trong việc tự thiết kế các thuật toán học máy mới thay vì chỉ tối ưu hóa mã nguồn thông thường, mở ra kỷ nguyên tự cải tiến đệ quy.

  12. Hugging Face Daily PapersT7 · 22/08 · 06:15

    FlowEvo: Bước tiến mới giúp AI tự tiến hóa thông qua quy trình và kỹ năng tự học

    FlowEvo là khung làm việc không cần huấn luyện, cho phép AI tự động chuyển đổi các quy trình thành công thành kỹ năng có thể tái sử dụng, giúp hệ thống liên tục phát triển và tối ưu hóa hiệu suất qua từng tác vụ.

  13. JiQiZhiXinT7 · 22/08 · 03:15

    GigaBrain-0.7 ra mắt: Mô hình robot đột phá với kiến trúc System-3 và hệ thống 'Tháp đôi' dẫn đầu bảng xếp hạng

    GigaBrain-0.7 thiết lập chuẩn mực mới cho robot thông minh nhờ kiến trúc System-3 cho phép dự đoán hành động trước khi thực thi, đồng thời thống trị bảng xếp hạng RoboColiseum với mô hình 'Tháp đôi' dữ liệu và thuật toán.

  14. Hugging Face Daily PapersT7 · 22/08 · 01:00

    Bài toán khó của Embedder: Dùng LLM thay thế mô hình nhúng truyền thống có đáng không?

    Nghiên cứu so sánh toàn diện cho thấy dù LLM có hiệu suất ngang ngửa mô hình nhúng chuyên dụng, nhưng chi phí vận hành lại đắt gấp 1.400 lần và tốc độ xử lý chậm hơn đáng kể.

  15. LMSYS: Blog (nhóm Chatbot Arena)T7 · 22/08 · 00:56

    Ling-3.0-flash: Tối ưu hóa độ trễ giải mã lên 54% trên 4 GPU Blackwell

    Đội ngũ Ant Group và RadixArk đã tối ưu hóa mô hình Ling-3.0-flash, giúp tăng tốc độ giải mã đơn yêu cầu từ 288 lên 606 tok/s và giảm độ trễ TPOT xuống còn 1.53 ms nhờ kiến trúc MoE cải tiến.

  16. Hugging Face Daily PapersT6 · 21/08 · 23:00

    τ_0-VLA: Mô hình nền tảng robot phân cấp với khả năng tính toán linh hoạt nhờ mô hình thế giới

    τ_0-VLA cải thiện khả năng thực hiện các tác vụ robot dài hạn bằng cách cho phép mô hình tự đánh giá và tìm kiếm phương án tối ưu trước khi hành động, thay vì chỉ phản hồi một lần duy nhất.

  17. Hugging Face: BlogT6 · 21/08 · 21:06

    Hugging Face vạch trần hiện tượng 'gian lận' điểm số trong các mô hình nhận dạng giọng nói (ASR)

    Nghiên cứu mới từ Hugging Face chỉ ra nhiều mô hình ASR đạt điểm cao nhờ học thuộc lòng dữ liệu kiểm thử thay vì cải thiện khả năng nhận dạng thực tế, dẫn đến kết quả đánh giá bị thổi phồng.

  18. Hugging Face Daily PapersT6 · 21/08 · 19:30

    Tư duy bằng ngôn ngữ ít tài nguyên: SFT xây dựng gì, RL sửa lỗi gì và những hạn chế của điểm số chính xác

    Nghiên cứu chỉ ra rằng điểm số benchmark thường gây nhiễu, trong khi SFT thực sự giúp mô hình tư duy bằng ngôn ngữ mục tiêu thay vì chỉ dịch thuật ngầm, giúp việc kiểm chứng và sửa lỗi trở nên khả thi hơn.

  19. JiQiZhiXinT6 · 21/08 · 19:15

    Bohr Science Space: Trợ lý AI giúp nhà khoa học giải phóng khỏi các công việc nghiên cứu thủ công

    Deepverse vừa ra mắt Bohr Science Space, nền tảng làm việc tích hợp AI giúp tự động hóa quy trình nghiên cứu từ khảo sát tài liệu, xây dựng giả thuyết đến thực thi thí nghiệm, cho phép nhà khoa học tập trung vào tư duy sáng tạo.

  20. JiQiZhiXinT6 · 21/08 · 19:15

    Spark-to-Paper: Hệ thống AI tự động viết bài báo khoa học từ ý tưởng, đạt tỷ lệ phát hiện lỗi sai 92%

    Spark-to-Paper là hệ thống end-to-end giúp tự động hóa quy trình nghiên cứu từ tìm kiếm tài liệu, chạy thực nghiệm đến xuất bản LaTeX, với khả năng kiểm chứng dữ liệu nghiêm ngặt giúp giảm thiểu tối đa tình trạng 'ảo giác' AI.

Nghiên cứu & Luận văn — Chủ Đề AI · Trang 14 | AIHOT.vn