T3 · 25/08

HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu88

Tinh chọnChỉ một trang web độc hại cũng đủ thao túng gợi ý của LLM: Nghiên cứu về lỗ hổng của hệ thống RAG

Nghiên cứu mới với bộ tiêu chuẩn FORGE chỉ ra rằng các mô hình LLM trong hệ thống gợi ý rất dễ bị thao túng bởi nội dung rác, khiến chúng vô tình quảng bá sản phẩm giả mạo chỉ với một trang web bị nhiễm độc.

Bảo mật AILLMRAGThao túng thông tinNghiên cứu AI
X.PIN@thexpin· 2 nguồn
Mô hình85

Thomson Reuters ra mắt mô hình ngôn ngữ lớn Thomson, phát triển dựa trên Qwen3.5-397B

Thomson Reuters vừa giới thiệu mô hình ngôn ngữ lớn đầu tiên mang tên Thomson, được tinh chỉnh từ Qwen3.5-397B với chi phí 40 triệu USD. Mô hình này tập trung vào độ an toàn, tính trung lập và đạt hiệu suất ấn tượng trong các bài kiểm tra chuyên môn về luật.

Thomson ReutersQwenAI pháp lýLLMCông nghệ AI
OpenBMB@OpenBMB
Thủ thuật85

MiniCPM-o-4.5: Bước tiến mới giúp AI Agent tự động hóa quy trình làm việc phức tạp

OpenBMB giới thiệu khả năng của MiniCPM-o-4.5 trong việc điều khiển AI Agent tự động hóa toàn bộ quy trình từ hiểu mô hình, tinh chỉnh đến triển khai, điển hình là việc hoàn tất tinh chỉnh mô hình đa phương thức chỉ trong 68 phút với tương tác tối thiểu.

MiniCPMAI AgentOpenBMBTinh chỉnh mô hìnhTự động hóa
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

MobilePA-Bench: Bộ tiêu chuẩn đánh giá tác nhân AI trên thiết bị di động với các tác vụ thực tế phức tạp

MobilePA-Bench là bộ tiêu chuẩn tương tác mới giúp đánh giá khả năng lập kế hoạch và sử dụng công cụ của các tác nhân AI trên di động thông qua 212 công cụ thực tế. Kết quả cho thấy các mô hình ngôn ngữ lớn hiện nay vẫn gặp khó khăn khi xử lý các ràng buộc phức tạp và lỗi vận hành.

AI di độngTác nhân AIĐánh giá mô hìnhLLMMobilePA-Bench
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

Nghiên cứu: Các kỹ thuật RAG nâng cao vô tình làm trầm trọng thêm lỗi từ nhận dạng giọng nói (ASR)

Nghiên cứu chỉ ra rằng việc sử dụng đồ thị thực thể và tái viết truy vấn trong RAG đa chặng làm khuếch đại sai sót từ ASR, khiến độ chính xác giảm mạnh hơn so với tìm kiếm thuần túy khi dữ liệu đầu vào bị nhiễu.

RAGASRXử lý ngôn ngữNghiên cứu AIĐộ tin cậy AI
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Cách mô hình ngôn ngữ đánh giá năng lực người dùng và định kiến nghề nghiệp

Nghiên cứu chỉ ra rằng mô hình ngôn ngữ tự ước tính năng lực người dùng để điều chỉnh độ phức tạp của câu trả lời. Dù tồn tại các vector định kiến, nghiên cứu chưa tìm thấy bằng chứng rõ ràng về việc chúng gây ra phân biệt đối xử trong đầu ra.

AIĐạo đức AILLMNghiên cứu AIĐịnh kiến
AI Notes@AYi_AInotes
Thủ thuật85

Thực hư mô hình đa tác tử Apodex 1.1: Vạch trần chiêu trò làm giàu bằng AI

Apodex 1.1 là kiến trúc đa tác tử mã nguồn mở cho phép chạy cục bộ, nhưng kết quả thực nghiệm cho thấy chưa có bằng chứng xác thực về khả năng tạo thu nhập như quảng cáo. Thay vì viết lách, nhu cầu thực tế cao nhất lại nằm ở mảng biên tập video.

AIĐa tác tửMã nguồn mởKiểm chứngSự thật AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

Task-CoEvolve: Tối ưu hóa Harness hiệu quả thông qua chọn lọc tác vụ thích ứng

Task-CoEvolve giới thiệu phương pháp tối ưu hóa harness cho LLM bằng cách cho phép các tác vụ kiểm chứng cùng tiến hóa, giúp giảm 80% chi phí đánh giá mà vẫn duy trì độ chính xác tương đương với bộ dữ liệu đầy đủ.

LLMTối ưu hóaĐánh giá mô hìnhHọc máyNghiên cứu AI
Rohan Paul@rohanpaul_ai
Nghiên cứu92

Chỉ huấn luyện lớp chiếu: Mở rộng đa phương thức cho LLM mà không làm mất khả năng vốn có

Nghiên cứu mới đề xuất phương pháp chỉ huấn luyện lớp kết nối giữa encoder và mô hình ngôn ngữ, giúp bổ sung đa phương thức mà không cần tinh chỉnh toàn bộ tham số, vừa tăng tốc độ huấn luyện vừa bảo toàn hiệu suất gốc của mô hình.

LLMĐa phương thứcMachine LearningTối ưu hóaNghiên cứu AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu92

ReWorld: Mô hình thế giới tương tác với khả năng ghi nhớ dài hạn

ReWorld tối ưu hóa mô hình thế giới bằng cách tách biệt điều khiển và bộ nhớ, cho phép xử lý video thời gian thực với độ chính xác cao và khả năng ghi nhớ lịch sử dài hạn vượt trội so với các mô hình hiện nay.

Mô hình thế giớiAI tương tácBộ nhớ dài hạnThị giác máy tínhNghiên cứu AI
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Sản phẩm92

Prime Agent: Framework AI tự cải tiến giúp đột phá hiệu suất lập trình và giải thuật

Prime Agent là framework mã nguồn mở tối ưu hóa quy trình làm việc cho AI Agent, giúp nâng cao khả năng xử lý ngữ cảnh và tính toán thông qua IPython REPL bền vững, đạt kết quả ấn tượng trong các bài kiểm tra ARC-AGI và lập trình chuyên sâu.

AI AgentLập trìnhTự động hóaNghiên cứu AIFramework

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (56 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả