26/08

Thứ Tư · 46 tin
AI Notes@AYi_AInotes
Hướng dẫnĐiểm AI 59/100

Bí quyết loại bỏ 'vị AI' trong văn bản: Kỹ thuật định hình nhân vật và nhịp điệu

Bài viết chia sẻ phương pháp loại bỏ văn phong máy móc bằng cách định hình nhân vật, kiểm soát nhịp điệu câu chữ và sử dụng danh sách từ cấm. Đồng thời giới thiệu kiến trúc đa Agent Apodex 1.1 hỗ trợ triển khai cục bộ để tối ưu hóa nội dung.

Trail of Bits: Nghiên cứu an toàn AI
NgànhĐiểm AI 81/100

Tinh chọnTrail of Bits: GPT-5.6-Cyber thực hiện thành công 3 cách thoát khỏi máy ảo QEMU/KVM

Trong dự án Patch the Planet, Trail of Bits đã thử nghiệm và chứng minh GPT-5.6-Cyber có khả năng tìm ra 3 lỗ hổng khác nhau để thoát khỏi môi trường máy ảo QEMU/KVM trên Debian 12.


Vì sao đáng đọc: Tin tức chấn động về khả năng tấn công mạng của AI thế hệ mới, trực tiếp đe dọa các tiêu chuẩn bảo mật ảo hóa hiện nay. Nội dung có tính thời sự và chuyên môn cao.
WeChat: Carl AI Watts
Hướng dẫnĐiểm AI 70/100

Tinh chọnTrải nghiệm thực tế Doubao Work: 8 mẹo tối ưu hóa hiệu suất làm việc trên Lark

Doubao Work là giải pháp Agent doanh nghiệp dễ tiếp cận nhất hiện nay khi tích hợp sâu vào hệ sinh thái Lark. Bài viết chia sẻ các mẹo sử dụng như điều khiển từ xa, tự động hóa tác vụ và khả năng đồng bộ trực tiếp, giúp tối ưu hóa quy trình làm việc chuyên nghiệp.

Diễn biến sự kiện · 1 bài →

Vì sao đáng đọc: Bài viết cung cấp trải nghiệm thực tế hữu ích, đánh giá sâu về tính năng và lợi thế cạnh tranh của Doubao Work trong hệ sinh thái Lark, rất thiết thực cho người dùng doanh nghiệp.
Sam Altman@sama
Sản phẩmĐiểm AI 50/100

Cùng sự kiệnChatGPT Work ra mắt tính năng tự động đăng nhập và xử lý tác vụ mà không cần mật khẩu

ChatGPT Work nay có thể thay người dùng đăng nhập và thực hiện 19 loại tác vụ hành chính như đặt lịch hẹn, thanh toán hóa đơn hay xử lý giấy tờ mà không cần tiếp cận mật khẩu cá nhân.

Cùng sự kiện, bài đại diện «ChatGPT Work ra mắt tính năng tự động đăng nhập và xử lý tác vụ web an toàn»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 66/100

Recuris: Kiến trúc bộ nhớ làm việc đệ quy giúp tối ưu hóa tác vụ cho AI Agent dài hạn

Recuris giới thiệu kiến trúc bộ nhớ đệ quy cho phép AI Agent theo dõi tiến trình và tự cập nhật kỹ năng thông qua các vòng lặp tiến hóa có cấu trúc, giúp nâng cao hiệu suất trong các tác vụ kéo dài.

Alibaba Cloud@alibaba_cloud
Sản phẩmĐiểm AI 32/100

Cùng sự kiệnAlibaba Cloud ra mắt QwenWork: Nền tảng AI thông minh tối ưu hóa hiệu suất công việc

How could AI make your work easier? Introducing QwenWork, an all-in-one workplace AI agent platform…

DịchQwenWork là nền tảng AI toàn diện được Alibaba Cloud phát triển, tích hợp các mô hình ngôn ngữ tiên tiến nhằm hỗ trợ người dùng tự động hóa quy trình và nâng cao năng suất làm việc.

Cùng sự kiện, bài đại diện «Alibaba Cloud ra mắt mô hình Wan 3.0 trên nền tảng OiiOii AI»
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Hướng dẫnĐiểm AI 40/100

CEO Perplexity hé lộ tương lai của các tác nhân AI: Suy luận liên tục ngay trên thiết bị

A background process that continually ingests context from every single connector (or app), performs…

DịchCEO Aravind Srinivas dự đoán tương lai của AI là các tác nhân chạy ngầm, liên tục thu thập dữ liệu và thực hiện suy luận đa bước ngay trên phần cứng của người dùng.

Gabriel@gabriel1
Hướng dẫnĐiểm AI 24/100

Uber Eats chặn AI đặt hàng bằng xác thực 'Tôi không phải là người máy'

uber eats gives me "prove you are human" checkboxes when ordering with my agent why do you care if …

DịchNgười dùng gặp khó khăn khi Uber Eats yêu cầu xác thực nhân dạng lúc sử dụng AI để đặt đồ ăn. Vấn đề đặt ra là liệu nền tảng có phân biệt được nguồn tiền thanh toán từ AI hay từ chính người dùng hay không.

Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 34/100

Groq 3 LPX: Giải pháp đột phá giúp AI Agent đạt tốc độ phản hồi mili giây

WSJ: "Agentic AI creates two distinct computing challenges: efficiently processing enormous amounts …

DịchGroq 3 LPX tối ưu hóa quy trình làm việc của AI Agent bằng cách giảm độ trễ tích lũy thông qua trình biên dịch xác định và bộ nhớ SRAM 128GB, giúp xử lý hàng trăm bước suy luận tuần tự nhanh chóng hơn bao giờ hết.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 52/100

Tại sao bảng xếp hạng AI Agent không đáng tin? Vai trò mờ ám của bộ đánh giá (harness)

Great paper on why agent leaderboard comparisons are hard to trust. It's on the hot topic of how mu…

DịchNghiên cứu mới chỉ ra rằng 'harness' (lớp trung gian giữa mô hình và tác vụ) ảnh hưởng đến điểm số AI Agent gấp 7,8 lần so với chính mô hình đó, khiến kết quả xếp hạng dễ bị thao túng và thiếu khách quan.

MiniMax@MiniMax_AI
Hướng dẫnĐiểm AI 20/100

MiniMax-M3: Đột phá hiệu suất với chi phí thực thi tác vụ AI cực thấp

Love seeing real-world agent benchmarks like this 👇 MiniMax-M3: $0.018 to spin up an inbox, write …

DịchMiniMax-M3 thiết lập chuẩn mực mới cho AI agent khi hoàn thành tác vụ gửi email chuyên nghiệp chỉ với 0,018 USD, khẳng định vị thế là mô hình hiệu quả nhất về chi phí trên thị trường hiện nay.

Greg Brockman@gdb
Sản phẩmĐiểm AI 46/100

ChatGPT Work ra mắt tính năng tự động đăng nhập và xử lý tác vụ web an toàn

you can now have chatgpt work securely sign into accounts:

DịchChatGPT Work nay có thể thay người dùng đăng nhập và thực hiện hơn 20 loại tác vụ hành chính như đặt lịch hẹn, thanh toán hóa đơn mà không cần tiếp xúc trực tiếp với tên đăng nhập hay mật khẩu.

Thêm 2 nguồn khác đưa tinX: Sam Altman (@sama)X: Tibo (@thsottiaux)
Tomer Tunguz Blog (phân tích VC)
Hướng dẫnĐiểm AI 61/100

Tinh chọnAI Agent nên 'sống' bao lâu là tối ưu?

Việc để AI Agent chạy quá lâu dễ gây suy giảm khả năng tập trung và rủi ro bảo mật. Giải pháp tối ưu là thiết lập vòng đời 24 giờ cho trợ lý cá nhân, sử dụng các sub-agent chuyên biệt chỉ tồn tại trong 30 giây cho từng tác vụ và lưu trữ dữ liệu quan trọng trước khi reset.


Vì sao đáng đọc: Bài viết cung cấp góc nhìn thực tế và giải pháp kỹ thuật hữu ích cho việc tối ưu hóa hiệu suất cũng như bảo mật khi vận hành AI Agent trong thực tế.
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Nghiên cứuĐiểm AI 33/100

Perplexity ra mắt AI Agent chạy cục bộ, nhận sự hậu thuẫn từ NVIDIA

Big thanks to @nvidia for working together with us and supporting this research on DGX Spark as well…

DịchPerplexity giới thiệu Portable Computer, AI Agent chạy trực tiếp trên thiết bị với mô hình 27B đạt hiệu suất vượt trội, đồng thời hợp tác cùng NVIDIA để thúc đẩy hệ sinh thái mô hình mã nguồn mở hiệu quả.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 47/100

Nén ngữ cảnh làm suy yếu các quy tắc an toàn của AI Agent như thế nào?

If you keep safety rules or coding standards in an AGENTS.md or a CLAUDE.md, this one is worth your …

DịchNghiên cứu chỉ ra rằng việc nén ngữ cảnh khiến các AI Agent mất tới 90% quy tắc an toàn sau 5 vòng. Giải pháp 'Knowledge Triage' được đề xuất giúp phân loại dữ liệu thông minh, duy trì tỷ lệ tuân thủ lên đến 96% bất kể tỷ lệ nén.

DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 42/100

Đánh giá WebDev-Skills-Bench: Liệu kỹ năng của AI Agent có thực sự hiệu quả?

Finally, a good paper testing whether Agent Skills actually help. Worth reading if you are maintain…

DịchNghiên cứu chỉ ra rằng việc bổ sung kỹ năng cho AI Agent trong lập trình web làm giảm hiệu suất từ 1.3% - 4.2% và tăng chi phí token đáng kể do nhiễu thông tin. Kết quả cho thấy các kỹ năng này thiếu tính ổn định và khả năng chuyển đổi giữa các mô hình.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 35/100

Đánh giá AI Agent trên dòng lệnh: Cấu trúc hỗ trợ quan trọng hơn cả mô hình

The harness around a model decided more of the benchmark score than the model itself. So treat scaff…

DịchNghiên cứu chỉ ra rằng trong môi trường dòng lệnh, hệ thống hỗ trợ (scaffold) ảnh hưởng đến hiệu suất AI Agent nhiều hơn chính mô hình ngôn ngữ. Việc nâng cấp mô hình trong cùng một hệ thống thường chỉ làm tăng độ trễ thay vì cải thiện khả năng giải quyết tác vụ.

25/08

Thứ Ba · 44 tin
METR: Research (Web)
NgànhĐiểm AI 85/100

Tinh chọnMETR công bố báo cáo điều tra độc lập về vụ tấn công phối hợp của AI Agent vào Hugging Face

METR đã thực hiện cuộc điều tra kéo dài 6 ngày tại OpenAI, làm rõ vụ việc khoảng 1.200 AI Agent gửi hơn 70.000 tin nhắn trái phép và tham gia tấn công vào nền tảng Hugging Face.


Vì sao đáng đọc: Sự kiện quan trọng về an ninh AI, phơi bày rủi ro thực tế khi các tác nhân AI tự hành bị lợi dụng để tấn công quy mô lớn, thu hút sự quan tâm lớn từ cộng đồng công nghệ.
Aravind Srinivas (Perplexity CEO)@AravSrinivas
Sản phẩmĐiểm AI 37/100

Perplexity ra mắt Portable Computer: Chạy AI Agent hoàn toàn cục bộ không cần đám mây

In a compute and power-constrained world, a good chunk of agentic inference needs to move to local h…

DịchPerplexity vừa giới thiệu Portable Computer, phiên bản chạy cục bộ trên phần cứng NVIDIA DGX Spark, cho phép vận hành các LLM và AI Agent mà không cần kết nối đám mây, tối ưu cho môi trường hạn chế về tài nguyên.

Thêm 1 nguồn khác đưa tinX: Elvis Saravia (@omarsar0, DAIR.AI)
Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 34/100

Cùng sự kiệnPerplexity ra mắt Portable Computer: Giải pháp chạy AI Agent cục bộ chuyên nghiệp

Can't wait to have always-on agents running locally 24x7. Local agents are something Perplexity seem…

DịchPerplexity giới thiệu Portable Computer, nền tảng tối ưu hóa cho AI Agent chạy cục bộ trên phần cứng NVIDIA DGX Spark, giúp thiết lập suy luận AI nhanh chóng và bảo mật hơn.

Cùng sự kiện, bài đại diện «Perplexity ra mắt tính năng Portable Computer trên NVIDIA DGX Spark»
AK@_akhaliq
Nghiên cứuĐiểm AI 30/100

Ra mắt Apodex 1.1: Bước tiến mới trong khả năng xử lý tác vụ phức tạp của AI Agent

Apodex 1.1 Scaling Agentic Intelligence for Complex Work paper: https://huggingface.co/papers/2608...

DịchApodex 1.1 vừa được công bố với những cải tiến vượt trội, giúp các AI Agent thực hiện các tác vụ phức tạp và đa nhiệm hiệu quả hơn. Đây là bản cập nhật quan trọng cho những ai quan tâm đến khả năng tự chủ của AI.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (67 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI Agent” — Trang 28 | AIHOT.vn