Hôm qua · 03/09

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Tin ngành85

Hệ thống AI AISLE phát hiện 6 lỗ hổng CVE trong curl, vượt mặt OpenAI và Anthropic

Sau khi các mô hình của OpenAI và Anthropic không tìm thấy lỗi, hệ thống AI tự hành AISLE đã phân tích và phát hiện 6 lỗ hổng bảo mật trong curl. Tất cả các lỗ hổng mức độ thấp này đã được xác nhận và khắc phục trong phiên bản curl 8.22.0.

AI tự hànhBảo mậtcurlLỗ hổng bảo mậtAISLE

T4 · 02/09

Google AI: DEV
Thủ thuật92

Tinh chọnGoogle chia sẻ cách viết tiêu chí đánh giá chuẩn xác cho mô hình LLM-as-a-Judge

Google hướng dẫn cách xây dựng bộ tiêu chí đánh giá (rubric) cho LLM-as-a-Judge, giúp giảm thiểu sự mơ hồ và lãng phí token. Bài viết nhấn mạnh việc chia nhỏ câu hỏi, tập trung vào dữ kiện khách quan và sử dụng bộ dữ liệu chuẩn để hiệu chỉnh mô hình đạt độ chính xác tương đương con người.

LLMĐánh giá AIGoogle AIKỹ thuật PromptPhát triển AI
ZHO@ZHO_ZHO_ZHO
Thủ thuật85

Zho ra mắt video AI '': Màn tri ân Ghost in the Shell đầy nghệ thuật với hiệu ứng chữ Hán

Tác giả Zho vừa trình làng video AI lấy cảm hứng từ 'Ghost in the Shell', sử dụng các khối chữ Hán làm hiệu ứng chuyển cảnh độc đáo. Tác phẩm mượn ý thơ trong 'Hoa Kính' để suy ngẫm về mối quan hệ giữa trí tuệ nhân tạo và nhân loại.

AI VideoGhost in the ShellNghệ thuật AISáng tạo nội dungZho
Google DeepMind: Blog· 2 nguồn
Sản phẩm92

Google DeepMind ra mắt chương trình Fairwind: Dùng AI tự động vá lỗ hổng bảo mật trong vài phút

Google DeepMind giới thiệu chương trình Fairwind, cung cấp mô hình Gemini 3.8 Flash Cyber và công cụ CodeMender giúp chính phủ và doanh nghiệp tự động phát hiện, xác thực và vá lỗi bảo mật ngay trong môi trường đám mây.

An ninh mạngGoogle DeepMindBảo mật AIGeminiCông nghệ doanh nghiệp
HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
Nghiên cứu85

DramaChain Bench: Bộ tiêu chuẩn đánh giá toàn diện quy trình sản xuất phim ngắn bằng AI

DramaChain Bench là bộ tiêu chuẩn đầu tiên đánh giá toàn bộ quy trình làm phim ngắn từ kịch bản đến thành phẩm. Nghiên cứu chỉ ra rằng chất lượng phim không chỉ phụ thuộc vào video mà còn chịu ảnh hưởng dây chuyền từ các lỗi ở khâu tiền kỳ.

AI tạo sinhSản xuất videoĐánh giá AIPhim ngắnNghiên cứu AI
Elvis Saravia@omarsar0· 3 nguồn
Nghiên cứu85

Harness-of-Harness: Khung phát triển phần mềm tự chủ đa ngày với hiệu suất tăng 52,25%

Các nhà nghiên cứu tại Thượng Hải giới thiệu Harness-of-Harness (HoH), khung làm việc cho phép các tác nhân AI tự động lập kế hoạch, viết mã và kiểm thử lặp đi lặp lại để phát triển phần mềm mà không cần sự can thiệp của con người.

AI tự chủPhát triển phần mềmCoding AgentNghiên cứu AI
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Nghiên cứu92

Nghiên cứu: 3 trang web tạo ra hơn 215.000 bài viết 'phần mềm tốt nhất' để thao túng Perplexity

Một nghiên cứu cho thấy Perplexity thường xuyên trích dẫn các nguồn tin kém chất lượng, với gần 60% dẫn chứng đến từ các trang web vô danh được tạo ra hàng loạt nhằm thao túng kết quả tìm kiếm AI.

PerplexityAIThao túng dữ liệuTìm kiếm AITin giả

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (45 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả