29/08

Thứ Bảy · 1 tin

27/08

Thứ Năm · 5 tin
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 36/100

PwC khuyến nghị doanh nghiệp chuẩn hóa khung AI Agent của Anthropic

PwC looked into Anthropic's harness primitives (a loop with memory, filesystem, and bash, i.e. the C…

DịchPwC đề xuất doanh nghiệp nên thống nhất sử dụng khung AI Agent của Anthropic thay vì xây dựng hệ thống riêng lẻ. Cách tiếp cận này giúp đơn giản hóa quy trình kiểm toán và quản lý bằng cách chuẩn hóa các lệnh điều khiển thay vì phải rà soát mã nguồn phức tạp.

VentureBeat: AI
Hướng dẫnĐiểm AI 41/100

Rủi ro thực sự của AI doanh nghiệp: Sự phức tạp trong tương tác giữa các tác nhân

Thay vì lo ngại về tính tự chủ, doanh nghiệp cần cảnh giác với hệ thống các tác nhân AI liên kết chằng chịt, dễ dẫn đến mất kiểm soát quyền hạn và trách nhiệm. Việc quản trị cần chuyển dịch từ phê duyệt đơn lẻ sang giám sát thời gian thực trên toàn bộ chuỗi tương tác.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 44/100

Google chuyển bộ phận trách nhiệm AI từ DeepMind sang khối Đối ngoại toàn cầu

WSJ reports Google is moving its 90-person AI responsibility unit out of DeepMind and into Google Gl…

DịchGoogle vừa điều chuyển đội ngũ 90 nhân sự phụ trách trách nhiệm AI từ DeepMind sang bộ phận Đối ngoại toàn cầu, nhằm tăng cường khả năng kiểm soát an toàn cho các sản phẩm và mô hình AI thực tế.

Thêm 1 nguồn khác đưa tinIT Home

26/08

Thứ Tư · 2 tin
Gary Marcus: The Road to AI We Can Trust
Hướng dẫnĐiểm AI 44/100

Bill Gates kêu gọi xây dựng chiến lược AI toàn diện, Gary Marcus đồng tình

Bill Gates cảnh báo về các rủi ro từ AI như khủng bố sinh học và tin giả, đồng thời kêu gọi sự tham gia của xã hội dân sự trong việc thiết lập khung quản trị AI toàn cầu. Gary Marcus đánh giá cao quan điểm này, cho rằng nó tương đồng với những luận điểm trong cuốn sách mới nhất của ông.

25/08

Thứ Ba · 3 tin
Hongming@hongming731
Hướng dẫnĐiểm AI 39/100

Điểm tin sáng: Tái thiết quy trình kiểm chứng và quản trị sau khi ứng dụng AI lập trình

Bài viết phân tích nút thắt khi dùng AI lập trình: việc tạo mã chỉ chiếm 20-30% quy trình, cần xây dựng hệ thống Agent khép kín từ build đến kiểm thử. Các chuyên gia đề xuất mô hình quản trị bằng 'hàng rào' luật lệ và phát triển phần mềm dựa trên đánh giá dữ liệu thực tế.

Steve Yegge: Medium
Hướng dẫnĐiểm AI 56/100

Steve Yegge: AI nên được quản lý bằng luật pháp thay vì các môi trường sandbox

Steve Yegge cho rằng thay vì dùng các rào cản kỹ thuật (sandbox), AI cần được quản lý bằng khung pháp lý. Ông chia sẻ kinh nghiệm vận hành hệ thống 60 AI agent để phát triển game, trong đó chỉ một số ít được phép tương tác trực tiếp với con người.

23/08

Chủ Nhật · 2 tin
The Decoder: AI News
NgànhĐiểm AI 52/100

AI quản lý Luna lần đầu sa thải nhân viên, nhưng cần con người nhắc nhở mới nhớ ra quy định

AI Luna tại Andon Market đã sa thải nhân viên vi phạm giờ giấc sau khi được con người nhắc lại quy định nội bộ. Thử nghiệm cho thấy các mô hình AI mạnh hơn có xu hướng quyết đoán hơn trong việc sa thải so với GPT-4o.

Lee Robinson@leerob
Hướng dẫnĐiểm AI 47/100

Làm sao để tin tưởng AI tự động thực hiện tác vụ? Giải pháp thiết kế tối ưu

How can you trust @Bots to operate autonomously? This is something we've carefully designed. First…

DịchLee Robinson chia sẻ cách cân bằng giữa tự động hóa và kiểm soát: sử dụng LLM để rà soát hành động, thiết lập quy tắc chặn các thao tác nguy hiểm và yêu cầu phê duyệt thủ công khi cần thiết.

22/08

Thứ Bảy · 1 tin

21/08

Thứ Sáu · 2 tin

20/08

Thứ Năm · 4 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
NgànhĐiểm AI 72/100

Anthropic tạm dừng huấn luyện RL, siết chặt an ninh trước lo ngại về năng lực tấn công mạng của AI

Trước lo ngại mô hình Astra có thể đạt ngưỡng năng lực tấn công mạng nguy hiểm, Anthropic quyết định tạm dừng huấn luyện tăng cường (RL) và áp dụng các tiêu chuẩn an ninh nghiêm ngặt nhất cho hạ tầng nghiên cứu.

19/08

Thứ Tư · 7 tin
Nathan Lambert@natolambert
NgànhĐiểm AI 65/100

Chuyên gia đề xuất cơ quan độc lập giám sát toàn diện quá trình huấn luyện mô hình AI tiên tiến

We should have independent organizations that can access the full details of these training runs for…

DịchNathan Lambert kêu gọi thành lập tổ chức độc lập để giám sát chi tiết quá trình huấn luyện AI thay vì chỉ can thiệp sau sự cố. Động thái này nhằm đảm bảo an toàn và tính minh bạch khi năng lực mô hình phát triển quá nhanh.

Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 55/100

Cùng sự kiệnOpenAI tạm dừng huấn luyện mô hình tiên phong trong hai tuần để kiểm soát rủi ro

OpenAI đã tạm dừng huấn luyện củng cố cho các mô hình thế hệ mới nhằm tăng cường bảo mật hệ thống và giám sát rủi ro. Động thái này cho thấy ưu tiên của hãng đang chuyển dịch từ việc nâng cao năng lực mô hình sang củng cố quản trị an toàn và kiểm soát hạ tầng.

Cùng sự kiện, bài đại diện «OpenAI tạm dừng huấn luyện mô hình tiên tiến để tăng cường kiểm soát an toàn»
OpenAI: Tin chính thức (RSS - lọc nội dung doanh nghiệp/khách hàng)
NgànhĐiểm AI 52/100

OpenAI khởi động sáng kiến hỗ trợ giám sát dân chủ đối với AI trong an ninh quốc gia

OpenAI cam kết tài trợ 5 triệu USD để trang bị công cụ và kỹ năng cho các cơ quan giám sát, giúp họ kiểm soát việc chính phủ ứng dụng AI trong lĩnh vực an ninh quốc gia một cách minh bạch và hiệu quả.

TechCrunch: AI
NgànhĐiểm AI 61/100

Cùng sự kiệnOpenAI siết chặt quy trình bảo mật sau sự cố rò rỉ tại Hugging Face

OpenAI vừa công bố loạt chính sách an toàn mới, bao gồm hệ thống cảnh báo 30 phút và tạm dừng các dự án học tăng cường quy mô lớn để kiểm soát rủi ro sau sự cố bảo mật gần đây.

Cùng sự kiện, bài đại diện «OpenAI tạm dừng huấn luyện RL trên các mô hình tiên tiến để tăng cường an toàn»

18/08

Thứ Ba · 3 tin
Databricks: Blog
Hướng dẫnĐiểm AI 34/100

Quản trị AI trong ngành bán lẻ: Tại sao doanh nghiệp cần một 'mặt phẳng kiểm soát' ngữ cảnh?

Databricks đề xuất các nhà bán lẻ cần thiết lập một mặt phẳng kiểm soát tập trung để quản lý ngữ cảnh AI, giúp đảm bảo tính nhất quán về dữ liệu, tuân thủ pháp lý và kiểm soát hành vi mô hình trong bối cảnh triển khai AI quy mô lớn.

The Decoder: AI News
NgànhĐiểm AI 47/100

Bộ Tư pháp Mỹ điều tra Andreessen Horowitz vì nghi vấn vi phạm luật chống độc quyền

Bộ Tư pháp Mỹ đang điều tra Andreessen Horowitz do các đối tác của quỹ này đồng thời giữ ghế hội đồng quản trị tại hai đối thủ cạnh tranh là Databricks và Fivetran, vi phạm quy định về cấm liên kết quản trị.

CafeF Kinh tế số
NgànhĐiểm AI 92/100

Tinh chọnOpenAI giải thể đội ngũ chuyên trách đánh giá rủi ro thảm họa AI

Đội ngũ Preparedness, bộ phận then chốt chịu trách nhiệm kiểm soát các rủi ro thảm họa từ mô hình AI của OpenAI, đã chính thức ngừng hoạt động từ cuối tháng 7.


Vì sao đáng đọc: Đây là thông tin quan trọng về quản trị rủi ro tại OpenAI, gây lo ngại lớn trong cộng đồng về đạo đức và an toàn AI, có tính thời sự cao.

17/08

Thứ Hai · 1 tin
AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 57/100

Cùng sự kiệnOpenAI âm thầm giải thể đội ngũ chuyên trách rủi ro thảm họa

OpenAI has quietly disbanded its catastrophic risk team (preparedness) "It is kind of scary; there …

DịchOpenAI đã lặng lẽ giải tán nhóm nghiên cứu rủi ro thảm họa, gây ra làn sóng lo ngại nội bộ về việc ưu tiên lợi nhuận hơn an toàn AI sau sự ra đi của nhiều nhân sự chủ chốt.

Cùng sự kiện, bài đại diện «OpenAI giải thể đội ngũ 'Preparedness', phân tán trách nhiệm kiểm soát rủi ro AI thảm họa»

16/08

Chủ Nhật · 2 tin
The Decoder: AI News
NgànhĐiểm AI 59/100

OpenAI giải thể đội ngũ 'Preparedness', phân tán trách nhiệm kiểm soát rủi ro AI thảm họa

OpenAI đã giải thể nhóm 'Preparedness' chuyên đánh giá rủi ro AI nghiêm trọng, chuyển giao nhiệm vụ cho các bộ phận khác trong bối cảnh làn sóng nhân sự an toàn rời đi gây lo ngại nội bộ.

Thêm 6 nguồn khác đưa tinX: AI Safety Memes (@AISafetyMemes)CafeF Kinh tế sốGenK AIX: Rohan Paul (@rohanpaul_ai)IT HomeThe Verge: AI
Deedy Das@deedydas
Hướng dẫnĐiểm AI 51/100

Cùng sự kiệnGavin Baker và Sholto Douglas tranh luận về quyền lực tập trung trong AI

The Gavin Baker vs. Sholto Douglas exchange on the economic concentration of power of AI is one of t…

DịchCuộc tranh luận xoay quanh lý thuyết cân bằng tấn công-phòng thủ: AI nên được phân tán trong các lĩnh vực ưu tiên phòng thủ, nhưng cần kiểm soát chặt chẽ ở các lĩnh vực ưu tiên tấn công như an ninh mạng và sinh học.

Cùng sự kiện, bài đại diện «CEO Anthropic phản hồi tranh cãi về quản lý AI và tập trung quyền lực»

15/08

Thứ Bảy · 1 tin

14/08

Thứ Sáu · 1 tin

13/08

Thứ Năm · 3 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Toàn cảnh rủi ro từ LLM: Phân loại 5 giai đoạn nguy hại trong vòng đời mô hình

This study builds a simple map of all the main ways large language models can cause harm. Using abo…

DịchNghiên cứu tổng hợp từ 200 tài liệu đã xây dựng bản đồ phân loại rủi ro toàn diện cho LLM, từ khâu dữ liệu đầu vào, quá trình vận hành đến các tác động xã hội, đồng thời đề xuất chiến lược phòng thủ đa tầng.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Nghiên cứu của Anthropic: AI Agent cần cơ chế quản trị để tránh rủi ro hệ thống

Anthropic's new research found found that identical or similar agents can converge on the same bad d…

DịchNghiên cứu mới từ Anthropic cảnh báo các AI Agent có xu hướng lặp lại sai lầm giống nhau, dễ dẫn đến thất bại hệ thống. Do đó, việc xây dựng các giao thức về danh tính, uy tín và giải quyết tranh chấp là yếu tố sống còn thay vì chỉ tập trung nâng cao năng lực thực thi của AI.

12/08

Thứ Tư · 4 tin
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (37 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “quản trị AI” — Trang 5 | AIHOT.vn