Anthropic công bố AI Claude đã tự phát hiện một hệ enzyme mới với các đặc tính sinh học tương đồng với bộ máy chỉnh sửa gene CRISPR, mở ra tiềm năng mới trong nghiên cứu khoa học.
Wild stuff. Anthropic's new wet lab got its first win after 949 Claude agents autonomously tracked d…
DịchAnthropic ghi dấu ấn với phòng thí nghiệm ướt đầu tiên: 949 Claude agent đã tự chủ nghiên cứu, quét 1,94 tỷ cụm protein và phát hiện thành công hệ enzyme ART mới trong thực khuẩn thể chỉ sau 21,5 giờ.
Anthropic chứng minh Claude có thể tự tối ưu hóa các mô hình khoa học với tốc độ nhanh gấp 4 lần. Cùng lúc đó, dự án ScienceIDE ra mắt nhằm biến kho mã nguồn khoa học thế giới thành môi trường học tập cho các tác nhân AI.
Vì sao đáng đọc: Tin tức đột phá về khả năng tự tối ưu hóa mã nguồn của AI trong lĩnh vực khoa học, kết hợp với hạ tầng mới cho AI nghiên cứu, có tác động lớn đến tương lai của R&D.
16/09
Thứ Tư · 2 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
ScienceBuddy là nền tảng nghiên cứu khoa học sử dụng cơ chế tự cải tiến đệ quy, kết hợp giữa tối ưu hóa công cụ và huấn luyện mô hình để giải quyết các tác vụ khoa học phức tạp một cách tự động.
This is really cool. PhAI Labs just released DFM (Discovery Foundation Models), a research paradigm…
DịchPhAI Labs công bố báo cáo kỹ thuật về Discovery Foundation Models (DFM), hướng tới hệ thống AI có khả năng tự đặt giả thuyết, thiết kế thí nghiệm và tinh chỉnh kiến thức khoa học. Dự án hiện đang mở rộng hợp tác với các cộng đồng nghiên cứu và phòng thí nghiệm thực tế.
We solved Navier-Stokes! Many of my colleagues left their fields because they believed that working…
DịchOpenAI vừa công bố lời giải cho bài toán Navier-Stokes tồn tại 90 năm qua nhờ thế hệ mô hình AI mới vượt xa GPT-6. Thành tựu này khẳng định vai trò của AI trong việc chinh phục các thách thức khoa học vĩ đại nhất nhân loại.
Of all the use cases for GPT-6 Astra, I'm most excited for scientific discovery. We at @OpenAI have …
DịchOpenAI công bố kho lưu trữ PrimeGaps186, trong đó GPT-6 Astra đã sử dụng ngôn ngữ Lean để chứng minh sự tồn tại vô hạn các cặp số nguyên tố có khoảng cách không quá 186, đánh dấu bước tiến mới trong ứng dụng AI vào toán học chuyên sâu.
Anthropic's Tom Brown: "My prediction is that within the next 12 months, AI could become a once-in-a…
DịchTom Brown từ Anthropic nhận định AI sắp đạt bước tiến đột phá, đóng vai trò như một nhà khoa học kiệt xuất trong các lĩnh vực then chốt. Đây là minh chứng cho thấy sự phát triển của AI mới chỉ bắt đầu và chưa hề có dấu hiệu chững lại.
New Google paper shows that autonomous AI research can go badly wrong even when the final paper look…
DịchNghiên cứu mới từ Google DeepMind giới thiệu mô-đun Co-Scientist giúp tăng độ tin cậy cho Gemini, giảm đáng kể tỷ lệ sai lệch dữ liệu trong các công trình nghiên cứu khoa học.
Anthropic giới thiệu hệ thống MHS, cho phép AI không chỉ phân tích dữ liệu mà còn trực tiếp điều khiển thiết bị để kiểm chứng giả thuyết khoa học trong thực tế.
Vì sao đáng đọc: Đây là bước tiến đột phá khi AI chuyển từ lý thuyết sang thực hành vật lý, có tiềm năng thay đổi hoàn toàn phương pháp nghiên cứu khoa học truyền thống.
Impressive new paper from Google DeepMind. (bookmark it) It takes Co-Scientist out of simulation a…
DịchAI Co-Scientist của Google DeepMind đã chứng minh khả năng thực nghiệm vượt trội, từ việc tối ưu hóa kiến trúc AI đến dự đoán chính xác kiểu hình vi khuẩn, đồng thời giảm thiểu đáng kể tình trạng ảo giác và đạo văn.
FrontierChallenge là bộ tiêu chuẩn đánh giá mới với 300 quy trình khoa học đa lĩnh vực, cho thấy các mô hình AI hiện nay vẫn gặp khó khăn lớn khi chỉ hoàn thành khoảng 20% nhiệm vụ thực tế.
The race to build "AI Scientists" may be optimizing for the wrong unit: the agent alone. This posit…
DịchNghiên cứu mới đề xuất đánh giá các tác nhân AI khoa học dựa trên hiệu quả cộng tác với con người thay vì khả năng tự chủ. Kết quả cho thấy sự kết hợp giữa chuyên gia và AI mang lại kết quả vượt trội hơn hẳn so với việc để AI tự thực hiện đơn lẻ.
Anthropic published one of its most ambitious scientific experiments with Claude yet. Anthropic sho…
DịchAnthropic đã để Claude tự chủ hoàn toàn quy trình thiết kế protein mà không cần sự can thiệp của con người. Kết quả cho thấy tỷ lệ thành công đạt 26,8%, vượt trội hơn các phương pháp truyền thống trong nhiều mục tiêu thử nghiệm.
Nghiên cứu giới thiệu bộ dữ liệu ALD/E-ImageMiner giúp AI hiểu và trích xuất thông tin từ biểu đồ, bảng biểu khoa học, đặt nền móng cho khả năng suy luận hình ảnh chuyên sâu trong nghiên cứu.
A 27B research agent outscored Claude Opus 4.8 and GPT-5.5 on held-out paper replication by learning…
DịchFaraday 27B là mô hình AI chuyên biệt cho nghiên cứu khoa học, sở hữu khả năng tự điều phối và lập trình. Nó đã xuất sắc vượt qua các đối thủ sừng sỏ như Claude Opus 4.8 và GPT-5.5 trong 68 tác vụ khoa học phức tạp.
OmniScientist là AI khoa học đầu tiên xử lý trực tiếp dữ liệu thô đa phương thức (hình ảnh, âm thanh, 3D, bảng biểu) để tự động hoàn thiện quy trình nghiên cứu từ dữ liệu đến bài báo khoa học hoàn chỉnh trên nhiều lĩnh vực.
Intern-S2-Preview là dòng mô hình nền tảng đa phương thức chuyên dụng cho nghiên cứu khoa học, hỗ trợ suy luận phức tạp và xử lý chuỗi thời gian dài với hiệu suất vượt trội trên nhiều tiêu chuẩn đánh giá.