03/09

Thứ Năm · 131 tin
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 52/100

FM-Bench: Thử thách 15 mô hình AI quản lý câu lạc bộ bóng đá trong 20 mùa giải

Current agent benchmarks may be ending before the real failures start. FM-Bench shows that a model …

DịchNghiên cứu FM-Bench đánh giá khả năng ra quyết định dài hạn của 15 mô hình AI hàng đầu thông qua việc quản lý câu lạc bộ bóng đá trong 20 mùa giải, bao gồm các nhiệm vụ phức tạp như chuyển nhượng, hợp đồng và đầu tư tài chính.

Emad Mostaque@EMostaque
Mô hìnhĐiểm AI 49/100

Meta có đang trở thành phòng thí nghiệm AI tiên phong hàng đầu?

Cựu CEO Stability AI, Emad Mostaque, đặt nghi vấn về vị thế của Meta trong cuộc đua AI, gợi mở khả năng tập đoàn này đang dẫn đầu các nghiên cứu đột phá thay vì các phòng thí nghiệm chuyên biệt.

Thêm 1 nguồn khác đưa tinX: Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI) (@alexandr_wang)
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Mô hìnhĐiểm AI 66/100

Meta Muse Spark 1.3 đạt 62 điểm trên Artificial Analysis, hiệu năng vượt trội với chi phí cực thấp

try muse spark 1.3 -- frontier performance at a fraction of the cost!

DịchMuse Spark 1.3 của Meta đạt 62 điểm, ngang bằng Claude Fable 5 và vượt qua nhiều đối thủ mạnh, trong khi chi phí vận hành rẻ hơn gấp nhiều lần, đưa Meta vào nhóm dẫn đầu về mô hình AI.

Diễn biến sự kiện · 5 bài →
Kim@kimmonismus
Mô hìnhĐiểm AI 78/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Hiệu năng tiệm cận Claude và GPT-5.6

It's worth really grasping this: in a very short time, the race between OpenAI and Anthropic has tur…

DịchMeta vừa trình làng Muse Spark 1.3, phiên bản thứ tư trong năm tháng qua. Biến thể 'max' đạt 62 điểm trên bảng xếp hạng Artificial Analysis, khẳng định vị thế cạnh tranh mạnh mẽ với các mô hình hàng đầu hiện nay.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng lập trình và tác tử AI»
DAIR.AI@dair_ai
Nghiên cứuĐiểm AI 40/100

HarnessEvolve: Tối ưu hóa khả năng tự tiến hóa của AI thông qua quỹ đạo tham chiếu

Nice paper with great insights on improving self-evolving agents. Self-evolving agents fail in thre…

DịchNghiên cứu từ DAIR.AI chỉ ra ba điểm yếu chí mạng trong quá trình tự tiến hóa của AI: lỗi quy kết phản hồi, học vẹt theo nhiệm vụ và mất khả năng cũ. HarnessEvolve đề xuất sử dụng quỹ đạo tham chiếu để giúp AI tự cải thiện một cách bền vững và đáng tin cậy hơn.

Thêm 1 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)
Tomer Tunguz Blog (phân tích VC)
Hướng dẫnĐiểm AI 56/100

Tomer Tunguz: AI không giúp làm việc ít đi, mà giúp nâng tầm chất lượng đầu ra

Thay vì tiết kiệm thời gian, AI giúp nâng cao chất lượng nội dung thông qua quy trình biên tập tỉ mỉ. Kết quả cho thấy điểm số chất lượng bài viết tăng vọt, đặc biệt ở nhóm nội dung trung bình, giúp nâng cao tiêu chuẩn đầu ra tổng thể.

cb_doge@cb_doge
Hướng dẫnĐiểm AI 22/100

Chuyên gia Oppenheimer: SpaceX trở thành đối thủ của Anthropic, đặt kỳ vọng lớn vào Grok

BREAKING: Oppenheimer analyst Timothy Horan says @SpaceX is now a competitor to Anthropic. "The com…

DịchNhà phân tích Timothy Horan từ Oppenheimer nhận định SpaceX đang là đối thủ đáng gờm của Anthropic trong lĩnh vực AI. Ông cũng đánh giá cao Grok, cho rằng chatbot này sẽ sớm trở thành trợ lý đắc lực giúp người dùng quản lý cuộc sống.

Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 51/100

Inworld ra mắt Realtime TTS-2: Sao chép giọng nói chỉ với 5-15 giây

Inworld has released Realtime TTS-2, focused on clarity, and TTS-2 Flash, built for low latency and …

DịchInworld vừa giới thiệu bộ đôi TTS-2 và TTS-2 Flash với khả năng sao chép giọng nói siêu tốc chỉ trong 5-15 giây, hỗ trợ đọc chính xác các mã số phức tạp và tối ưu độ trễ thấp.

Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 52/100

Artificial Analysis cập nhật bảng xếp hạng Image Editing Arena: MAI-Image-2.6-Preview dẫn đầu

We have updated the Artificial Analysis Image Editing Arena to expand the range of editing tasks we …

DịchArtificial Analysis vừa mở rộng bảng xếp hạng chỉnh sửa ảnh với các tác vụ mới như giữ nguyên danh tính và thiết kế UI/UX, dựa trên đánh giá từ người dùng thực tế.

Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3: Hiệu suất vượt trội, xử lý ngữ cảnh dài lên tới 512K

Meta released Muse Spark 1.3. Reports 20% fewer tool calls and 25% fewer tokens than 1.2. So long c…

DịchMeta vừa trình làng Muse Spark 1.3 với khả năng tối ưu hóa vượt bậc, giảm 20% lệnh gọi công cụ và 25% lượng token tiêu thụ. Mô hình đạt điểm số ấn tượng 98.5 trong bài kiểm tra MRCR 256K-512K, vượt qua nhiều đối thủ sừng sỏ trên thị trường.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3: Nâng cấp mạnh mẽ khả năng lập trình và tác tử AI»
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wang
Hướng dẫnĐiểm AI 20/100

Alexandr Wang chia sẻ kết quả đánh giá sớm của Muse Spark 1.3 trên bộ benchmark Stata

some early eval results from Stata benchmark:)

DịchNhà sáng lập Scale AI, Alexandr Wang, vừa đăng tải những đánh giá ban đầu về hiệu năng của mô hình Muse Spark 1.3 thông qua bộ kiểm chuẩn Stata, thu hút sự chú ý trong giới công nghệ.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 46/100

Sam Altman và Satya Nadella lên tiếng về lượng nước khổng lồ mà AI tiêu thụ

Sam Altman explains how little water AI uses. "For every 38, 000 ChatGPT queries, that is the same a…

DịchSam Altman so sánh 38.000 truy vấn ChatGPT với lượng nước tưới một quả hạnh nhân, trong khi Satya Nadella cho biết một trung tâm dữ liệu của Microsoft tiêu tốn lượng nước tương đương một nhà hàng.

Emad Mostaque@EMostaque
Hướng dẫnĐiểm AI 27/100

Emad Mostaque: Khi AI đã đủ thông minh, tốc độ và chi phí mới là ưu tiên hàng đầu

This is known as satisficing At a certain speed they go faster than our ability to guide them Then…

DịchEmad Mostaque cho rằng khi AI vượt ngưỡng trí tuệ con người, cuộc đua quy mô sẽ nhường chỗ cho tối ưu hóa tốc độ và chi phí, đặt ra câu hỏi về giới hạn cải tiến tiếp theo.

opencode@opencode
Sản phẩmĐiểm AI 20/100

Cùng sự kiệnMeta ra mắt Muse Spark 1.3 Contributor trên nền tảng OpenCode Go

Meta Muse Spark 1.3 Contributor is now available on OpenCode Go

DịchPhiên bản Muse Spark 1.3 Contributor của Meta hiện đã chính thức có mặt trên OpenCode Go, hỗ trợ cộng đồng phát triển các mô hình AI chuyên sâu.

Cùng sự kiện, bài đại diện «Meta ra mắt Muse Spark 1.3, tích hợp vào Muse Code và Meta Model API»
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 47/100

X Square Robot ra mắt TwinDEX: Hệ thống đeo tay giúp huấn luyện robot thao tác linh hoạt mà không cần máy thật

Dexterous robots have a data problem that gets expensive very quickly, and recently, so many brillia…

DịchTwinDEX là hệ thống gồm hai thiết bị đeo tay đồng bộ, cho phép thu thập dữ liệu chuyển động và triển khai trực tiếp lên robot với cấu trúc cơ khí và cảm biến tương đồng, giúp tối ưu hóa quá trình huấn luyện thao tác khéo léo.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 28/100

Ethan Mollick trải nghiệm Gemini 3.8 Flash: Hiệu năng ấn tượng trong tạo shader

Had early access to Gemini 3.8 Flash, it is a very good Flash model, but not equivalent to a frontie…

DịchEthan Mollick chia sẻ trải nghiệm sớm với Gemini 3.8 Flash, đánh giá đây là mô hình Flash xuất sắc dù chưa đạt tầm cỡ các mô hình đầu bảng. Ông đã thử nghiệm khả năng tạo shader kiến trúc Gothic và so sánh trực tiếp với Fable 5.1.

MarkTechPost
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnGoogle DeepMind ra mắt Gemini 3.8 Flash và bản chuyên dụng Cyber: Cùng một lõi, hai cách tiếp cận

Google DeepMind vừa giới thiệu Gemini 3.8 Flash và phiên bản Cyber, sử dụng chung nền tảng cốt lõi nhưng được tối ưu hóa khác biệt về cơ chế bảo mật và phương thức truy cập.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
TechCrunch AI
Sản phẩmĐiểm AI 85/100

Max Spero (Pangram): Tại sao việc phát hiện nội dung AI khó hơn chúng ta tưởng?

Khi nội dung AI tràn lan trong hồ sơ xin việc và đánh giá sản phẩm, việc phân biệt thật giả trở thành thách thức lớn. Max Spero từ Pangram giải thích lý do các công cụ phát hiện AI hiện nay vẫn chưa thể giải quyết triệt để vấn đề niềm tin trên internet.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 77/100

Cùng sự kiệnBộ Tư pháp Mỹ ủng hộ OpenAI: Huấn luyện AI trên dữ liệu có bản quyền là 'sử dụng hợp lý'

A massive win for OpenAI (and for AI training in general) for its legal case against New York Times….

DịchBộ Tư pháp Mỹ lần đầu can thiệp vào vụ kiện bản quyền AI, cho rằng việc huấn luyện LLM là 'sử dụng hợp lý' vì không thay thế tác phẩm gốc, đồng thời cảnh báo việc yêu cầu cấp phép khắt khe sẽ cản trở các công ty nhỏ.

Cùng sự kiện, tinh chọn hiển thị «Bộ Tư pháp Mỹ can thiệp vụ kiện NYT vs OpenAI, ủng hộ việc huấn luyện AI là 'sử dụng hợp lý'»
The Decoder: AI News
Mô hìnhĐiểm AI 74/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Flash: Mẫu mô hình giá rẻ thứ ba chỉ trong sáu tuần

Google vừa giới thiệu Gemini 3.8 Flash, bao gồm phiên bản tiêu chuẩn và phiên bản chuyên dụng cho an ninh mạng (Cyber), đánh dấu bước đi chiến lược trong việc phổ cập các mô hình AI hiệu năng cao.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»

02/09

Thứ Tư · 135 tin
Demis Hassabis@demishassabis
Mô hìnhĐiểm AI 54/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Flash và phiên bản chuyên dụng cho an ninh mạng

Introducing Gemini 3.8 Flash, another upgrade in under a month! And the new 3.8 Flash Cyber pushes t…

DịchGoogle vừa giới thiệu Gemini 3.8 Flash cùng biến thể mới 3.8 Flash Cyber, tập trung tăng cường khả năng phòng thủ mạng. Đây là lần cập nhật thứ ba cho dòng Flash chỉ trong vòng 6 tuần.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
Kim@kimmonismus
Hướng dẫnĐiểm AI 43/100

Phát hiện mã định danh 'gpt-6-astra' trong API OpenAI, nghi vấn về thế hệ mô hình tiếp theo

OpenAI's next major model Astra may actually be GPT-6. The "gpt-6-astra" name is now producing the …

DịchNgười dùng phát hiện API của OpenAI phản hồi mã 404 cho 'gpt-6-astra' thay vì 400, dấu hiệu tương tự như cách các mô hình mới từng bị rò rỉ trước đây. Điều này làm dấy lên đồn đoán Astra chính là tên gọi của GPT-6.

Thêm 1 nguồn khác đưa tinX: ZHO (@ZHO_ZHO_ZHO)
fofr@fofrAI
Mô hìnhĐiểm AI 64/100

Cùng sự kiệnGoogle DeepMind ra mắt bộ đôi Gemini 3.8 Flash và 3.8 Flash Cyber

Google DeepMind vừa giới thiệu Gemini 3.8 Flash với khả năng lập trình và suy luận vượt trội, cùng phiên bản chuyên dụng 3.8 Flash Cyber hỗ trợ phát hiện và tự động vá lỗi bảo mật.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
Google DeepMind: Blog
Mô hìnhĐiểm AI 78/100

Tinh chọnGoogle DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber

Google DeepMind vừa chính thức giới thiệu Gemini 3.8 Flash cùng phiên bản chuyên biệt 3.8 Flash Cyber, hứa hẹn cải thiện hiệu suất và khả năng xử lý cho người dùng.

Diễn biến sự kiện · 20 bài →Thêm 26 nguồn khác đưa tinArs Technica: AIX: Google AI (@GoogleAI)MarkTechPostX: Google DeepMind (@GoogleDeepMind)The Decoder: AI NewsX: Demis Hassabis (@demishassabis)X: fofr (@fofrAI)X: Sundar Pichai (@sundarpichai)IT HomeCafeF Kinh tế sốX: AI Notes (@AYi_AInotes)GenK AIX: Ma Dongxi NLP (@dongxi_nlp)The Verge: AIX: Rohan Paul (@rohanpaul_ai)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)X: OpenRouter (@OpenRouter)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Josh Woodward (@joshwoodward, Google Labs VP)X: Artificial Analysis (@ArtificialAnlys)X: Ammaar Reshi (@ammaar)X: Gemini (@GeminiApp)X: Logan Kilpatrick (@OfficialLoganK)X: Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI) (@alexandr_wang)X: Google AI for Developers (@googleaidevs)X: Testing Catalog (@testingcatalog)

Vì sao đáng đọc: Đây là bản cập nhật quan trọng từ Google về dòng mô hình chủ lực, thu hút sự quan tâm lớn từ cộng đồng công nghệ và các nhà phát triển.
IT Home
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnGoogle ra mắt Gemini 3.8 Flash Cyber: Chuyên gia AI bảo mật mã nguồn

Google vừa giới thiệu mô hình Gemini 3.8 Flash Cyber, được tối ưu hóa cho việc tự động phát hiện lỗ hổng bảo mật với tỷ lệ thành công trên 70% trong các thử nghiệm nội bộ.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt bộ đôi mô hình mới: Gemini 3.8 Flash và 3.8 Flash Cyber»
Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 31/100

Cùng sự kiệnGrok Bot chính thức có mặt trên Android

SPACEXAI 🔥: Grok Bot is now available on Android platform! Bot testing time 👀

DịchGrok Bot vừa ra mắt phiên bản thử nghiệm trên Android. Người dùng hiện đã có thể trải nghiệm, gắn thẻ bot ở bất kỳ đâu và gửi phản hồi để đội ngũ phát triển hoàn thiện tính năng.

Cùng sự kiện, bài đại diện «Grok AI chính thức có mặt trên Google Play Store cho người dùng Android»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (103 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI” — Trang 56 | AIHOT.vn