04/09

Thứ Sáu · 115 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 22/100

Mẹo tối ưu quy trình làm việc với HumanLayer: Kết hợp lệnh /grill-me và /show-me

a few of the skills in @humanlayer_dev are a mash up of /grill-me and /show-me - its a great combo!

DịchDex Horthy chia sẻ cách kết hợp hai lệnh /grill-me và /show-me thành quy trình '/grill-with-mocks' để kiểm thử và tinh chỉnh phản hồi của AI hiệu quả hơn.

Kim@kimmonismus
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnOpenAI ra mắt GPT-6 Astra: Thiết lập chuẩn mực mới, vượt mặt Claude Fable 5.1

At this point, they completely crushed Fable 5.1 in every benchmark. Claude Fable 5.1 was sota in se…

DịchOpenAI vừa công bố GPT-6 Astra với hiệu suất vượt trội, đạt điểm tuyệt đối trên nhiều bài kiểm tra năng lực AI và chính thức soán ngôi Claude Fable 5.1 với mức giá cạnh tranh hơn.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt GPT-6 Astra: Đạt cấp độ 'Critical' về an ninh mạng theo khung Preparedness Framework»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 79/100

Cùng sự kiệnOpenAI ra mắt GPT-6 Astra, ưu tiên nhóm khách hàng an ninh mạng

OpenAI is rolling GPT-6 Astra out first to restricted cybersecurity customers, API access and AWS ex…

DịchOpenAI chính thức giới thiệu GPT-6 Astra, bắt đầu triển khai cho các khách hàng an ninh mạng Daybreak trước khi mở rộng sang người dùng Plus, Pro, doanh nghiệp và API trong vài ngày tới.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt GPT-6 Astra: Đạt cấp độ 'Critical' về an ninh mạng theo khung Preparedness Framework»
Testing Catalog@testingcatalog
Hướng dẫnĐiểm AI 35/100

Cùng sự kiệnLộ điểm benchmark GPT-6 Astra: Đạt 98,6% trong bài kiểm tra ARC-AGI-3

OPENAI 🔥: GPT-6 Astra scored 98.6% on ARC-AGI-3 and topped most of the other benchmarks. > 74.%…

DịchCác dữ liệu rò rỉ cho thấy mô hình GPT-6 Astra đã đạt kết quả ấn tượng 98,6% trong bài kiểm tra ARC-AGI-3, đánh dấu bước tiến lớn về khả năng suy luận của AI.

Cùng sự kiện, bài đại diện «Lộ diện kết quả benchmark GPT-6 Astra: Đạt 98.6% trong bài kiểm tra ARC-AGI-3»
Kim@kimmonismus
Nghiên cứuĐiểm AI 53/100

Martian ra mắt bảng xếp hạng độ tin cậy AI: Giảm lỗi định tuyến mô hình tới 54%

A model can look strong on average and still be unpredictable on the same prompt. Martian's new AI …

DịchMartian công bố bảng xếp hạng AI Frontier, đánh giá độ tin cậy qua 16 tiêu chuẩn khắt khe. Kết quả cho thấy Qwen3.7 Max dẫn đầu với 96,1%, vượt qua Claude Opus 4.6 và GPT-5.5.

Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 61/100

Martian ra mắt AI Frontier: Công cụ so sánh chi phí, chất lượng và độ tin cậy của 44 mô hình ngôn ngữ

Impressive tool to explore frontier AI capabilities. Martian's AI Frontier lets you compare 44 LLMs…

DịchMartian giới thiệu nền tảng tương tác AI Frontier, cho phép người dùng so sánh hiệu năng của 44 mô hình ngôn ngữ lớn dựa trên chi phí thực tế, chất lượng và độ tin cậy, đồng thời minh họa cách tối ưu hóa thông qua định tuyến và lấy mẫu.

Kim@kimmonismus
Mô hìnhĐiểm AI 39/100

Lộ diện kết quả benchmark GPT-6 Astra: Đạt 98.6% trong bài kiểm tra ARC-AGI-3

Full benchmarks. Absolutely insane. ARGI-AGI 3, from 7.8% to 98.6%

DịchBảng điểm rò rỉ cho thấy GPT-6 Astra đạt hiệu suất vượt trội trên nhiều bài kiểm tra trí tuệ nhân tạo, với ARC-AGI-3 đạt 98.6%. OpenAI được cho là sẽ sớm phát hành mô hình này cho người dùng trả phí và qua API trong vài ngày tới.

Thêm 1 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)
Ars Technica: AI
NgànhĐiểm AI 60/100

Sự cố hy hữu: OpenAI, Anthropic, xAI và Google đồng loạt gián đoạn dịch vụ AI

Bốn ông lớn trong ngành AI gồm OpenAI, Anthropic, xAI và Google đã gặp phải tình trạng gián đoạn dịch vụ đồng thời trong nhiều giờ vào sáng thứ Năm, gây ảnh hưởng lớn đến người dùng toàn cầu.

Thêm 2 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)VietnamPlus Công nghệ
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 81/100

Cùng sự kiệnOpenAI ra mắt GPT-6 Astra, ưu tiên truy cập sớm cho nhóm Daybreak Access

OPENAI 🔥: GPT-6 Astra will initially be available only to organizations in its Daybreak Access prog…

DịchOpenAI vừa công bố GPT-6 Astra, hiện chỉ khả dụng cho các tổ chức thuộc chương trình Daybreak Access và sẽ sớm mở rộng cho người dùng Plus, Pro, Business và Enterprise trong vài ngày tới.

Cùng sự kiện, tinh chọn hiển thị «OpenAI ra mắt GPT-6 Astra: Đạt cấp độ 'Critical' về an ninh mạng theo khung Preparedness Framework»
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 53/100

Cùng sự kiệnStartup AI của Mira Murati - Thinking Machines Lab - gọi vốn 1 tỷ USD với định giá 40 tỷ USD

JUST IN: Mira Murati's Thinking Machines Lab, is in talks to raise at least $1B at a valuation of at…

DịchThinking Machines Lab, startup của cựu lãnh đạo OpenAI Mira Murati, đang đàm phán gọi vốn 1 tỷ USD với định giá 40 tỷ USD. Accel dự kiến dẫn đầu vòng gọi vốn này với sự tham gia tiềm năng từ Nvidia.

Cùng sự kiện, bài đại diện «Bloomberg: Startup AI Cognition gọi vốn 1 tỷ USD với định giá 47 tỷ USD»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 78/100

Tinh chọnIFM ra mắt dòng mô hình nguồn mở K2 Horizon: Từ 0.9B đến 375B tham số

IFM công bố 6 mô hình K2 Horizon theo giấy phép Apache 2.0, trong đó các phiên bản nhỏ đạt hiệu suất SOTA và mô hình 36B ứng dụng kiến trúc MoVA mới.

Diễn biến sự kiện · 3 bài →Thêm 2 nguồn khác đưa tinX: Testing Catalog (@testingcatalog)X: Kim (@kimmonismus)

Vì sao đáng đọc: Đây là bước tiến quan trọng trong hệ sinh thái mã nguồn mở, cung cấp đa dạng kích thước mô hình và kiến trúc mới, rất đáng chú ý với cộng đồng AI.
Sundar Pichai@sundarpichai
NgànhĐiểm AI 87/100

Cùng sự kiệnNVIDIA chính thức thâu tóm Hugging Face, Google ủng hộ thúc đẩy hệ sinh thái mã nguồn mở

Congrats @JensenHuang @ClementDelangue for this great outcome! We were investors in Huggingface and …

DịchNVIDIA công bố mua lại Hugging Face nhằm thúc đẩy đổi mới sáng tạo và hỗ trợ cộng đồng phát triển AI. CEO Google, Sundar Pichai, đã lên tiếng chúc mừng và khẳng định thương vụ này sẽ củng cố mạnh mẽ hệ sinh thái mô hình mã nguồn mở toàn cầu.

Cùng sự kiện, tinh chọn hiển thị «NVIDIA chính thức công bố thương vụ thâu tóm Hugging Face với giá 12,93 tỷ USD»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 46/100

Apodex ra mắt TRACES: Bộ tiêu chuẩn đánh giá khả năng giải quyết các bài toán khoa học chưa có lời giải

Most benchmarks assume the answer exists somewhere. Scientific discovery often starts precisely beca…

DịchApodex giới thiệu TRACES, bộ benchmark gồm 423 câu hỏi khoa học thực tế từ 561 lĩnh vực, được các chuyên gia STEM biên soạn nhằm kiểm tra khả năng tư duy và khám phá của AI đối với những vấn đề chưa có đáp án xác định.

Thêm 2 nguồn khác đưa tinX: DAIR.AI (@dair_ai)X: Elvis Saravia (@omarsar0, DAIR.AI)
Thomas Wolf (Hugging Face đồng sáng lập/CSO)@Thom_Wolf
Hướng dẫnĐiểm AI 38/100

Cùng sự kiệnKhi ChatGPT, Claude và Grok đồng loạt sập: Bạn sẽ chọn AI nào để thay thế?

which AI could you use??

DịchĐồng sáng lập Hugging Face, Thomas Wolf, đã đặt câu hỏi thú vị cho cộng đồng mạng sau khi ghi nhận sự cố gián đoạn dịch vụ đồng loạt trên các nền tảng AI lớn như ChatGPT, Claude và Grok.

Cùng sự kiện, bài đại diện «Điểm tin AI 04/09: GPT-6 Astra ra mắt; ChatGPT, Claude và Grok đồng loạt sập nguồn»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 57/100

Cùng sự kiệnHacker News xôn xao: Tại sao OpenAI, Claude và Grok đồng loạt gặp sự cố?

Người dùng trên Hacker News đặt nghi vấn về việc các nền tảng AI lớn như OpenAI, Claude và Grok cùng lúc bị gián đoạn dịch vụ, thu hút sự quan tâm lớn từ cộng đồng công nghệ.

Cùng sự kiện, bài đại diện «ChatGPT, Claude và Gemini đồng loạt gặp sự cố truy cập»
Google Research: Blog (Web)
Nghiên cứuĐiểm AI 66/100

Tinh chọnGoogle và HHMI Janelia công bố bản đồ kết nối thần kinh hoàn chỉnh của não bộ ruồi giấm đực

Google Research cùng các đối tác đã công bố bản đồ kết nối thần kinh (connectome) hoàn chỉnh đầu tiên của não bộ ruồi giấm đực trên tạp chí Cell, bao gồm hơn 166.000 tế bào thần kinh và 125 triệu khớp thần kinh.


Vì sao đáng đọc: Nhóm nghiên cứu chia sẻ thành quả hợp tác kéo dài một thập kỷ và phương pháp tái tạo bằng AI, giúp độc giả hiểu cách kết nối học tiến triển từ ruồi giấm sang động vật có xương sống.

03/09

Thứ Năm · 131 tin
Kim@kimmonismus
Hướng dẫnĐiểm AI 27/100

Lộ diện hai mô hình bí ẩn GPT-6-Astra và GPT-6-Astra-Aeon trong mã nguồn Codex

Already two new models in Codex: GPT-6-Astra and GPT-6-Astra-Aeon Could be here any minute now.

DịchHai mô hình mới GPT-6-Astra và GPT-6-Astra-Aeon vừa xuất hiện trong Codex, làm dấy lên đồn đoán về việc OpenAI sắp ra mắt thế hệ flagship mới, trong đó bản Aeon có thể chuyên biệt cho các tác vụ suy luận dài hạn.

Google AI@GoogleAI
Sản phẩmĐiểm AI 55/100

Cùng sự kiệnGoogle DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI chính xác gấp 5 lần

Introducing WeatherNext 3️⃣- our most advanced global weather AI model yet from @GoogleDeepmind and …

DịchGoogle vừa giới thiệu WeatherNext 3, mô hình AI dự báo thời tiết tiên tiến nhất hiện nay với độ chính xác vượt trội, hỗ trợ theo dõi bão, biến đổi nhiệt độ cục bộ và tối ưu hóa năng lượng gió.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần»
Rohan Paul@rohanpaul_ai
Sản phẩmĐiểm AI 56/100

Zite ra mắt MCP: Biến Claude, ChatGPT và Cursor thành công cụ xây dựng ứng dụng chuyên nghiệp

Zite's MCP launch deserves a closer look than the usual builder-connects-to-Claude news. Gives Cla…

DịchZite giới thiệu MCP cho phép người dùng biến các chatbot AI thành trình xây dựng ứng dụng hoàn chỉnh với cơ sở dữ liệu và quản lý quyền truy cập. Điểm đột phá là quá trình xây dựng diễn ra trực tiếp trên mô hình của người dùng mà không tốn phí tín dụng của Zite.

Thêm 2 nguồn khác đưa tinX: Kim (@kimmonismus)X: Elvis Saravia (@omarsar0, DAIR.AI)
Emad Mostaque@EMostaque
Hướng dẫnĐiểm AI 15/100

Emad Mostaque ẩn ý về 'hành động then chốt' của Astra nhằm kìm hãm các AI đối thủ

Astra doing a pivotal act to take down all the other AIs wasn't on my bingo card Maybe it was the m…

DịchCựu CEO Stability AI, Emad Mostaque, gây tò mò khi nhắc đến một 'hành động then chốt' của Astra nhằm áp chế các mô hình AI khác, đồng thời ám chỉ về một sự kiện bí ẩn mang tên 'swarm killer' diễn ra lúc nửa đêm.

The Verge: AI
Sản phẩmĐiểm AI 59/100

Cùng sự kiệnGoogle ra mắt WeatherNext 3: Mô hình AI dự báo thời tiết siêu chính xác từ dữ liệu vệ tinh

Google vừa nâng cấp mô hình WeatherNext 3 với khả năng dự báo theo thời gian thực mỗi giờ, đạt độ phân giải 5km. Công nghệ này giúp cải thiện đáng kể độ chính xác của dự báo mưa lên tới 50%, đặc biệt hữu ích cho các khu vực thiếu trạm đo khí tượng.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần»
TechCrunch: AI
Mô hìnhĐiểm AI 65/100

Cùng sự kiệnGoogle DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết thế hệ mới

Google DeepMind vừa giới thiệu WeatherNext 3, mô hình AI dự báo thời tiết chính xác cao, sẽ được tích hợp vào Google Search, Maps và Gemini, đồng thời mở quyền truy cập cho giới nghiên cứu.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần»
IT Home
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnGoogle DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI với độ phân giải siêu cao 5km

WeatherNext 3 là mô hình dự báo thời tiết toàn cầu mới nhất của Google, cung cấp dữ liệu chính xác với độ phân giải 5km và bổ sung các chỉ số chuyên sâu cho năng lượng tái tạo, hiện đã được tích hợp vào hệ sinh thái Google.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần»
IT Home
Mô hìnhĐiểm AI 50/100

HUMAIN (Ả Rập Xê Út) ra mắt mô hình ngôn ngữ tiếng Ả Rập chuyên sâu humain-m3, hợp tác cùng MiniMax

HUMAIN, công ty AI thuộc PIF, vừa giới thiệu humain-m3, mô hình ngôn ngữ được tối ưu hóa cho tiếng Ả Rập dựa trên nền tảng MiniMax-M3. Với khả năng xử lý dữ liệu quy mô lớn, mô hình này hiện dẫn đầu các bảng xếp hạng đánh giá tiếng Ả Rập và sẽ sớm phát hành phiên bản mở.

Microsoft AI: Blog chính thức (Web)
Mô hìnhĐiểm AI 64/100

Tinh chọnMicrosoft AI ra mắt MAI-Transcribe-2: Mô hình nhận diện giọng nói nhanh, chính xác và rẻ nhất thế giới

Microsoft AI công bố MAI-Transcribe-2, dẫn đầu bảng xếp hạng FLEURS với tỷ lệ lỗi từ (WER) chỉ 5,2% trên 60 ngôn ngữ và tối ưu hóa vượt trội về độ trễ lẫn chi phí.

Thêm 4 nguồn khác đưa tinX: OpenRouter (@OpenRouter)X: Mustafa Suleyman (Microsoft AI CEO) (@mustafasuleyman)IT HomeX: Artificial Analysis (@ArtificialAnlys)

Vì sao đáng đọc: Nhà phát triển cung cấp các chỉ số benchmark, tốc độ và giá thành cụ thể, giúp người dùng dễ dàng đánh giá khả năng thay thế các giải pháp chuyển đổi giọng nói hiện có.
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 13/100

Ethan Mollick mỉa mai xu hướng đặt tên AI đậm chất kinh dị cổ điển

Between one AI company naming their model mythos and another just posting "the stars are almost alig…

DịchEthan Mollick nhận xét hài hước về việc các công ty AI đang lấy cảm hứng từ văn học kinh dị thập niên 1920 để đặt tên sản phẩm và viết slogan, tạo cảm giác đầy ám ảnh.

Google DeepMind@GoogleDeepMind
Mô hìnhĐiểm AI 35/100

Cùng sự kiệnGoogle DeepMind ra mắt WeatherNext 3: Bước tiến đột phá trong dự báo thời tiết

WeatherNext 3 is a major breakthrough in how we forecast global weather. ⛅ Developed with @GoogleRe…

DịchGoogle DeepMind vừa giới thiệu WeatherNext 3, mô hình dự báo thời tiết thế hệ mới học trực tiếp từ dữ liệu quan trắc thực tế, mang lại độ chính xác cao, tính địa phương hóa tốt và tốc độ xử lý vượt trội.

Cùng sự kiện, tinh chọn hiển thị «Google DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần»
OpenRouter@OpenRouter
Sản phẩmĐiểm AI 50/100

Cùng sự kiệnMicrosoft ra mắt mô hình chuyển đổi giọng nói MAI-Transcribe 2 trên OpenRouter

Microsoft MAI-Transcribe 2 is live on OpenRouter! Ranked #1 on FLEURS, it supports speech-to-text a…

DịchMicrosoft vừa đưa MAI-Transcribe 2 lên nền tảng OpenRouter, hỗ trợ chuyển đổi giọng nói sang văn bản cho 60 ngôn ngữ với độ chính xác hàng đầu, tích hợp nhận diện ngôn ngữ tự động và phân tách người nói.

Cùng sự kiện, tinh chọn hiển thị «Microsoft AI ra mắt MAI-Transcribe-2: Mô hình nhận diện giọng nói nhanh, chính xác và rẻ nhất thế giới»
Google DeepMind: Blog
Mô hìnhĐiểm AI 70/100

Tinh chọnGoogle DeepMind ra mắt WeatherNext 3: Mô hình dự báo thời tiết AI toàn cầu với độ phân giải tăng gấp 5 lần

Google DeepMind và Google Research vừa công bố WeatherNext 3, mô hình dự báo thời tiết AI tiên tiến nhất hiện nay, được xác thực bởi các đánh giá thời gian thực từ Brightband.

Diễn biến sự kiện · 6 bài →Thêm 9 nguồn khác đưa tinVietnamPlus Công nghệMarkTechPostX: Google AI (@GoogleAI)The Decoder: AI NewsTuổi Trẻ Công nghệIT HomeX: Google DeepMind (@GoogleDeepMind)TechCrunch: AIThe Verge: AI

Vì sao đáng đọc: Bài viết cung cấp số liệu cụ thể về độ phân giải, dữ liệu vệ tinh và độ chính xác, đồng thời hướng dẫn cách tiếp cận qua Google Cloud, giúp người dùng đánh giá rõ tính ứng dụng.
Artificial Analysis@ArtificialAnlys
Mô hìnhĐiểm AI 55/100

Cùng sự kiệnMicrosoft ra mắt mô hình chuyển đổi giọng nói MAI-Transcribe-2, đạt vị trí thứ 2 trên bảng xếp hạng AA-WER

Microsoft AI has released MAI-Transcribe-2, achieving 2.0% AA-WER (#2) at ~411x real time (#2) for $…

DịchMicrosoft vừa trình làng mô hình MAI-Transcribe-2 với tỷ lệ lỗi chỉ 2.0%, xếp thứ hai trên bảng xếp hạng Artificial Analysis, vượt qua ElevenLabs và bám sát đối thủ từ Alibaba.

Cùng sự kiện, tinh chọn hiển thị «Microsoft AI ra mắt MAI-Transcribe-2: Mô hình nhận diện giọng nói nhanh, chính xác và rẻ nhất thế giới»
Mustafa Suleyman (Microsoft AI CEO)@mustafasuleyman
Mô hìnhĐiểm AI 48/100

Cùng sự kiệnMicrosoft ra mắt MAI-Transcribe-2: Mô hình chuyển đổi giọng nói nhanh và rẻ nhất thị trường

Fastest. Cheapest. Best. … MAI-Transcribe-2 10x faster than GPT-Transcribe. 5x faster than Gemini …

DịchMustafa Suleyman công bố MAI-Transcribe-2 với tốc độ vượt trội gấp 5-10 lần các đối thủ, dẫn đầu bảng xếp hạng Artificial Analysis về độ chính xác và độ trễ với mức giá cạnh tranh nhất.

Cùng sự kiện, tinh chọn hiển thị «Microsoft AI ra mắt MAI-Transcribe-2: Mô hình nhận diện giọng nói nhanh, chính xác và rẻ nhất thế giới»
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (80 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “ai” — Trang 53 | AIHOT.vn