Ngày này có 9 sự kiện AI đáng chú ý
- Phát hành / cập nhật mô hình
Tiểu Hồng Thư mã nguồn mở Iris: Mô hình Search Agent vượt trội ở phân khúc 35B và 397B
Đội ngũ AllSpark của Tiểu Hồng Thư vừa công bố mã nguồn mở cho Iris, mô hình Search Agent chuyên dụng. Hiện tại, trọng số và mã đánh giá đã được phát hành, các dữ liệu huấn luyện sẽ sớm được cập nhật.
- Phát hành / cập nhật mô hình
SiliconFlow ra mắt mô hình mã nguồn mở Hy4: 770 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token
SiliconFlow vừa phát hành mô hình Hy4 (bản preview) với 770 tỷ tham số, hỗ trợ 1 triệu token ngữ cảnh và giấy phép Apache 2.0, tối ưu cho lập trình và phân tích dữ liệu phức tạp.
- Sản phẩm / ứng dụng
Apple ra mắt Apple Intelligence thế hệ mới: Siri AI chính thức bước vào giai đoạn thử nghiệm
Apple giới thiệu Siri AI hoàn toàn mới với khả năng hiểu ngữ cảnh cá nhân, nhận diện màn hình và điều khiển ứng dụng hệ thống. Tính năng này bắt đầu thử nghiệm bằng tiếng Anh và sẽ sớm hỗ trợ thêm nhiều ngôn ngữ khác.
- Tín hiệu ngành
Anthropic rục rịch lên sàn Nasdaq, đặt mục tiêu định giá 2 nghìn tỷ USD sau khi có lãi
Anthropic thông báo đạt lợi nhuận quý thứ hai liên tiếp dựa trên các chỉ số điều chỉnh, với biên lợi nhuận gộp vượt 80%. Công ty đang chuẩn bị cho đợt IPO quy mô lớn nhằm thu hút các nhà đầu tư chiến lược.
- Nghiên cứu / bài báo
DeepSeek-V4.1-Flash (Max) vươn lên vị trí thứ 3 trên bảng xếp hạng Agent Arena
DeepSeek-V4.1-Flash (Max) đạt vị trí thứ 3 trong nhóm mô hình mã nguồn mở trên Agent Arena với hiệu suất tăng 4,87% và chi phí tối ưu chỉ 0,07 USD mỗi tác vụ, vượt xa các đối thủ về hiệu quả kinh tế.
- Hướng dẫn / quan điểm
Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?
Các lãnh đạo công nghệ hàng đầu đang đề xuất làm chậm tiến độ AI và tăng cường kiểm soát, nhưng giới phê bình lo ngại đây chỉ là cách để các tập đoàn lớn triệt tiêu đối thủ và kìm hãm cộng đồng mã nguồn mở.
- Hướng dẫn / quan điểm
Đánh giá GPT-5.6 Luna vs GPT-6 Astra: Liệu mô hình rẻ hơn 28 lần có đủ sức thay thế trong review code?
Entelligence thực hiện bài kiểm tra trên 50 PR công khai để so sánh hiệu năng review code giữa GPT-5.6 Luna và GPT-6 Astra, tập trung vào khả năng tối ưu chi phí mà vẫn đảm bảo chất lượng.
- Hướng dẫn / quan điểm
Tomer Tunguz phân tích 5 luồng quan điểm về đề xuất 'hãm phanh' phát triển AI của Dario Amodei
Tomer Tunguz mổ xẻ lời kêu gọi làm chậm tiến độ AI của Dario Amodei qua 5 góc nhìn: khả năng giải thích, lao động, kinh tế, địa chính trị và sự kiểm soát của cơ quan quản lý, đồng thời chỉ ra sự thiếu hụt các lộ trình cụ thể.
- Hướng dẫn / quan điểm
Kỹ sư Anthropic chia sẻ cách mở rộng hệ thống kiểm thử khi lập trình bằng AI
Khi Claude viết 80% mã nguồn khiến khối lượng CI tăng vọt 25 lần, đội ngũ Anthropic đã phải từ bỏ các giải pháp tạm thời để thiết kế lại kiến trúc hệ thống kiểm thử theo hướng phi trạng thái và có khả năng mở rộng linh hoạt.