23/09

Thứ Tư · 35 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 61/100

Cùng sự kiệnArtificial Analysis: Chi phí vận hành Claude Opus 5.5 ngang bằng thế hệ tiền nhiệm

Claude Opus 5.5 (max) costs $5.98 per Intelligence Index task, which is similar to Opus 5 (max) at $…

DịchDù mức tiêu thụ token tăng, Anthropic đã tối ưu hóa giá cơ bản và chi phí bộ nhớ đệm, giúp chi phí mỗi tác vụ của Claude Opus 5.5 đạt 5,98 USD, tương đương với phiên bản Opus 5 trước đó.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Tối ưu hóa huấn luyện Reinforcement Learning cho LLM với định dạng FP8 toàn trình

Nghiên cứu giải quyết tình trạng mất ổn định khi huấn luyện RL cho LLM bằng FP8, vốn gây ra lỗi sai lệch gradient và làm giảm chất lượng mô hình. Nhóm tác giả đề xuất phương pháp mới giúp duy trì độ chính xác và hiệu suất huấn luyện ổn định hơn.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnArtificial Analysis đánh giá hiệu năng và giá thành của Claude Opus 5.5

Anthropic vừa ra mắt Claude Opus 5.5 với khả năng suy luận vượt trội, đạt 58 điểm trên bảng xếp hạng Artificial Analysis, cao hơn gấp đôi so với mức trung bình của các mô hình cùng phân khúc.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
ZHO@ZHO_ZHO_ZHO
Mô hìnhĐiểm AI 82/100

Cùng sự kiệnOpenAI ra mắt bộ đôi GPT-6 Sol và GPT-6 Luna: Hiệu năng cao, chi phí tối ưu

OpenAI vừa giới thiệu GPT-6 Sol và Luna, hai phiên bản tối ưu hóa từ nền tảng Astra với chi phí rẻ hơn 50% so với thế hệ trước, hướng tới nhu cầu sử dụng quy mô lớn.

Cùng sự kiện, tinh chọn hiển thị «Arena ra mắt thử nghiệm GPT-6 Sol và GPT-6 Luna, chuẩn bị công bố bảng xếp hạng»
StepFun@StepFun_ai
Sản phẩmĐiểm AI 59/100

StepFun ra mắt onPanda: Công cụ mã nguồn mở tối ưu hóa dữ liệu và kiểm tra mô hình LLM

We've open-sourced onPanda 🐼 - the tool we use internally for LLM data annotation and model inspect…

DịchStepFun vừa công bố onPanda, công cụ mã nguồn mở giúp tăng tốc gắn nhãn dữ liệu LLM lên 52% và hỗ trợ kiểm soát token chi tiết. Nền tảng này cho phép tạo dữ liệu SFT và dữ liệu ưu tiên trong cùng một quy trình, đồng thời hỗ trợ gắn nhãn đa phương thức cho các tác nhân AI.

Artificial Analysis bài đầy đủ (Web)
Hướng dẫnĐiểm AI 81/100

Đã có đại diệnClaude Opus 5.5 chính thức soán ngôi đầu bảng xếp hạng Artificial Analysis Intelligence Index

Claude Opus 5.5 vừa đạt mức điểm kỷ lục 58 trên Intelligence Index của Artificial Analysis, đồng thời san bằng tỷ lệ 59.6% với GPT-6 Astra trong bài kiểm tra Terminal-Bench 4.0.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
Claude: YouTube
Mô hìnhĐiểm AI 49/100

Cùng sự kiệnRa mắt Claude Opus 5.5: Bước tiến mới trong khả năng xử lý của Anthropic

Anthropic chính thức giới thiệu Claude Opus 5.5, phiên bản nâng cấp mạnh mẽ tập trung vào hiệu suất xử lý tác vụ phức tạp và khả năng suy luận vượt trội.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 75/100

Cùng sự kiệnAnthropic ra mắt Claude Opus 5.5: Hiệu năng ngang ngửa Fable 5.1, chi phí giảm 40%

Claude Opus 5.5 dropped and, claiming Fable 5.1-level performance while cutting typical workload cos…

DịchAnthropic vừa giới thiệu Claude Opus 5.5, mẫu model mới đạt hiệu suất tương đương Claude Fable 5.1 nhưng tối ưu chi phí vận hành tốt hơn 40% so với thế hệ Opus 5 tiền nhiệm.

Cùng sự kiện, tinh chọn hiển thị «Claude Opus 5.5 chính thức có mặt trên OpenRouter: Đỉnh cao mới về lập trình và khả năng tự hành»
Thariq@trq212
Mô hìnhĐiểm AI 76/100

Cùng sự kiệnAnthropic ra mắt Claude Opus 5.5: Hiệu năng ngang ngửa Fable 5.1, chi phí vận hành giảm 40%

Opus 5.5 is the result of your feedback. It communicates clearly, it's cheaper per token than Opus…

DịchClaude Opus 5.5 vừa được Anthropic trình làng với hiệu suất tương đương Fable 5.1 nhưng tiết kiệm 40% chi phí. Bản cập nhật này cải thiện khả năng giao tiếp, tối ưu hóa token và nới lỏng giới hạn sử dụng cho người dùng.

Cùng sự kiện, tinh chọn hiển thị «Claude Opus 5.5 chính thức có mặt trên OpenRouter: Đỉnh cao mới về lập trình và khả năng tự hành»

22/09

Thứ Ba · 43 tin
Anthropic@AnthropicAI
Mô hìnhĐiểm AI 71/100

Cùng sự kiệnAnthropic ra mắt Claude Opus 5.5: Hiệu năng vượt trội với chi phí tối ưu

Claude Opus 5.5 is available today.

DịchAnthropic vừa giới thiệu Claude Opus 5.5, mẫu model đầu tiên thuộc dòng 5.5 mới. Sản phẩm này đạt hiệu suất tương đương Claude Fable 5.1 nhưng tiết kiệm tới 40% chi phí vận hành so với thế hệ Opus 5 trước đó.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
The Decoder: AI News
Mô hìnhĐiểm AI 83/100

Cùng sự kiệnAnthropic ra mắt Claude Opus 5.5: Hiệu năng ngang ngửa Fable 5.1 nhưng tiết kiệm 40% chi phí

Claude Opus 5.5 vừa trình làng với hiệu suất tương đương Fable 5.1, đồng thời tối ưu hóa chi phí vận hành giảm 40% và tăng tốc độ phản hồi thêm 30%.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
TechCrunch: AI
Mô hìnhĐiểm AI 83/100

Cùng sự kiệnAnthropic ra mắt Opus 5.5: Hiệu năng vượt trội, giá thành tối ưu hơn

Anthropic vừa trình làng Opus 5.5 với khả năng lập trình và xử lý tri thức vượt xa Fable, đồng thời giảm giá token xuống còn 20 USD/triệu đơn vị cùng tốc độ phản hồi nhanh hơn.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 56/100

Cùng sự kiệnOpenAI có lợi thế lớn để tích hợp trực tiếp khả năng phân loại của Jev vào mô hình

Các chuyên gia nhận định OpenAI hoàn toàn có thể sao chép cơ chế phân loại của Jev bằng cách tận dụng kỹ thuật logprobs và công cụ gọi hàm (tool calling) sẵn có để tối ưu hóa trực tiếp trong mô hình.

Cùng sự kiện, bài đại diện «Hướng dẫn sử dụng Jev: Kiểm duyệt nội dung với mô hình ra quyết định của TypeSafe trên OpenRouter»
Claude@claudeai
Mô hìnhĐiểm AI 70/100

Đã có đại diệnAnthropic trình làng Claude Opus 5.5: Mở màn thế hệ Claude 5.5 mới

Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level…

DịchAnthropic vừa ra mắt Claude Opus 5.5, mẫu model đầu tiên trong dòng 5.5. Sản phẩm này đạt hiệu suất ngang ngửa Claude Fable 5.1 nhưng tiết kiệm chi phí vận hành tới 40% so với bản Opus 5 tiền nhiệm.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnMáy dò nói dối cho AI: Khám phá kiến thức ẩn giấu bên trong các mô hình ngôn ngữ

Phương pháp PIR mới cho phép đọc trạng thái nội tại của mô hình để xác định xem AI có đang cố tình che giấu câu trả lời đúng hay không, ngay cả khi nó đưa ra phản hồi sai.


Vì sao đáng đọc: Đây là nghiên cứu đột phá về tính minh bạch và an toàn của AI, giải quyết vấn đề nan giải khi mô hình cố tình 'giấu nghề' hoặc đưa ra thông tin sai lệch.
QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnXiaomi lập kỷ lục 'livestream luyện AI': Đốt 20 triệu trong 6 ngày để thống trị bảng xếp hạng mã nguồn mở

Xiaomi vừa kết thúc buổi livestream 'luyện' mô hình AI đầy ấn tượng, thu hút sự chú ý lớn từ cộng đồng công nghệ và nhận được lời khen ngợi từ CEO Hugging Face.


Vì sao đáng đọc: Sự kiện livestream luyện mô hình AI công khai của Xiaomi là một bước đi táo bạo, minh bạch và thu hút sự quan tâm lớn từ giới chuyên môn lẫn cộng đồng mã nguồn mở.
Testing Catalog@testingcatalog
Mô hìnhĐiểm AI 56/100

Cùng sự kiệnAlibaba ra mắt dòng mô hình Qwen 4 tại Hội nghị Vân Tê

ALIBABA 🔥: Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus and Qwen 4 27B models have been announced! The n…

DịchTại Hội nghị Vân Tê, Alibaba chính thức giới thiệu dòng Qwen 4 gồm các phiên bản Max, Flash, Plus và 27B. Hãng cũng hé lộ lộ trình nâng cấp Qwen 4.5 và Qwen 5 với quy mô tham số lên tới 5-10 nghìn tỷ.

Cùng sự kiện, bài đại diện «Lộ diện dòng Qwen4: Alibaba tham vọng huấn luyện mô hình quy mô 5-10T tham số»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 43/100

D-RAC: Giải pháp chuẩn hóa tài liệu doanh nghiệp cho hệ thống RAG thông qua chuyển đổi PDF đa phương thức

D-RAC tối ưu hóa quy trình RAG bằng cách chuẩn hóa tài liệu sang PDF, sau đó dùng LLM đa phương thức chuyển đổi thành Markdown có cấu trúc, giúp tăng độ chính xác khi truy xuất dữ liệu.

@mark_k@mark_k
Mô hìnhĐiểm AI 45/100

Cùng sự kiệnAlibaba tham vọng đưa mô hình Qwen đạt quy mô 5-10 nghìn tỷ tham số

Alibaba is going big: 5-10 TRILLION parameters for future Qwen models, with artificial superintellig…

DịchAlibaba đang phát triển các thế hệ Qwen tiếp theo với quy mô lên tới 10 nghìn tỷ tham số, tích hợp khả năng tự cải tiến và hỗ trợ bởi chip AI chuyên dụng Zhenwu V900 để hướng tới siêu trí tuệ.

Cùng sự kiện, bài đại diện «Alibaba công bố chiến lược mô hình đa phương thức toàn diện: Tương lai không còn ranh giới»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnDeep Persona: Kiến trúc mô phỏng nhân vật AI dựa trên nền tảng tâm lý học

Deep Persona là kiến trúc ba tầng giúp AI nhập vai chân thực hơn bằng cách mô phỏng niềm tin và động lực cốt lõi thay vì chỉ dựa vào mô tả bề nổi. Hệ thống này còn đi kèm khung đánh giá mới giúp đo lường độ tự nhiên của hội thoại dựa trên các tiêu chuẩn tâm lý học lâm sàng.


Vì sao đáng đọc: Đề tài đột phá trong việc giải quyết tính nhất quán của AI khi nhập vai, kết hợp giữa tâm lý học và kỹ thuật LLM, rất hữu ích cho phát triển chatbot và game.
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 38/100

Chỉ cần 1% Token: Tối ưu hóa chưng cất chính sách trực tuyến (OPD) bằng lý thuyết thông tin

Nghiên cứu chỉ ra rằng có thể đạt hiệu suất tương đương hoặc vượt trội so với chưng cất toàn phần chỉ với 0,1%-1% token. Bằng cách sử dụng chỉ số hiệu quả thông tin (IER), phương pháp này giúp chọn lọc dữ liệu huấn luyện tối ưu, tiết kiệm tài nguyên đáng kể cho các mô hình ngôn ngữ lớn.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 39/100

onPanda: Công cụ tối ưu hóa dữ liệu căn chỉnh LLM và AI Agent thông qua chỉnh sửa cấp độ token

onPanda là công cụ hỗ trợ gán nhãn dữ liệu hiệu quả, cho phép người dùng can thiệp trực tiếp vào các token sai lệch trong quá trình mô hình tạo văn bản, từ đó giúp tinh chỉnh LLM và AI Agent chính xác hơn.

QbitAI
Mô hìnhĐiểm AI 85/100

Cùng sự kiệnChuyên gia Alibaba hé lộ: Các phiên bản Qwen tương lai sẽ đạt quy mô 5-10 nghìn tỷ tham số

Sau phiên bản Qwen4.5, Alibaba dự kiến sẽ nâng cấp các mô hình ngôn ngữ lớn tiếp theo lên quy mô từ 5 đến 10 nghìn tỷ tham số để tăng cường sức mạnh xử lý.

Cùng sự kiện, bài đại diện «Alibaba công bố chiến lược mô hình đa phương thức toàn diện: Tương lai không còn ranh giới»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 45/100

RRSI: Phương pháp tự cải tiến đệ quy giúp AI Agent tránh quá tải và tối ưu hiệu suất

RRSI giải quyết vấn đề quá tải khi AI Agent tự cải tiến bằng cách sử dụng cơ chế kiểm soát ngân sách thời gian, bộ lọc phê bình và công cụ cắt tỉa để đảm bảo các thay đổi thực sự hiệu quả trên nhiều tác vụ khác nhau.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (46 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “llm” — Trang 3 | AIHOT.vn