Hôm nay · 28/09

Thứ Hai · 1 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 54/100

Jev và sự bình thường hóa những thất bại không thể giải thích

Bài viết phê phán việc người dùng Jev bỏ qua quy trình đánh giá (evals) và chấp nhận sự thất bại của AI như một điều hiển nhiên, thay vì tìm hiểu nguyên nhân gốc rễ. Tác giả cảnh báo xu hướng đổ lỗi cho tính bất định của LLM thay vì xây dựng các bộ kiểm thử đơn giản để cải thiện hệ thống.

Hôm qua · 27/09

Chủ Nhật · 8 tin
QbitAI
NgànhĐiểm AI 92/100

Tinh chọnStartup AI lượng tử từ 'đội hình mơ ước' Thanh Hoa: Định giá 1 tỷ USD, tham vọng tái cấu trúc nền tảng LLM

Một startup quy tụ các tài năng từ Đại học Thanh Hoa vừa gọi vốn thành công với định giá 1 tỷ USD, tập trung ứng dụng công nghệ tính toán lượng tử để tối ưu hóa kiến trúc hạ tầng cho các mô hình ngôn ngữ lớn (LLM).


Vì sao đáng đọc: Tin tức về sự kết hợp giữa AI và điện toán lượng tử là xu hướng công nghệ đột phá, đặc biệt khi startup này đạt mức định giá kỳ lân với đội ngũ nhân sự chất lượng cao.
Hacker News: AI bài nổi bật
Nghiên cứuĐiểm AI 54/100

Nghiên cứu mới: Chat template đóng vai trò như 'công tắc' điều khiển giọng điệu tự nhận thức của LLM

Nghiên cứu trên arXiv chỉ ra rằng chat template ảnh hưởng mạnh mẽ đến cách LLM tự xưng danh. Việc loại bỏ template giúp giảm đáng kể các câu từ chối trách nhiệm máy móc và tăng tỷ lệ phản hồi mang tính trải nghiệm cá nhân hơn.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 67/100

Cùng sự kiệnPrivatemode biến GLM-5.3-Flash thành mô hình ra quyết định có cấu trúc chỉ với một lần suy luận

Nhóm Privatemode giới thiệu kỹ thuật không cần tinh chỉnh, tận dụng log probability của GLM-5.3-Flash để thực hiện các quyết định có kiểu dữ liệu cụ thể chỉ trong một lần forward pass.

Cùng sự kiện, bài đại diện «Hướng dẫn sử dụng Jev: Kiểm duyệt nội dung với mô hình ra quyết định của TypeSafe trên OpenRouter»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 36/100

Khi cộng đồng Stack Overflow bị LLM thay thế: Lời tự sự từ một kỹ sư

Tác giả chia sẻ về giá trị kết nối giữa người với người trên Stack Overflow trong giai đoạn khó khăn, đồng thời cảnh báo rằng dù LLM giải quyết vấn đề nhanh chóng, chúng không thể thay thế sự thấu cảm và cảm giác thuộc về của một cộng đồng thực thụ.

Arena@arena
Mô hìnhĐiểm AI 78/100

Đã có đại diệnClaude Opus 5.5 (High) chính thức soán ngôi đầu bảng xếp hạng Text Arena với 1509 điểm

Claude Opus 5.5 (High) debuts at #1 in Text Arena with 1509 pts! That's an 18-pt improvement over O…

DịchClaude Opus 5.5 (High) vừa vươn lên dẫn đầu Text Arena với 1509 điểm, vượt qua phiên bản tiền nhiệm 18 điểm. Anthropic hiện đang thống trị top 6 bảng xếp hạng, trong khi Opus 5.5 (High) cũng đạt hiệu suất chi phí tối ưu với mức giá 16 USD/triệu token.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»

26/09

Thứ Bảy · 13 tin
Elvis Saravia@omarsar0
Sản phẩmĐiểm AI 52/100

Cùng sự kiệnOpenRouter ra mắt Jev Router: Tự động tối ưu hóa mô hình và chi phí cho mọi truy vấn LLM

This is one of the strongest use cases I've seen for System One models like Jev. Pay close attenti…

DịchJev Router giúp tự động chọn mô hình và mức độ suy luận phù hợp cho từng yêu cầu. Thử nghiệm cho thấy hiệu suất tương đương GPT-6 Sol nhưng giảm hơn 50% chi phí và cải thiện tốc độ phản hồi.

Cùng sự kiện, tinh chọn hiển thị «So sánh Jev 1.13 và Claude Opus 5: Hiệu năng phân loại dữ liệu ngân hàng trên OpenRouter»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 62/100

Xây dựng trình bao bọc LLM phong cách Jev: Tối ưu hóa phản hồi qua xác suất token và hỗ trợ thị giác

Tác giả allanrbo giới thiệu cách tiếp cận đơn hàm (single-function) để ép LLM trả về lựa chọn thông qua logprobs, đồng thời mở rộng hỗ trợ đầu vào hình ảnh cho các mô hình thị giác.

Elvis Saravia@omarsar0
Nghiên cứuĐiểm AI 47/100

MIT CSAIL giới thiệu JAZ: Khung làm việc tối giản cho AI Agent

Keep your agent harness minimal, folks. This paper from MIT CSAIL shows why. (bookmark it) While …

DịchMIT CSAIL ra mắt JAZ, một khung làm việc cho AI Agent cực kỳ tinh gọn với duy nhất một nguyên lý 'invoke'. Hệ thống cho phép LLM tự viết mã, gọi đệ quy và quản lý toàn bộ lịch sử tương tác như các biến trong môi trường lập trình.

Thomas Wolf (Hugging Face đồng sáng lập/CSO)@Thom_Wolf
Nghiên cứuĐiểm AI 43/100

Đột phá: LLM có thể tự khám phá các định lý toán học thú vị mà không cần con người

this is important

DịchNghiên cứu mới cho thấy LLM có khả năng tự tìm ra các định lý toán học quan trọng nhờ định nghĩa định lượng về 'độ thú vị', giúp tăng hiệu suất khám phá lên 4,3 lần thông qua vòng lặp tự mở rộng.

Thêm 1 nguồn khác đưa tinHugging Face Daily Papers
JiQiZhiXin
Nghiên cứuĐiểm AI 92/100

Tinh chọnNature Machine Intelligence: Tín hiệu não người giúp tối ưu hóa khả năng suy luận của mô hình ngôn ngữ

Nghiên cứu mới từ ĐH Bắc Kinh, Thanh Hoa và Microsoft cho thấy việc sử dụng tín hiệu fMRI từ não người có thể định hướng và cải thiện độ chính xác, tính bền vững trong suy luận của các mô hình ngôn ngữ lớn.


Vì sao đáng đọc: Nghiên cứu đột phá kết nối khoa học thần kinh và AI, chuyển từ việc chỉ so sánh biểu diễn sang ứng dụng thực tế để cải thiện hiệu năng mô hình, rất có giá trị học thuật.
QbitAI
Sản phẩmĐiểm AI 92/100

Tinh chọnChạy mô hình 700 tỷ tham số GLM trên laptop không cần GPU? Colibrì gây sốt khi biến SSD thành VRAM

Dự án mã nguồn mở Colibrì đang làm mưa làm gió trên GitHub nhờ khả năng chạy các mô hình ngôn ngữ khổng lồ trên phần cứng phổ thông bằng cách tận dụng SSD làm bộ nhớ đồ họa.


Vì sao đáng đọc: Công nghệ đột phá giúp hạ thấp rào cản phần cứng cho AI, giải quyết bài toán VRAM vốn là rào cản lớn nhất cho người dùng cá nhân khi chạy mô hình lớn.
Rohan Paul@rohanpaul_ai
Mô hìnhĐiểm AI 48/100

Cùng sự kiệnPhân tích phong cách viết của Claude Opus 5.5: Giảm 95% việc lạm dụng dấu gạch ngang

Claude Opus 5.5 simply writes better. Em dashes fall from 15.2 to 0.8 per 1, 000 words, a 95% drop, …

DịchPhân tích cho thấy Claude Opus 5.5 cải thiện rõ rệt văn phong so với bản 5.0, với câu văn ngắn gọn hơn, giảm đáng kể dấu gạch ngang và dấu chấm phẩy, giúp văn bản trở nên tự nhiên và dễ đọc hơn.

Cùng sự kiện, tinh chọn hiển thị «Anthropic giải mã lý do Claude Opus 5.5 là lựa chọn tối ưu cho lập trình với ngữ cảnh dài»
@typesafeai@typesafeai
Sản phẩmĐiểm AI 44/100

Cùng sự kiệnOpenRouter tích hợp Jev: Bộ định tuyến thông minh giúp tối ưu hóa chi phí và tốc độ LLM

You've never routed like this before. @OpenRouter is bringing Jev to all of your LLM calls, so your…

DịchOpenRouter vừa ra mắt Jev Router, công cụ định tuyến thông minh giúp tự động chọn mô hình và cường độ suy luận tối ưu cho từng yêu cầu, giúp tiết kiệm token mà vẫn đảm bảo chất lượng.

Cùng sự kiện, tinh chọn hiển thị «So sánh Jev 1.13 và Claude Opus 5: Hiệu năng phân loại dữ liệu ngân hàng trên OpenRouter»
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Cùng sự kiệnHọc cách khám phá toán học thú vị: Định nghĩa mới về giá trị của các định lý

Nghiên cứu đề xuất phương pháp đo lường độ thú vị của định lý toán học dựa trên tỷ lệ giữa độ dài chứng minh và phát biểu, đồng thời huấn luyện mô hình 27B để dự đoán độ khó chứng minh hiệu quả hơn các mô hình hiện nay.

Cùng sự kiện, bài đại diện «Đột phá: LLM có thể tự khám phá các định lý toán học thú vị mà không cần con người»
@typesafeai@typesafeai
Sản phẩmĐiểm AI 36/100

DSPy 3.4.0 ra mắt: Hỗ trợ nguyên bản Jev và System One

DSPy methodology 🤝 System One Program, don't prompt!

DịchDSPy 3.4.0 vừa phát hành với khả năng hỗ trợ trực tiếp các mô hình Jev và System One, thay thế phương pháp viết prompt truyền thống. Bản cập nhật này cũng giới thiệu trình tối ưu hóa ReAnchor giúp hiệu chỉnh độ tin cậy cho đầu ra của mô hình.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Quan điểmĐiểm AI 73/100

Cùng sự kiệnCòn Rails thì sao? DHH gây tranh cãi khi Hey từ bỏ Rails tại Rails World 2026

DHH thông báo 37signals sẽ dùng LLM viết lại Hey bằng ngôn ngữ native và Rust thay vì Rails. Ông tiết lộ 150.000 dòng code đã được tạo bởi AI trong tháng 8, trong khi Ruby chỉ chiếm 3% sản lượng code năm nay.

Cùng sự kiện, bài đại diện «Nhà sáng lập Ruby on Rails, DHH, tuyên bố ngừng viết code thủ công»

25/09

Thứ Sáu · 13 tin
@completeskeptic@completeskeptic
Sản phẩmĐiểm AI 47/100

DSPy 3.4.0 ra mắt: Tích hợp ReAnchor giúp tối ưu hóa độ tin cậy của mô hình

this is an honor! 🥹

DịchDSPy 3.4.0 vừa chính thức phát hành với khả năng hỗ trợ native cho các mô hình Jev và System one. Điểm nhấn của bản cập nhật này là trình tối ưu hóa ReAnchor hoàn toàn mới, giúp người dùng hiệu chỉnh độ tin cậy cho kết quả đầu ra một cách hiệu quả.

Meituan LongCat@Meituan_LongCat
Mô hìnhĐiểm AI 55/100

Meituan ra mắt LongCat-2.5-Preview: 1.6T tham số, cửa sổ ngữ cảnh 1M token và đa phương thức gốc

LongCat-2.5-Preview is now live. 1.6T parameters. ~48B active. A 1M-token context window. Natively …

DịchMeituan giới thiệu LongCat-2.5-Preview với 1.6T tham số (48B kích hoạt), hỗ trợ cửa sổ ngữ cảnh 1M token và khả năng đa phương thức gốc, tối ưu cho các tác vụ phức tạp trên trình duyệt, GUI và thiết kế.

Diễn biến sự kiện · 5 bài →Thêm 3 nguồn khác đưa tinX: opencode (@opencode)IT HomeX: karminski (@karminski3)
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 44/100

Transformer có thể chứa hai luồng tư duy cùng lúc: Bằng chứng về sự chồng chất tuyến tính trong LLM

Nghiên cứu chứng minh Transformer có khả năng xử lý đồng thời hai luồng văn bản thông qua sự chồng chất tuyến tính, cho phép giải mã song song hai kết quả từ một lần chạy duy nhất.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 36/100

Từ loại (PoS) như những danh mục mới nổi trong không gian tiềm ẩn của SAE

Nghiên cứu khám phá cách Sparse AutoEncoders (SAE) biểu diễn cấu trúc ngôn ngữ thông qua từ loại. Kết quả cho thấy các danh mục từ loại được hình thành từ các nhóm latent ổn định, không phụ thuộc vào bộ nhớ từ vựng đơn thuần.

HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 41/100

IterSynth: Tối ưu hóa tác vụ tìm kiếm chuyên sâu thông qua cơ chế tách biệt vai trò và tổng hợp lặp

IterSynth giới thiệu phương pháp tìm kiếm chuyên sâu mới, tách biệt vai trò giữa lập kế hoạch và tổng hợp thông tin, giúp giải quyết hiệu quả vấn đề quá tải ngữ cảnh và xung đột vai trò trong các tác vụ tìm kiếm phức tạp.

Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 36/100

Boltzbit công bố nghiên cứu 'Infinite-Parameter LLMs' với kiến trúc BAST đột phá

There are two ways to make an agent improve. One is to leave the model unchanged and accumulate doc…

DịchBoltzbit giới thiệu Bayesian Self-learning Transformers (BAST), cho phép cập nhật tham số theo thời gian thực với chi phí tính toán thấp hơn 1.000 lần so với huấn luyện truyền thống, vượt trội hơn RAG trong các tác vụ hội thoại dài.

Baseten Blog kỹ thuật (Web)
Sản phẩmĐiểm AI 54/100

Cùng sự kiệnLangSmith ra mắt tính năng Fine-Tuning, hỗ trợ CLI smithtune để tinh chỉnh mô hình trên Baseten Loops

LangChain vừa giới thiệu LangSmith Fine-Tuning tại hội nghị Interrupt, cho phép chuyển đổi các lượt chạy thành công từ LangSmith thành tập dữ liệu huấn luyện thông qua công cụ CLI mã nguồn mở smithtune trên nền tảng Baseten Loops.

Cùng sự kiện, bài đại diện «LangChain ra mắt tính năng LangSmith Fine-Tuning và công cụ CLI SmithTune»
vLLM Blog chính thức
Sản phẩmĐiểm AI 66/100

Tinh chọnvLLM tích hợp tính năng đóng dấu bản quyền văn bản không mất dữ liệu bằng Gumbel-max

vLLM vừa bổ sung thuật toán Gumbel-max vào pipeline lấy mẫu của Model Runner v2, cho phép đóng dấu bản quyền văn bản mà không làm giảm chất lượng, đồng thời hỗ trợ giải mã suy đoán và duy trì tính đa dạng của nội dung.


Vì sao đáng đọc: Bài viết cung cấp nguyên lý thuật toán đóng dấu bản quyền, phương án khóa kép và khử trùng lặp cùng dữ liệu thông lượng thực tế, giúp độc giả đánh giá tính khả thi và chi phí khi kích hoạt watermark trong môi trường sản xuất.

24/09

Thứ Năm · 24 tin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 58/100

Best Model for Your Budget: Công cụ cập nhật hàng ngày giúp chọn LLM tối ưu chi phí

Trang web mới của terryds giúp người dùng chọn LLM phù hợp nhất với ngân sách bằng cách đối chiếu chỉ số thông minh (Intelligence Index) với giá thành thực tế, cập nhật dữ liệu hàng ngày từ Artificial Analysis.

@completeskeptic@completeskeptic
Mô hìnhĐiểm AI 18/100

Cùng sự kiệnMô hình jev chính thức dẫn đầu bảng xếp hạng OpenRouter cho ngữ cảnh ngắn

jev is the top model at 1k-10k context on openrouter!

DịchMô hình jev đã vượt qua các đối thủ để chiếm vị trí số 1 trên OpenRouter trong phân khúc xử lý ngữ cảnh từ 1k đến 10k token.

Cùng sự kiện, tinh chọn hiển thị «So sánh Jev 1.13 và Claude Opus 5: Hiệu năng phân loại dữ liệu ngân hàng trên OpenRouter»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 45/100

Nghiên cứu mới: LLM sở hữu cấu trúc tư duy nội tại tách biệt với văn bản đầu ra

The paper finds that LLM reasoning has an internal structure beyond the words being generated, openi…

DịchNghiên cứu chỉ ra rằng LLM vận hành các quy trình suy luận riêng biệt như tính toán hay suy diễn bên trong cấu trúc nội tại, ngay cả khi kết quả đầu ra bị sai. Điều này chứng minh mô hình có khả năng biểu diễn ý định tư duy độc lập với ngôn ngữ được tạo ra.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (66 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “LLM” | AIHOT.vn