Jiqizhixin
85

Nghiên cứu

Looped Transformer có thực sự mạnh hơn? Câu trả lời từ nghiên cứu của Thanh Hoa và ByteDance

(giờ Việt Nam)

Tóm tắt AI

Nghiên cứu SMELT từ Đại học Thanh Hoa và ByteDance giải mã hiệu năng của Looped Transformer bằng cách so sánh công bằng về chi phí tính toán, tham số và KV cache, khẳng định tiềm năng của việc tái sử dụng các lớp mạng thay vì chỉ tăng quy mô mô hình.

Bản dịch AI

CVPR 2026: Đại học Thanh Hoa và ByteDance đồng công bố khung tăng tốc mô hình khuếch tán TAP

Nhóm nghiên cứu từ Đại học Thanh Hoa và ByteDance đã đề xuất TAP (Token-Adaptive... giúp duy trì chất lượng mẫu trong cùng một ngân sách tính toán. Đối với mô hình chưng cất FLUX-...

Trí Tích Tương Lai (ZhiXi Future)

Phá đảo KernelBench! Seed của ByteDance kết hợp cùng Thanh Hoa đề xuất CUDA Agent: Tăng cường học tập cho tác nhân thông minh quy mô lớn để tạo nhân CUDA

Tháng..., nhóm nghiên cứu AIR của Đại học Thanh Hoa và nhóm Seed của ByteDance đã cùng công bố một nghiên cứu quan trọng... đưa ra câu trả lời của họ. Trong bài viết này, chúng ta sẽ đi sâu vào phân tích công trình này,...

Tuệ Cực Sinh Hoạt (HuiJi Life)

[Nguồn nước đầu nguồn] Tác phẩm mới từ nhóm của Giáo sư Chu Quân (Thanh Hoa): Huấn luyện Transformer bằng số nguyên 4-bit, nhanh hơn 2,2 lần so với FP16, tăng tốc 35,1%, thúc đẩy sự xuất hiện của AGI!

Ngoài các tác vụ dịch máy quy mô lớn và Transformer thị giác quy mô lớn, chúng tôi sẽ... ReCon sẽ cho bạn câu trả lời. AAAI 2023 Oral | ByteDance đề xuất lấy mẫu lại hình ảnh bất đối xứng...

Giảng tập tiên phong về trí tuệ nhân tạo

Cột mốc quan trọng trong tạo ảnh! VAR: Mô hình tự hồi quy đầu tiên vượt qua Diffusion Transformer! (Đại học Bắc Kinh & ByteDance)

Các mô hình ngôn ngữ dựa vào thuật toán Byte Pair Encoding (BPE) hoặc WordPiece để phân tách văn bản... Số lượng tham số chính của VAR transformer với độ sâu... được tính theo công thức sau: tất cả...

AI kiến tạo tương lai

Thiên Chi Bôi (Heaven's Feel): Nguồn gốc của AI và trò chơi

Transformer không phải là cuộc cách mạng đầu tiên trong lĩnh vực học máy. Trong hai thập kỷ qua,... cần phong cách cá nhân mạnh mẽ hơn và khả năng kiểm soát dự án kiên định hơn. Cuộc đua về "tính tổng quát" trong tương lai...

Internet Monster Thief (Nhóm Quái trộm Internet)

Microsoft đề xuất DR-PO: Tối ưu hóa RLHF dựa trên thiết lập lại tập dữ liệu | Scaling (Down): Hiệu suất mô hình khi thu nhỏ quy mô dưới ngân sách tính toán hạn chế....

(CLIP) khi thu nhỏ quy mô dưới ngân sách tính toán hạn chế. Các tác giả dựa trên dữ liệu, kiến trúc... Mô hình ngôn ngữ tinh chỉnh chỉ dẫn mạnh mẽ hơn bạn nghĩ, là bộ chọn trắc nghiệm... Tiêu đề:...

cheatPPT

Google: Liệu dự đoán token tiếp theo có thực sự mô phỏng được trí tuệ con người? | Meituan: Hé lộ bí ẩn về định luật quy mô (Scaling Laws) | OpenAI: Phương pháp đánh cắp tham số mô hình hộp đen

Bao gồm công nghệ robot và nội soi; các tác giả đề xuất một phương pháp thực hiện trên video phẫu thuật... ByteDance, Đại học Khoa học và Công nghệ Trung Quốc. Tác giả: Tianhao Qi, Shancheng...

cheatPPT

Những kiến thức AI "phải xem" năm 2023! Tổng hợp "Transformer/Mô hình khuếch tán/Nhân quả/Tấn công đối nghịch/Học máy/Đồ thị tri thức/NLP/CV-AI+X"

Bài báo tổng quan mới nhất từ Thanh Hoa và các đơn vị khác về "Học tăng cường Transformer" trình bày chi tiết về tiến trình học đồ thị... Bản tiếng Trung, PDF 402 trang. Đại học Thanh Hoa công bố bài báo tổng quan đầu tiên về "Tự động học máy trên đồ thị"...

Chuyên Tri (ZhuanZhi)

Thiên Chi Bôi (Heaven's Feel): Nguồn gốc của AI và trò chơi | 5Y View

Transformer không phải là cuộc cách mạng đầu tiên trong lĩnh vực học máy. Trong hai thập kỷ qua,... cần phong cách cá nhân mạnh mẽ hơn và khả năng kiểm soát dự án kiên định hơn. Cuộc đua về "tính tổng quát" trong tương lai...

Ngũ Nguyên Tư Bản (5Y Capital)

12 Trang tiếp theo

Tìm thấy khoảng 12 kết quả

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Jiqizhixin. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.