T3 · 18/08

Dex Horthy (HumanLayer)@dexhorthy
Thủ thuật85

Kẻ kế vị GitHub sẽ hoàn toàn khác biệt với những gì chúng ta biết

Dex Horthy nhận định rằng nền tảng thay thế GitHub sẽ không đi theo lối mòn cũ như PR hay CI, mà tập trung vào việc hòa nhập sâu vào quy trình làm việc hiện tại và tạo ra sự tin tưởng tuyệt đối cho từng đơn vị công việc.

GitHubPhát triển phần mềmTương lai công nghệQuy trình làm việcAI
a16z: News
Thủ thuật85

Khi người sáng tạo nội dung bạn yêu thích không có thật: Liệu điều đó có quan trọng?

Một tác giả đã tạo ra Janie, một cô gái ảo bằng AI, để tham gia thử thách tuyển sinh tại ĐH Alabama. Dù không gắn nhãn AI, Janie vẫn thu hút hàng ngàn người theo dõi, đặt ra câu hỏi lớn về khả năng nhận diện và sự trung thực trên các nền tảng mạng xã hội.

AI sáng tạoMạng xã hộiĐạo đức AINgười ảoTikTok
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Harness-IF: ByteDance ra mắt chuẩn đánh giá khả năng tuân thủ chỉ dẫn của AI lập trình

ByteDance giới thiệu Harness-IF, bộ tiêu chuẩn kiểm tra khả năng tuân thủ chỉ dẫn của các AI lập trình khi gặp xung đột với hành vi mặc định. Kết quả cho thấy các mô hình hiện nay vẫn gặp khó khăn với các chỉ dẫn đối kháng, đặt ra dấu hỏi về khả năng kiểm soát thực tế của AI.

AI lập trìnhByteDanceĐánh giá AIHarness-IFLLM
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Nghiên cứu từ UPenn: AI thường 'quên' quy tắc người dùng khi nén dữ liệu hội thoại dài

Nghiên cứu mới chỉ ra rằng các mô hình AI thường quên đi các quy tắc thiết lập khi nén hội thoại dài, dù vẫn nhớ nhiệm vụ chính. Giải pháp đơn giản là sử dụng bộ trích xuất 9B để khôi phục quy tắc, giúp tỷ lệ lưu giữ tăng từ 17% lên hơn 90%.

AINén dữ liệuLLMNghiên cứu AIKỹ thuật Prompt
NLP@dongxi_nlp
Thủ thuật85

Mô hình nhỏ kết hợp công cụ đã chạm trần: Đâu là hướng phát triển tiếp theo?

Chuyên gia đặt nghi vấn về mô hình 1B tham số kết hợp công cụ, cho rằng việc nội hóa tri thức vào tham số có giới hạn và để đạt trí tuệ đỉnh cao vẫn cần các mô hình lớn hơn. Sau kỷ nguyên mở rộng tính toán tiền huấn luyện và suy luận, ngành AI đang tìm kiếm trục mở rộng mới.

Mô hình ngôn ngữXu hướng AILLMSuy luậnKiến trúc AI
Rohan Paul@rohanpaul_ai
Nghiên cứu85

Hiện tượng kích hoạt cực đại trong LLM lai: Điểm nóng trước lớp Attention và sự ổn định giữa các tầng

Các mô hình LLM kiến trúc lai sử dụng lớp tuần hoàn giá rẻ thay thế phần lớn lớp Attention, nhưng các lớp Attention còn lại đóng vai trò quyết định. Nghiên cứu chỉ ra sự xuất hiện của các giá trị nội tại cực đại trước các lớp này, ảnh hưởng trực tiếp đến hiệu suất và cấu trúc mô hình.

LLMKiến trúc AITransformerNghiên cứu AIDeep Learning
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Thủ thuật85

Qwen2.5 27B đạt 52 điểm trên bảng xếp hạng Artificial Analysis, vượt xa các đối thủ cùng phân khúc

Mô hình Qwen2.5 27B gây ấn tượng với 52 điểm trên Artificial Analysis, bỏ xa mức trung bình 9 điểm của các mô hình cùng loại. Với cửa sổ ngữ cảnh 256k tokens và giấy phép Apache 2.0, đây là lựa chọn mạnh mẽ cho xử lý văn bản và hình ảnh.

QwenLLMMã nguồn mởĐánh giá AICông nghệ
Rohan Paul@rohanpaul_ai
Tin ngành85

Groq gọi vốn thành công 350 triệu USD, định giá giảm một nửa còn 3,5 tỷ USD

Groq vừa huy động 350 triệu USD với mức định giá 3,5 tỷ USD, giảm mạnh so với con số 6,9 tỷ USD trước đó sau khi sáp nhập mảng công nghệ cốt lõi vào NVIDIA. Hiện tại, lợi thế cạnh tranh của Groq phụ thuộc hoàn toàn vào khả năng tối ưu hóa chi phí và độ trễ trên nền tảng dịch vụ đám mây.

GroqNVIDIAĐầu tư AIChip AIKinh doanh công nghệ

30 tin mỗi trang · lọc và sắp xếp ngay trên máy chủ (267 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả