Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
85

Mô hình

Kimi ra mắt K3-256k: Tối ưu hóa cho lập trình với cửa sổ ngữ cảnh 256k

(giờ Việt Nam)

Tóm tắt AI

Kimi giới thiệu mô hình K3-256k hỗ trợ cửa sổ ngữ cảnh 256k, được tối ưu chuyên biệt cho việc tạo và hiểu mã nguồn, giúp lập trình viên xử lý hiệu quả các dự án quy mô lớn.

Bản dịch AI

Cấu hình Model

Trang này bao gồm các model mà Kimi Code cung cấp và cách chuyển đổi giữa chúng trong mỗi client.

Tổng quan về Model

Kimi Code hiện cung cấp hai model—Kimi K3 và Kimi K2.7 Code—thông qua bốn ID model, có thể lựa chọn theo ID model trong các client hoặc công cụ của bên thứ ba. Thông số kỹ thuật của model:

Ra mắt model được đề xuất

k3-256k hiện đã khả dụng. Trong phạm vi ngữ cảnh 256k, nó mang lại kết quả tương đương. k3 (1M) tiêu tốn hạn mức gấp đôi so với k3-256k. Đây là lựa chọn lý tưởng cho các tác vụ hỏi đáp hàng ngày, hoàn thiện mã nguồn, phát triển tính năng thông thường và chỉnh sửa tệp đơn lẻ hoặc tệp nhỏ — không hỗ trợ đầu vào video.

💓 Lưu ý

Chuyển đổi từ K3 (1M) sang K3-256k: Khi chuyển từ k3 (1M) sang k3-256k, nếu ngữ cảnh của phiên làm việc hiện tại đã vượt quá 256k, một số công cụ lập trình như Kimi Code CLI và Claude Code sẽ thực hiện nén (compact) ở phía công cụ.

Khuyến nghị khi chuyển đổi: (1) Vì các công cụ agent khác nhau xử lý việc này theo cách khác nhau, hãy thực hiện nén thủ công một lần trước khi chuyển đổi để thu gọn ngữ cảnh xuống dưới 256k. Điều này giúp bảo toàn các điểm chính của tác vụ, giữ nguyên phiên làm việc và cho phép bạn hưởng lợi từ hạn mức bền vững hơn sau khi chuyển đổi. (2) Nếu lịch sử hội thoại bao gồm các tệp video, việc chuyển đổi trực tiếp sẽ thất bại vì K3-256k không hỗ trợ đầu vào video. Vui lòng nén trước, sau đó mới chuyển đổi.

Chuyển đổi từ K3-256k sang K3 (1M): Khi chuyển từ k3-256k sang k3 (1M), nếu k3-256k đang gần đạt giới hạn 256k và bạn không muốn việc nén làm mất thông tin, bạn có thể chuyển trực tiếp sang 1M. Phiên bản hiện tại khi chuyển từ 256k sang 1M sẽ không ảnh hưởng đến bộ nhớ đệm (cache).

Bạn cần gói thành viên cao cấp hơn?

Các gói thành viên khác nhau sẽ mở khóa các model, cửa sổ ngữ cảnh và tốc độ khác nhau. Nâng cấp gói của bạn →

Sau khi chuyển đổi model, bộ nhớ đệm ngữ cảnh đã xây dựng trước đó sẽ không còn khớp với model mới, vì vậy ngữ cảnh đó phải được nạp trước (re-prefilled). Do đó, mức sử dụng sẽ hiển thị cao hơn ngay sau khi chuyển đổi. Hành động được khuyến nghị:

Khi khả năng được yêu cầu vượt quá quyền hạn trong gói của bạn, máy chủ sẽ trả về lỗi 401. Ba trường hợp phổ biến:

Để biết toàn bộ nội dung lỗi và cách xử lý, hãy xem Tài liệu tham khảo về lỗi (Error Reference).

Hai lý do phổ biến:

Việc thay đổi nỗ lực suy luận (reasoning effort) sẽ làm mất hiệu lực của bộ nhớ đệm ngữ cảnh mà bạn đã xây dựng, vì vậy ngữ cảnh lẽ ra có thể khớp với bộ nhớ đệm sẽ phải được nạp lại. Để tránh kích hoạt việc nạp lại quá thường xuyên:

Cách chuyển đổi Model

Lưu ý về cách sử dụng

Các cách để chuyển sang model mục tiêu:

Các client chính thức

Các công cụ của bên thứ ba

Thiết lập Model ID của công cụ thành model mục tiêu. Các bước chi tiết:

Kimi Code API hỗ trợ cả giao thức của OpenAI và Anthropic. Các Base URL:

Để biết các bước thiết lập chi tiết, hãy xem hướng dẫn công cụ tương ứng:

Trước khi sử dụng K3 trong các công cụ của bên thứ ba

Thiết lập của K3 hơi khác so với K2.7 Code. Trước khi sử dụng, hãy kiểm tra hai điểm dưới đây:

KimiLập trìnhAIMô hình ngôn ngữ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.