Phiên bản DeepSeek v4.1 Flash Uncensored loại bỏ hoàn toàn bộ lọc an toàn

Nhóm nghiên cứu dealignai vừa cho ra mắt phiên bản DeepSeek-V4.1-Flash Uncensored, ứng dụng kỹ thuật can thiệp trọng số vĩnh viễn (weight-level abliteration) để loại bỏ hoàn toàn các bộ lọc an toàn và cơ chế từ chối phản hồi. Khác với các phương pháp can thiệp thời gian chạy (runtime hooks) hay steering vectors, bản tinh chỉnh này hoạt động như một checkpoint tiêu chuẩn, tương thích hoàn toàn với kiến trúc gốc mà không cần chỉnh sửa mã nguồn mô hình.

Điểm đáng chú ý của phiên bản này là khả năng duy trì trọn vẹn năng lực cốt lõi của mô hình gốc. Các thành phần quan trọng như bộ nhớ Engram, cơ chế chú ý thưa CSA2, đầu dự đoán DSpark, vision tower và hệ thống router đều được giữ nguyên chính xác tới từng byte. Qua kiểm thử trên 11.000 câu hỏi (loại trừ nhóm câu hỏi đạo đức), độ suy giảm hiệu suất chỉ ở mức 1,1 điểm phần trăm, nằm trong ngưỡng mục tiêu bảo tồn tri thức 3 điểm phần trăm.

Về hạ tầng triển khai, nhóm nghiên cứu cung cấp các thiết lập tối ưu hóa cho công cụ phục vụ SGLang trên hệ thống 4 GPU Nvidia H200 NVLink. Nhờ sử dụng bộ nhớ Engram trên host và thuật toán suy đoán DSpark, mô hình có thể xử lý tối đa 256 yêu cầu đồng thời với chiều dài ngữ cảnh lên tới 1 triệu token, mang lại tốc độ phản hồi cực nhanh cho các tác vụ phức tạp.

Sự xuất hiện của DeepSeek-V4.1-Flash Uncensored mang đến cho cộng đồng nghiên cứu AI và các nhà phát triển Việt Nam một công cụ mạnh mẽ, không bị giới hạn bởi các rào cản an toàn khắt khe. Điều này đặc biệt có ý nghĩa với các bài toán nghiên cứu chuyên sâu, phân tích dữ liệu nhạy cảm hoặc ứng dụng đòi hỏi khả năng tư duy mở rộng.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account