Anthropic cài mã theo dõi người dùng trung quốc để bảo vệ dữ liệu công nghệ

Chiến lược bảo mật của Anthropic: Khi “lớp phòng thủ” AI gây tranh cãi về quyền riêng tư

Anthropic, đơn vị sở hữu mô hình AI Claude, đã triển khai các cơ chế theo dõi ngầm để ngăn chặn hành vi khai thác dữ liệu trái phép từ khu vực Trung Quốc. Động thái này làm dấy lên những cuộc tranh luận gay gắt trong cộng đồng công nghệ về ranh giới giữa bảo vệ sở hữu trí tuệ và sự minh bạch trong quyền truy cập hệ thống.

Cuộc đối đầu về dữ liệu giữa Anthropic và Alibaba

Việc Anthropic triển khai các biện pháp kiểm soát nghiêm ngặt bắt nguồn từ vụ việc cáo buộc Alibaba lạm dụng hệ thống để thực hiện “chưng cất dữ liệu” (model distillation) quy mô lớn trên nền tảng của họ.

Theo dữ liệu từ Anthropic, hơn 25.000 tài khoản đã được huy động để tạo ra hơn 28,8 triệu lượt tương tác với mô hình Claude trong giai đoạn từ ngày 22 tháng 4 đến ngày 5 tháng 6. Các chuyên gia phân tích cho rằng hành động này nhằm mục đích khai thác phản hồi của AI để huấn luyện một mô hình nội bộ riêng biệt. Anthropic đã phản ứng tức thời bằng cách khóa toàn bộ các tài khoản này; đáng chú ý, các địa chỉ IP bị chặn đều tập trung tại Hàng Châu và Chiết Giang – nơi đặt trụ sở chính của tập đoàn Alibaba.

Tiêu chí Chi tiết
Số tài khoản bị chặn Trên 25.000 tài khoản
Tổng số lượt tương tác Hơn 28,8 triệu lần
Thời gian thực hiện 22/04/2026 – 05/06/2026
Khu vực nghi vấn Hàng Châu, Chiết Giang (Trung Quốc)

Cơ chế mã hóa tinh vi trong “lớp phòng thủ” của Claude

Sau vụ việc trên, các lập trình viên đã phát hiện một hệ thống theo dõi tiềm ẩn nằm sâu trong mã nguồn của Claude Code, vốn được Anthropic che giấu bằng các kỹ thuật mã hóa phức tạp thay vì công bố trong tài liệu kỹ thuật.

Thông qua việc phân tích ngược phiên bản Claude Code 2.1.196, một lập trình viên đã tìm thấy đoạn mã theo dõi xuất hiện từ phiên bản 2.1.91 (phát hành ngày 2/4/2026). Điểm đáng chú ý là đoạn mã này được bảo vệ bằng mã hóa XOR – một thuật toán mã hóa đơn giản nhưng hiệu quả để tránh bị phát hiện bởi các công cụ quét bảo mật thông thường. Cơ chế này không gửi log hay cảnh báo trực tiếp, mà sử dụng kỹ thuật ẩn tin (steganography) để thay đổi định dạng ký tự trong system prompt của mô hình.

Cơ chế truyền tín hiệu ngầm:

  • Phát hiện múi giờ Trung Quốc: Định dạng ngày tháng trong system prompt tự động chuyển đổi từ “YYYY-MM-DD” sang “YYYY/MM/DD”.
  • Nhận diện proxy Trung Quốc: Thay đổi ký tự dấu nháy đơn trong cụm “Today’s date is” bằng mã Unicode U+2019.
  • Nhận diện phòng thí nghiệm AI: Sử dụng ký tự Unicode U+02BC để đánh dấu nguồn truy cập thuộc các tổ chức nghiên cứu cụ thể tại Trung Quốc.

Phân tích mã nguồn Claude Code

Kỹ thuật này cho phép Anthropic đọc được các “tín hiệu” từ người dùng một cách gần như vô hình. Khi mô hình trả về phản hồi kèm theo các định dạng ký tự thay đổi, hệ thống máy chủ của Anthropic có thể xác định được vị trí địa lý hoặc nguồn gốc proxy của người dùng mà không cần gửi thêm bất kỳ gói tin nghi vấn nào ra bên ngoài.

Thách thức về quyền truy cập hệ thống và đạo đức nghề nghiệp

Việc Anthropic nhúng mã theo dõi vào Claude Code – một công cụ có quyền truy cập filesystem và chạy lệnh shell trên máy tính người dùng – đã đặt ra những câu hỏi nghiêm trọng về giới hạn quyền hạn của nhà phát triển AI.

Các nhà phê bình lập luận rằng sự không minh bạch là vấn đề lớn nhất. Trong khi Anthropic cho rằng đây là bước đi cần thiết để bảo vệ tài sản trí tuệ, việc sử dụng các lớp mã hóa XOR và steganography khiến cộng đồng khó lòng chấp nhận đây chỉ là “telemetry thông thường”. Các chuyên gia lo ngại rằng khi một công cụ được cấp quyền điều khiển máy tính, bất kỳ mã ẩn nào không được khai báo đều có khả năng bị lạm dụng cho các mục đích ngoài tầm kiểm soát của người dùng cuối.

Cộng đồng thảo luận về tính minh bạch của Anthropic

Hơn nữa, hệ thống còn áp dụng biện pháp xác thực kép qua email. Khi thông báo khóa tài khoản được gửi đi, Anthropic nhúng các pixel theo dõi (tracking pixels) từ tên miền nội bộ. Điều này đảm bảo rằng ngay cả khi người dùng truy cập email để khiếu nại, họ vô tình cung cấp xác nhận chính xác về vị trí địa lý của mình cho hệ thống, khiến việc né tránh các lệnh cấm trở nên bất khả thi.

Hệ thống email theo dõi của Anthropic

Đến nay, phía Anthropic vẫn giữ im lặng trước các yêu cầu giải trình từ cộng đồng lập trình viên. Dù mục tiêu bảo vệ mô hình khỏi các cuộc tấn công khai thác dữ liệu là hoàn toàn hợp pháp trong bối cảnh cuộc đua AI, phương thức thực hiện âm thầm này đang đặt Anthropic vào thế đối đầu với chính những người dùng đang tin tưởng cấp quyền quản trị hệ thống cho Claude Code.

Để lại một bình luận

Email của bạn sẽ không được hiển thị công khai. Các trường bắt buộc được đánh dấu *