
28,8 Triệu Lượt Gọi API: Đòn Tấn Công Vào Trái Tim Của AI Thương Mại
Một con số. 28,8 triệu. Đó không phải là số lượng giao dịch Bitcoin trong một ngày. Đó là số lần mà, theo Anthropic, phòng thí nghiệm Qwen của Alibaba đã gọi API của mô hình Claude để... học lỏm kiến thức. Nếu bạn nghĩ đây chỉ là một vụ ăn cắp công nghệ thông thường, bạn đã bỏ lỡ bức tranh lớn hơn. Cuộc chiến thực sự đang diễn ra trên mặt trận cơ sở hạ tầng và mô hình kinh doanh.
Khi tôi còn là một nhà phân tích dữ liệu tại một sàn giao dịch nhỏ vào năm 2017, tôi nhận ra điều tương tự: những kẻ lừa đảo ICO không cần tấn công hệ thống; chúng chỉ cần lợi dụng các quy tắc được viết cho người dùng trung thực. Hôm nay, câu chuyện cũ được viết lại với mực mới. Anthropic, công ty AI được định giá hàng chục tỷ đô la, phát hiện ra rằng một trong những đối thủ cạnh tranh lớn nhất châu Á đã thực hiện hàng chục triệu truy vấn đến API của họ – một hành vi được gọi là 'chiết xuất mô hình' (model distillation). Về mặt kỹ thuật, đó là một phương pháp hợp pháp để nén mô hình. Nhưng ở quy mô 28,8 triệu, nó vượt qua ranh giới của nghiên cứu và trở thành một cuộc tấn công có chủ đích.
Hãy nói về sự thật. Số lần gọi API này không phải là ngẫu nhiên. Trong lĩnh vực khoa học dữ liệu, một tập dữ liệu lớn như vậy đủ để huấn luyện một mô hình ngôn ngữ nhỏ nhưng mạnh mẽ – gần như tái tạo lại khả năng của Claude. Chi phí cho phía Qwen? Khoảng 288.000 đô la nếu tính theo giá API niêm yết (giả sử $0.01 cho mỗi lần gọi). Chi phí cho Anthropic? Hàng triệu đô la để vận hành GPU phản hồi, cộng với tổn thất vô hình về lợi thế cạnh tranh. Đây là sự bất cân xứng về chi phí cốt lõi: kẻ tấn công trả ít hơn nhiều so với nạn nhân phải gánh chịu. Từ kinh nghiệm theo dõi dòng chảy thanh khoản DeFi của tôi, tôi biết rằng các cuộc tấn công quy mô lớn thường bắt đầu bằng một loạt giao dịch nhỏ, sau đó tăng tốc. Nhưng ở đây, không có giai đoạn thăm dò. 28,8 triệu là một cú đánh trực diện.
Điều khiến tôi chú ý không phải là cáo buộc đạo đức – mà là góc khuất về mặt kỹ thuật. Hầu hết các cuộc thảo luận tập trung vào việc “có nên hay không”. Nhưng câu hỏi thực sự là: làm thế nào để phát hiện một cuộc tấn công như vậy? Anthropic có thể đã sử dụng các mẫu hành vi bất thường: thời gian giữa các yêu cầu quá đều, nội dung truy vấn lặp lại một cách có hệ thống, và tỷ lệ thành công cao bất thường trong việc trích xuất thông tin. Tôi đã từng xây dựng một bot phát hiện ICO scam từ dữ liệu on-chain, và nguyên tắc tương tự áp dụng ở đây: nếu ai đó mua token với số lượng quá lớn và quá đều đặn, đó là tín hiệu. Nhưng với API, ranh giới giữa người dùng hợp pháp và kẻ tấn công còn mờ hơn nhiều. Điều này đặt ra một thách thức: các công ty AI có thể sẽ phải tăng cường giám sát, nhưng điều đó cũng làm tăng chi phí cho mọi người dùng.
Góc nhìn phản trực giác: Đây không phải là một vụ trộm cắp công nghệ. Đó là một tín hiệu thị trường rõ ràng rằng mô hình kinh doanh API của các công ty AI đang bị phá vỡ từ bên trong. Nếu một đối thủ có thể sao chép khả năng của bạn chỉ bằng cách gọi API, thì lợi thế cạnh tranh của bạn không nằm ở mô hình, mà nằm ở dữ liệu độc quyền, mối quan hệ khách hàng, hoặc khả năng tích hợp hệ sinh thái. Qwen, dù có tội hay không, đã chỉ ra một lỗ hổng cấu trúc. Các nhà đầu tư nên nhìn vào điều này: các công ty AI có bảo vệ API của họ đủ mạnh không? Họ có đang xây dựng hào kỹ thuật hay chỉ dựa vào niềm tin?
Kết luận của tôi: Bạn không thể ngăn dòng chảy thông tin. Nhưng bạn có thể điều chỉnh cống. Sự kiện này sẽ thúc đẩy một cuộc chạy đua vũ trang trong lĩnh vực bảo mật AI. Những công ty đầu tư vào phát hiện và phòng chống chiết xuất mô hình sẽ sống sót. Những công ty chỉ dựa vào sự ngây thơ sẽ bị bỏ lại phía sau. Hãy theo dõi các động thái tiếp theo từ cả hai phía, và đừng quên rằng trên thị trường này, dữ liệu không bao giờ nói dối.