Anthropic detecta ataques de destilación a Claude desde laboratorios chinos
Anthropic, desarrollador de modelos de inteligencia artificial, anunció el jueves la detección y neutralización de una serie de ataques de destilación dirigidos a su modelo Claude. Estas operaciones, descritas como de "escala industrial" e "ilícitas", fueron atribuidas a siete laboratorios con sede en China. La información fue reportada por The Hacker News el 11 de septiembre de 2026.
Entre las entidades identificadas en estos ataques se encuentran Alibaba, Moonshot, DeepSeek, Z.ai (también conocida como Zhipu) y MiniMax. Aunque el resumen de la alerta no detalla la metodología específica empleada en estos ataques, Anthropic subraya la naturaleza ilícita de las actividades detectadas.
La destilación de conocimiento es una técnica legítima en el campo del aprendizaje automático, donde un modelo de IA grande y potente actúa como "profesor" para transferir su conocimiento a un modelo más pequeño y eficiente. Sin embargo, en el contexto reportado por Anthropic, esta práctica fue utilizada de manera no autorizada, lo que llevó a la intervención de la compañía para su interrupción.
Fuente original: The Hacker News






