Китайські розробники ШІ звинувачуються у створенні фейкових акаунтів для навчання
Незаконна діяльність китайських компаній
Американський стартап у сфері штучного інтелекту Anthropic повідомив про можливе порушення з боку трьох великих китайських розробників ШІ. За інформацією, оприлюдненою у виданні The Wall Street Journal, ці компанії створили понад 24 тисячі підроблених облікових записів для незаконного отримання інформації з флагманської моделі Claude, щоб навчити свої системи.
Використання дистиляції
Згідно з даними Anthropic, компанії DeepSeek, Moonshot AI і MiniMax згенерували більше 16 мільйонів запитів до Claude. Основна тактика, яку вони використали, – це дистиляція. Цей процес передбачає використання відповідей потужної моделі ШІ як навчального матеріалу для створення меншої й дешевшої програми.
Дистиляція має законне застосування, коли компанії намагаються створити зменшені копії своїх продуктів. Проте, така практика, якщо вона стосується чужих алгоритмів, дозволяє конкурентам значно заощаджувати на витратах на дослідження та розробки.
Звинувачення від OpenAI
Ці звинувачення з’явилися після того, як основний конкурент Anthropic – компанія OpenAI – направила листа американським конгресменам, в якому також звертала увагу на можливі порушення з боку DeepSeek.
Розвиток китайського ШІ
Китайські компанії демонструють активність у розробці нових моделей ШІ з покращеними можливостями логічного мислення та програмування. Наприклад, DeepSeek незабаром представить нову систему наступного покоління. Експерти відзначають, що стрімкий розвиток китайських фірм викликав підозри, що вони могли швидко наздогнати США завдяки методам дистиляції.
Дані з відкритих джерел
У своєму дослідженні представники DeepSeek раніше стверджували, що для навчання головної моделі V3 були використані лише звичайні вебсторінки та електронні книги. Однак компанія визнала, що деякі сайти могли містити інформацію, згенеровану моделями OpenAI.
На думку керівництва Anthropic, такі дії китайських розробників становлять загрозу національній безпеці США. Вони підкреслили, що можливість використання таких алгоритмів у військових та розвідувальних системах є серйозним викликом.
