第一财经

Борьба за дистилляцию: на кону право на развитие в эпоху интеллекта | Жаркие комментарии экспертов

原文:蒸馏之争,争的是智能时代的发展权|专家热评

Три американских ведомства обвиняют Китай в “злонамеренном переработке” искусственного интеллекта? Не позволяйте себя ввести в заблуждение – за этим стоит борьба за “кто здесь главный”

Здравствуйте, я ваш финансовый журналист и экономист. Недавно в технологических кругах разразился скандал: Агентство национальной безопасности США (NSA), Управление по кибербезопасности и безопасности инфраструктуры (CISA) и Федеральное бюро расследований (FBI) совместно выпустили заявление, в котором обвиняют китайские компании в области искусственного интеллекта в “промышленном масштабе” злонамеренной переработки данных, другими словами, утверждают, что мы “украли” их технологии.

Это звучит пугающе, как будто мы совершили какое-то серьезное преступление. Но если внимательно проанализировать логику этого заявления, становится ясно, что это не технический спор, а тщательно спланированный политический трюк. Сегодня я объясню вам, в чем дело.

I. Основной вывод: игра в двойные стандарты

В одном предложении: США политизировали изначально нейтральную технологию переработки знаний и, используя жалобы отдельных компаний, пытаются с помощью государственной силы сохранить свои монопольные позиции в области искусственного интеллекта и сдержать развитие китайских технологий.

Основная логическая цепочка:

1. Технология невиновна: Переработка знаний – это обычная практика в области искусственного интеллекта; это не похоже на кражу.

2. Обвинения без оснований: Доказательства со стороны США в основном основаны на заявлениях отдельных американских компаний (например, Anthropic) и не содержат достоверных технических доказательств; логика несостоятельна.

3. Нечистые мотивы: США одновременно запрещают Китаю использовать китайские чипы и обвиняют его в изучении их технологий с целью создания “защитного барьера из данных” и предотвращения китайского догоняющего развития.

4 Двойные стандарты: Американские компании активно используют китайские открытые исходные модели (например, DeepSeek, Qwen2) для дальнейшего инновационного развития, но при этом обвиняют китайские компании в изучении американских моделей.

5 Конечная цель: Сохранение технологического господства; превращение коммерческой конкуренции в вопрос национальной безопасности для последующего введения более строгих санкций.

---

II. Глубокий анализ: пять аспектов для понимания этого скандала

1. Что такое “переработка знаний”? Разве это действительно похоже на “кражу”?

Прежде всего, нужно разобраться, что такое переработка знаний. В области искусственного интеллекта переработка знаний (Knowledge Distillation) – это давно существующая и очень зрелая технология.

  • Простой пример: Представьте себе опытного профессора (большую модель искусственного интеллекта), который сжимает свои знания в упрощенное учебное пособие (маленькую модель). Ученик (маленькая модель) может быстро освоить основные знания, не читая все книги с самого начала.
  • Техническая суть: Это процесс, при котором большая модель “учит” маленькую, чтобы сделать ее меньше, быстрее и более энергоэффективной, чтобы она могла работать на мобильных устройствах, таких как телефоны и планшеты.
  • Исторические факты: Эта технология была предложена еще в 2015 году Нобелевским лауреатом Синтоном и другими учеными. Сама компания OpenAI ранее предлагала услуги по переработке моделей; после выпуска Qwen2 Alibaba также была быстро выпустила серию более маленьких моделей DistilQwen2.
  • Общепринятое мнение в отрасли: Американская промышленность это прекрасно понимает. Гендиректор Nvidia Дженсон Хуанг, Microsoft, Meta и еще 25 организаций совместно написали письмо, в котором указали, что переработка моделей – это обычный способ их улучшения и не должна считаться незаконным кражей.

Вывод: Переработка знаний – это инструмент ускорения технологического прогресса и эффективного распространения знаний. Называть это “злонамеренной кражей” так же нелогично, как считать, что студенты крадут конспекты на занятиях.

2. Надежны ли доказательства со стороны США? На самом деле у них много сомнений

Заявления трех американских ведомств звучат серьезно, но при внимательном рассмотрении становится ясно, что доказательства очень слабы, даже можно сказать, что это “самопроизвольные утверждения”.

  • Односторонние источники доказательств: Основные доказательства основаны на заявлениях отдельных американских компаний (например, Anthropic). Это как если бы сосед заявил, что вы украли у него вещи, и полиция арестовала вас на основании его слов – разве это разумно?
  • Отсутствие надежных доказательств: Anthropic утверждает, что тысячи пользователей посещали их модели, но они не могут предоставить прямых доказательств того, что эти данные были использованы для тренировки китайских моделей. Используемые ими доказательства – это IP-адреса, метаданные и другие косвенные улики.
  • Проблема 1: IP-адреса могут быть скрыты прокси-серверами или перепродавцами, поэтому невозможно точно определить конкретные компании.
  • Проблема 2: Получение данных не означает их использование; вы можете посетить сайт, но это не значит, что вы скачали их для тренировки модели – возможно, вы просто тестировали или просматривали контент.
  • Проблема технической “черной коробки”: Большие модели искусственного интеллекта являются “черными коробками”; после завершения тренировки очень сложно определить, какие именно данные были использованы для их создания. Это как если бы вы съели торт и пытались точно узнать, из какого сада взяты каждые виноградины.
  • Результаты независимых тестов: Китайский институт информационных и коммуникационных технологий провел тесты и обнаружил, что сходство между американскими моделями (например, разными версиями Claude) даже выше, чем сходство между китайскими моделями и американскими. Это говорит о том, что на заданиях с фиксированными ответами все модели дают похожие результаты, и это не является признаком плагиата.

Вывод: Обвинения США не подкреплены достоверными техническими доказательствами и в основном основаны на предположениях и коммерческих опасениях отдельных компаний.

3. “Двойные стандарты” американских компаний: с одной стороны используют китайские технологии, с другой стороны обвиняют Китай

Это самый ироничный момент. США обвиняют Китай в злонамеренной переработке данных, но сами активно используют китайские открытые модели для своих целей.

  • Примеры:
  • NVIDIA: При разработке серии моделей Nemotron они напрямую использовали данные, сгенерированные моделью DeepSeek-R1, и об этом публично заявили.
  • Стартап Perplexity: На основе DeepSeek-R1 они отладили собственную модель R1-1776.
  • Hugging Face: Запустили проект Open-R1, воссоздав модель DeepSeek-R1.
  • Microsoft, Amazon Web Services: Уже внедрили китайские модели, такие как Qwen2, в свои сервисы и предлагают их всему миру.
  • Сравнение данных: Количество производных моделей на основе Qwen превышает 100 000; в то время как использование американских моделей в Китае значительно ниже, чем использование китайских моделей в США.

Вывод: Американские компании пользуются удобствами и инновациями, предоставляемыми китайскими открытыми моделями, но при этом обвиняют китайские компании в изучении американских технологий. Такой подход, когда “своим можно все, а чужим нельзя”, явно свидетельствует о их желании сохранить монопольные позиции.

4. Настоящая цель: от “блокады чипов” к “блокаде данных”

Почему США решили раздувать этот скандал именно сейчас? Потому что одной блокады чипов уже недостаточно; они хотят построить еще один барьер.

  • Расширение монополии на вычислительные мощности: Ранее США использовали чипы (например, Nvidia GPU), чтобы ограничить возможности Китая в области тренировки больших моделей искусственного интеллекта. Теперь они видят, что Китай, несмотря на ограничения в вычислительных ресурсах, все равно может создавать высокопроизводительные модели с помощью алгоритмических оптимизаций и открытых технологий.
  • Создание “защитного барьера из данных”: Если выводы моделей считаются “защищенными активами”, то любое их использование может быть расценено как нарушение прав. Таким образом, только крупнейшие американские компании (например, OpenAI, Anthropic), обладающие самыми мощными моделями и большими данными, смогут безопасно развиваться, в то время как новые участники рынка (включая китайские компании и малые американские стартапы) столкнутся с серьезными юридическими рисками.
  • Политизация коммерческих споров: Обратите внимание на хронологию событий: в феврале OpenAI оказало давление на Конгресс, в апреле Белый дом выпустил меморандум, в июне были предложены меры по усилению сотрудничества, а в сентябре трех ведомств выпустили заявление. Это четкий путь от давления со стороны компаний к поддержке со стороны правительства и последующему введению регулирований. Они пытаются превратить обычную коммерческую конкуренцию (кто лучше в технологиях) в вопрос национальной безопасности, чтобы найти предлоги для последующих санкций, ограничений инвестиций и даже военного вмешательства.

Вывод: Цель США – не защита интеллектуальной собственности, а сохранение доли рынка и технологического господства. Их боятся не самих технологий, а того, что конкуренты могут сократить разрыв в их развитии законными с